Geri Dön

Bağlı veri kaynakları ve ilişkileri kullanılarak haberlerin öbeklendirilmesi

News clustering using linked data resources and their relationships

  1. Tez No: 450647
  2. Yazar: MEHMET MERT YÜCESAN
  3. Danışmanlar: PROF. DR. ERDOĞAN DOĞDU
  4. Tez Türü: Yüksek Lisans
  5. Konular: Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve Kontrol, Computer Engineering and Computer Science and Control
  6. Anahtar Kelimeler: Kümeleme analizi, Makine öğrenmesi yöntemleri, Veri madenciliği, Cluster analysis, Machine learning methods, Data mining
  7. Yıl: 2016
  8. Dil: Türkçe
  9. Üniversite: Tobb Ekonomi ve Teknoloji Üniversitesi
  10. Enstitü: Fen Bilimleri Enstitüsü
  11. Ana Bilim Dalı: Bilgisayar Mühendisliği Ana Bilim Dalı
  12. Bilim Dalı: Bilgisayar Mühendisliği Bilim Dalı
  13. Sayfa Sayısı: Belirtilmemiş.

Özet

Metin veya doküman öbeklendirilmesi, aynı konuyla ilgili olan metin belgelerinin belirlenerek gruplandırılması işlemidir. Bu işlem, metin belgelerinin sayısının artmaya devam ettiği sürekli büyüyen Web için özellikle önemlidir. Haber öbeklendirilmesi bu alanda, haber belgelerinin konu bazında sınıflandırılmasının hedeflendiği özel bir konudur. Bu probleme ilişkin daha önce geliştirilmiş çözümler, belgelerin içlerinde geçen kelimelerle ve bu kelimelerin sıklıklarıyla temsil edildiği ``sözcük çantası'' yaklaşımını kullanmıştır ve öbeklendirme işlemi belgelerin bu gösterimi kullanılarak ölçülen benzerlikler kullanılarak yapılmıştır. Bununla birlikte, bu yaklaşım sözcüklerin anlamını veya önemini dikkate almaz ve sözcüklerdeki muğlaklık çözümlenmez. Bu çalışmada doküman veya haber öbeklendirilmesi konusunda ``bağlı veri'' kullanan yeni bir yaklaşım geliştirilmiştir. Bu yaklaşımda haber belgelerindeki sözcükler ve cümleler, DBpedia gibi bağlı veri bilgi tabanlarındaki gerçek dünya karşılıklarına eşlenir ve belgeler sahip oldukları bağlı veri varlıklarıyla temsil edilmektedir. Daha sonra haberler bu varlıklar ve bu varlıkların kategori hiyerarşisi benzerlikleri kullanılarak öbeklendirilmektedir. Değerlendirme sonuçları, geliştirilen yaklaşımın kelime çantasına göre daha iyi sonuç verdiğini göstermektedir.

Özet (Çeviri)

Text clustering or document clustering is the task of identifying and grouping text documents that are about the same topic. This is especially important for the ever growing Web where the number of free-text documents just keep increasing. News clustering is a special task in this domain in which the goal is to classify news documents by topic. Earlier solutions on this problem utilized ``bag of words'' approach in which documents are represented with words and their frequencies in documents, and the clustering task measures the similarity of documents using this representation. However, this approach does not take into consideration the meaning or the importance of words and ambiguity in words is not resolved. We present a new approach to document or news clustering, we utilize ``linked data''. We map words or phrases in news documents to their real-world counterparts in ``linked data'' knowledge bases such as DBpedia and represent documents with linked data entities they have. Then we cluster documents using these entities and their category hierarchy similarities. Evaluation results show that our approach performs better than the bag of words approach.

Benzer Tezler

  1. Denizcilik işletmelerine yönelik entelektüel sermaye değerlemesi üzerine bir model önerisi

    A model proposal on valuation for intellectual capital of maritime businesses

    GİZEM ÇEVİK

    Doktora

    Türkçe

    Türkçe

    2023

    Denizcilikİstanbul Teknik Üniversitesi

    Deniz Ulaştırma İşletme Mühendisliği Ana Bilim Dalı

    PROF. DR. ÖZCAN ARSLAN

  2. Mobil telefon kullanımına bağlı oluşan 900-1800 mhz radyo frekans dalgalarının meydana getirdiği elektromanyetik alanın iliak kanat kemik mineral yoğunluğuna etkisi

    The effect of electromagnetic fields on bone mineral density of iliac bone produced by 900-1800 mhz radio frequency waves dependent on cellular phone usage

    BEŞİR ANDAÇ AKSOY

    Tıpta Uzmanlık

    Türkçe

    Türkçe

    2006

    Ortopedi ve TravmatolojiSüleyman Demirel Üniversitesi

    Ortopedi ve Travmatoloji Ana Bilim Dalı

    PROF.DR. NEVRES HÜRRİYET AYDOĞAN

  3. Implementation of a topic map data model for a web-based information resource

    Web tabanlı bilgi kaynakları için bir kavram haritası veri modeli gerçekleştirimi

    MUSTAFA KUTUTÜRK

    Yüksek Lisans

    İngilizce

    İngilizce

    2002

    Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve Kontrolİhsan Doğramacı Bilkent Üniversitesi

    Bilgisayar Mühendisliği Ana Bilim Dalı

    DOÇ. DR. ÖZGÜR ULUSOY

  4. Derin öğrenme ve büyük veri analitiği yöntemleriKullanarak Covid-19 yayılımının ileriye dönük tahmini

    Forecasting the spread of covid-19 using deep learning and big data analytics methods

    CYLAS KIGANDA

    Yüksek Lisans

    İngilizce

    İngilizce

    2023

    Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve KontrolGazi Üniversitesi

    Bilgisayar Bilimleri Ana Bilim Dalı

    PROF. DR. MUHAMMET ALİ AKCAYOL

  5. Sınıf öğretmenlerinin kendini kabul düzeyleri ile mesleki doyum kaynakları arasındaki ilişkinin incelenmesi

    The Analysis of the relation between the level of self acceptance and the sources of occupational satisfaction of the teachers of primary school

    ŞEREF ALTUNOK

    Yüksek Lisans

    Türkçe

    Türkçe

    2003

    Eğitim ve ÖğretimAtatürk Üniversitesi

    Eğitim Bilimleri Ana Bilim Dalı

    DOÇ. DR. SIRRI AKBABA