Computer processing of Turkish: Morphological and lexical investigation
Başlık çevirisi mevcut değil.
- Tez No: 38440
- Danışmanlar: PROF.DR. SELAHATTİN KURU
- Tez Türü: Doktora
- Konular: Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve Kontrol, Dilbilim, Computer Engineering and Computer Science and Control, Linguistics
- Anahtar Kelimeler: Bilgisayarlı dilbilimi, Doğal dil işleme, Biçimbilimsel analiz, Türkçe, Genişletilmiş geçiş ağları, Yazım kontrolü, Metin, Biçimbilim, Computational linguistics, Natural language processing, Morphological analysis, Turkish, Augmented transition networks, Spelling checking, Corpus IV, Morphology
- Yıl: 1995
- Dil: İngilizce
- Üniversite: Boğaziçi Üniversitesi
- Enstitü: Fen Bilimleri Enstitüsü
- Ana Bilim Dalı: Belirtilmemiş.
- Bilim Dalı: Belirtilmemiş.
- Sayfa Sayısı: Belirtilmemiş.
Özet
ÖZET Bu tezin konusu Türkçe'nin biçimbiliminin incelenmesidir. Türkçe bitişimli diller grubuna dahildir. Bu özelliğinden dolayı Türkçe'nin biçimbilimi oldukça karmaşıktır ve pek çok istisnai durumlar içerir. Son zamanlarda yapılan çalışmalarda dilin sadece bir kısmı incelenmiştir. Bu çalışmalar özellikle temel bazı kuralların açıklanması ve gösterilmesi üzerine kurulmuştur. Bu tezin başlıca amacı, Türkçe'nin tüm biçimbilimsel yapısını açığa çıkarmak ve bu yapının bilgisayardaki gösterimini oluşturmaktır. Bu işlem tamamlanmadan, dilin sözdizimsel ve anlambilimsel olarak incelenmesi hemen hemen olanaksızdır. Bu çalışmada biçimbilim analizini iki kısma ayırıyoruz: Eklerin yapısının ve sıralanmasının incelenmesi. Dilin biçimbilimini bu iki kısmı göz önüne alarak tanımlayacağız. Daha sonra bu tanımlamaları Genişletilmiş Geçiş Ağı formasyonunda birleştireceğiz. Böylece, Türkçe'nin biçimbilimsel yapısının bilgisayardaki gösterimini elde edeceğiz. Bu önerilen yapı, Türkçe konusundaki dil uygulamaları için bir temel oluşturacaktır. Bu uygulamalar arasından, bir biçimbilimsel tarama programı ile yazım düzeltme elemanı da içeren bir yazım kontrol programı hazırlayacağız. Bu biçimbilimsel gösterimi ve hazırlanan programları kullanarak Türkçe hakkında istatistik bilgi üreteceğiz. Bu üretim iki kısımdan oluşuyor: sözlük ve biçimbilimi analizi ile metin analizi. Bunlardan ilki dilin yapısal kısımları hakkındaki bilgilerden yararlanır. İkincisi ise dilin günlük kullanımıyla ilgilidir. Bu amaçla, bir metin oluşturacağız ve yazım kontrol programını bu metin üzerinde çalıştıracağız.
Özet (Çeviri)
ABSTRACT The morphological analysis of Turkish is the subject of this thesis. Turkish belongs to the group of agglutinative languages. Because of its agglutinative nature, Turkish morphology is quite complex and includes many exceptional cases. Most recent research on Turkish morphology have limited themselves with a partial treatment of the language. The study has concentrated especially on the explanation and representation of the basic rules. The main objective of this thesis is to bring the full morphological structure of Turkish to light and to build its computer representation. Before this analysis is handled, the syntactic or semantic parsing of the language is quite impossible. In this study, we divide the analysis of the morphology into two interrelated parts: morphophonemic analysis and morphotactic analysis. We investigate and define the morphological structure for both of these. Then we combine these in the Augmented Transition Network (ATN) formalism. This forms the formal representation of the Turkish morphological structure. This proposed morphological structure forms a basis for the language applications about Turkish. Among these applications, we design and implement a morphological parser and a spelling checker which incorporates a spelling corrector component. We perform statistical analysis of Turkish based on this morphological representation and the implemented programs. This analysis is formed of two parts: lexical and morphological analysis, and corpus analysis. The first one uses the information about the structural parts of the language. The second one deals with the daily usage of the language. For this purpose, we form a corpus and run the spelling checker program on this corpus.
Benzer Tezler
- Bir robot koluna kumanda eden doğal dil anlama sistemi
Başlık çevirisi yok
HASAN FERİT KEÇECİ
Yüksek Lisans
Türkçe
1996
Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve Kontrolİstanbul Teknik ÜniversitesiPROF.DR. EŞREF ADALI
- Design and implementation of a computational lexicon for Turkish
Türkçe için bir hesapsal sözlüğün tasarımı ve gerçekleştirilmesi
ABDULLAH KURTULUŞ YORULMAZ
Yüksek Lisans
İngilizce
1997
Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve Kontrolİhsan Doğramacı Bilkent ÜniversitesiYRD. DOÇ. DR. KEMAL OFLAZER
- Tagging and morphological disambiguation of turkish text
Türkçe metinlerin işaretlenmesi ve biçimbirimsel çokyapılılık çözümlemesi
İLKER KURUÖZ
Yüksek Lisans
İngilizce
1994
Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve Kontrolİhsan Doğramacı Bilkent ÜniversitesiBilgisayar Mühendisliği Ana Bilim Dalı
YRD. DOÇ. DR. KEMAL OFLAZER
- Turkish text generation with systemic- functional grammar
Sistemik-fonksiyonel gramer yaklaşımı ile Türkçe metin üretimi
TURGAY KORKMAZ
Yüksek Lisans
İngilizce
1996
Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve Kontrolİhsan Doğramacı Bilkent ÜniversitesiY.DOÇ.DR. İLYAS ÇİÇEKLİ
- A Statistical information extraction system for Turkish
Türkçe için istatistiksel bir bilgi çıkarım sistemi
GÖKHAN TÜR
Doktora
İngilizce
2000
Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve Kontrolİhsan Doğramacı Bilkent ÜniversitesiBilgisayar Mühendisliği Ana Bilim Dalı
DOÇ. DR. KEMAL OFLAZER