Geri Dön

Noun phrase chunker for Turkish using dependency parser

Türkçe için bağımlı çözümleyici kullanarak isim tamlaması çıkarımı

  1. Tez No: 266043
  2. Yazar: MÜCAHİD KUTLU
  3. Danışmanlar: DR. İLYAS ÇİÇEKLİ, PROF. DR. ÖZGÜR ULUSOY
  4. Tez Türü: Yüksek Lisans
  5. Konular: Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve Kontrol, Computer Engineering and Computer Science and Control
  6. Anahtar Kelimeler: Doğal dil işleme, Türkçe, Türkçe adlar, Natural language processing, Turkish, Turkish nouns
  7. Yıl: 2010
  8. Dil: İngilizce
  9. Üniversite: İhsan Doğramacı Bilkent Üniversitesi
  10. Enstitü: Mühendislik ve Fen Bilimleri Enstitüsü
  11. Ana Bilim Dalı: Bilgisayar Mühendisliği Ana Bilim Dalı
  12. Bilim Dalı: Belirtilmemiş.
  13. Sayfa Sayısı: Belirtilmemiş.

Özet

İsim tamlaması çıkarımı bir çok doğal dil işleme konusunda kullanılabilen yüzeysel çözümlemenin alt kategorisidir. Bu tezde, biz Türkçe metinler için bir isim tamlaması çıkarımı sistemi öneriyoruz. Cümle bileşkenleri arasındaki ilişkiyi göstermek ve isim tamlamalarını bulmak için ağırlıklı bir kısıtlayıcı bağımlı çözümleyici kullanıyoruz.Bağımlı çözümleyici kısıtlamaları belirlemek için, manual olarak oluşturulan ve biçimbirimsel ve anlamsal bilgileri birleştirebilen etkili kurallar kullanır. Kurallar esnek yapıları gereği karmaşık isim tamlamaları yapılarını çözmek için uygundur. Kural dizisi değiştirilerek bağımlı çözümleyici diğer tüm cümle parçacığı çeşitlerini içeren bir yüzeysel çözümleyici olarak da kolaylıkla kullanılabilir.Türkçe için insanlar tarafından oluşturulmuş güvenilir bir veri grubunun olmaması Türkçe ile ilgili olan doğal dil işleme çalışmalarını için önemli bir problemdir. Bu yüzden, Türkçe için ilk isim tamlaması veri gruplarını oluşturduk. Bu veri grupları üzerinde yaptığımız testlere göre, bizim önerdiğimiz isim tamlaması çıkarımı sistemimiz, umut verici sonuçlarvermektedir.Kelimelerin biçimbirimsel bilgisini bilmek bağımlı çözümleyicinin doğru çalışması için önemlidir. Bu yüzden, bu tezde, istatistiksel bilgi ile, elle oluşturulmuş gramer kuralları ile dönüşüm bazlı öğrenilmiş kuralları bir arada kullanan hibrit bir biçimbirimsel belirsizliği giderme tekniği önerdik. Ayrıca bizim belirsizlik giderici sistemimizin performansını ölçmek için bir veri grubu oluşturduk. Yaptığımız testlere göre, bizim önerdiğimiz sistem umut verici sonuçlar vermektedir.

Özet (Çeviri)

Noun phrase chunking is a sub-category of shallow parsing that can be used formany natural language processing tasks. In this thesis, we propose a noun phrasechunker system for Turkish texts. We use a weighted constraint dependencyparser to represent the relationship between sentence components and to determine noun phrases.The dependency parser uses a set of hand-crafted rules which can combinemorphological and semantic information for constraints. The rules are suitablefor handling complex noun phrase structures because of their flexibility. Thedeveloped dependency parser can be easily used for shallow parsing of allphrase types by changing the employed rule set.The lack of reliable human tagged datasets is a significant problem fornatural language studies about Turkish. Therefore, we constructed the first nounphrase dataset for Turkish. According to our evaluation results, our noun phrasechunker gives promising results on this dataset.The correct morphological disambiguation of words is required for thecorrectness of the dependency parser. Therefore, in this thesis, we propose ahybrid morphological disambiguation technique which combines statisticalinformation, hand-crafted grammar rules, and transformation based learningrules. We have also constructed a dataset for testing the performance of ourdisambiguation system. According to tests, the disambiguation system is highlyeffective.

Benzer Tezler

  1. Türkçe cümlelerde isim tamlamalarının bulunması

    Noun phrase chunking of Turkish sentences

    KÜBRA ADALI

    Yüksek Lisans

    Türkçe

    Türkçe

    2014

    Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve Kontrolİstanbul Teknik Üniversitesi

    Bilgisayar Mühendisliği Ana Bilim Dalı

    YRD. DOÇ. DR. AHMET CÜNEYD TANTUĞ

  2. Türkçe tümcelerin öğelerinin bulunması

    Finding constituents of Turkish sentences

    NİLAY COŞKUN

    Yüksek Lisans

    Türkçe

    Türkçe

    2013

    Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve Kontrolİstanbul Teknik Üniversitesi

    Bilgisayar Mühendisliği Ana Bilim Dalı

    PROF. DR. EŞREF ADALI

  3. The noun phrase accessibility hierarchy (NPAH) in the acquisition of English restrictive relative clauses by Turkish adult learners of English

    Yetişkin Türk öğrencilerinin ilgi tümcelerini öğrenmede izledikleri sıra ve bunun ad öbeklerinin erişimlik sıralaması (NPAH) ile bağlantısı

    AYNUR BAYSAL

    Doktora

    İngilizce

    İngilizce

    1999

    İngiliz Dili ve EdebiyatıAnadolu Üniversitesi

    İngiliz Dili Eğitimi Ana Bilim Dalı

    PROF. DR. GÜL DURMUŞOĞLU KÖSE

  4. A Cross-linguistic study of noun phrase complexity in english-dominant and turkish efl writers' graduate level academic writing in foreign policy

    Baskın dili ingilizce olan yazarların ve yabancı dili ingilizce olan türk yazarların lisansüstü düzeyde dış politika üzerine yazılarında isim tamlaması karmaşıklığının dillerarası bir çalışması

    ELİF NUR ALTUNTAŞ

    Yüksek Lisans

    İngilizce

    İngilizce

    2025

    Dilbilimİhsan Doğramacı Bilkent Üniversitesi

    Yabancı Dil Olarak İngilizce Öğretimi Ana Bilim Dalı

    DR. ÖĞR. ÜYESİ TİJEN AKŞİT

  5. Subject positions case checking and epp in complex noun phrase constructions in Turkish

    Türkçede karmaşık ad öbeği yapılarında özne konumları ismin durumlarını denetleme ve genişletilmiş yansıma ilkesi

    ASLI GÜRER

    Yüksek Lisans

    İngilizce

    İngilizce

    2010

    DilbilimBoğaziçi Üniversitesi

    Dilbilim Ana Bilim Dalı

    PROF. DR. A. SUMRU ÖZSOY