Geri Dön

Dil modellerinin türkçe dilinde performanslarının iyileştirilmesi için farklı istem formatlarının kullanımı

The use of different prompt formats to improve the performance of language models in the turkish language

  1. Tez No: 955958
  2. Yazar: ERAY NURTEKİN
  3. Danışmanlar: DR. ÖĞR. ÜYESİ EMİR ÖZTÜRK
  4. Tez Türü: Yüksek Lisans
  5. Konular: Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve Kontrol, Computer Engineering and Computer Science and Control
  6. Anahtar Kelimeler: Belirtilmemiş.
  7. Yıl: 2025
  8. Dil: Türkçe
  9. Üniversite: Trakya Üniversitesi
  10. Enstitü: Fen Bilimleri Enstitüsü
  11. Ana Bilim Dalı: Veri Bilimi ve Analitiği Ana Bilim Dalı
  12. Bilim Dalı: Belirtilmemiş.
  13. Sayfa Sayısı: Belirtilmemiş.

Özet

Dil modelleri, etkin ince-ayarlama metotları ile herkes tarafından eğitilebilmekte ve özelleştirilerek farklı alanlarda kullanılabilmektedir. Dil modellerinin başarımı için genellikle kayıp veya doğruluk metrikleri kontrol kabul edilse de istem formatlarının seçimi de bu başarımı etkilemektedir. Bu çalışmada Llama2, Llama3 ve Mistral7B gibi büyük dil modellerinin yanı sıra küçük dil modeli olan Phi3 ile farklı iki veriseti üzerinde çeşitli yaygın olarak kullanılan istem formatlarının ve özelleştirilmiş Türkçe istem formatları ile birlikte denenmesi ile eğitilmiş ve başarım sonuçları karşılaştırılmıştır. Elde edilen bulgular ve sonuçlar neticesinde, yalnızca model mimarisinin değil, kullanılan istem formatının yapısının da başarım üzerinde kritik bir rol oynadığını göstermiş ve istem formatının değişikliğinin dil modellerinde performansı etkilediği gözlenmiştir. Bunlarla birlikte özelleştirilmiş istem formatı kabul edilebilir kayıp değerlerinde en iyi metrik sonuçlarını elde etmiştir.

Özet (Çeviri)

Language models can be trained and customized by anyone using effective finetuning methods, making them versatile tools across various domains. While metrics like loss and accuracy are commonly used to assess the performance of language models, the choice of prompt formats also plays a crucial role. In this study, large language models such as Llama2, Llama3 and Mistral7B, as well as the smaller Phi3 model, were trained and evaluated on two different datasets using both commonly used prompt formats and customized Turkish prompt formats. Based on the findings and results obtained, it has been demonstrated that not only the model architecture but also the structure of the prompt format plays a critical role in performance, and that changes in prompt formats can affect the performance of language models. Furthermore, the customized prompt format achieved the best metric results within acceptable loss values.

Benzer Tezler

  1. Türkçe klinik metinlerin derin öğrenme yaklaşımları ile sınıflandırılması

    Classification of Turkish clinical notes using deep learning techniques

    HAZAL TÜRKMEN

    Doktora

    Türkçe

    Türkçe

    2023

    Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve KontrolEge Üniversitesi

    Bilgisayar Mühendisliği Ana Bilim Dalı

    PROF. DR. OĞUZ DİKENELLİ

  2. Büyük dil modelleri ile yazılan kaynak kodların güvenlik analizi: Bankacılık sektörü uygulaması

    Security analysis of source codes written by large language models: An application to the banking industry

    RESUL SEZGİN ALBAYRAK

    Yüksek Lisans

    Türkçe

    Türkçe

    2026

    BankacılıkKocaeli Üniversitesi

    Bilgisayar Mühendisliği Ana Bilim Dalı

    YRD. DOÇ. DR. MELTEM KURT PEHLİVANOĞLU

  3. Sohbet robotu veri seti ile niyet sınıflandırmasında geleneksel ve modern yaklaşımların karşılaştırılması

    Comparison of traditional and modern methods in intent classification using a chatbot dataset

    KARDEL RÜVEYDA ÇETİN

    Yüksek Lisans

    Türkçe

    Türkçe

    2025

    Bilim ve TeknolojiYıldız Teknik Üniversitesi

    Matematik Mühendisliği Ana Bilim Dalı

    PROF. DR. FATMA AYDIN AKGÜN

  4. Mevcut derin doğal dil işleme modellerinin Türkçe özelinde performanslarının artırılması

    Improving the performance of existing deep natural language processing models in Turkish

    BİLAL KOBANOĞLU

    Doktora

    Türkçe

    Türkçe

    2025

    Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve Kontrolİstanbul Topkapı Üniversitesi

    Yönetim Bilişim Sistemleri Ana Bilim Dalı

    PROF. DR. FAZLI YILDIRIM

  5. A comprehensive multi-prompt evaluation of large language models on Turkish datasets

    Büyük dil modellerinin Türkçe veri kümeleri üzerinde kapsamlı ve çok-istemli değerlendirmesi

    MUSTAFA BURAK TOPAL

    Yüksek Lisans

    İngilizce

    İngilizce

    2025

    Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve KontrolBoğaziçi Üniversitesi

    Bilgisayar Mühendisliği Ana Bilim Dalı

    DR. ÖĞR. ÜYESİ EMRE UĞUR

    PROF. AYŞE BAŞAR