Doğal dil işleme modeli kullanılarak kan test verilerinden kişisel sağlık asistanı geliştirilmesi
Development of a personal health assistant using a natural language processing model based on blood test data
- Tez No: 1022163
- Danışmanlar: DOÇ. DR. ÖZAL YILDIRIM
- Tez Türü: Yüksek Lisans
- Konular: Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve Kontrol, Halk Sağlığı, Computer Engineering and Computer Science and Control, Public Health
- Anahtar Kelimeler: Akıllı asistanlar, Doğal dil işleme, Elektronik sağlık, Kan, Kliniksel laboratuvar teknikleri, Sanal asistan, Sağlık okuryazarlığı, Tıbbi bilişim uygulamaları, İnsan-yapay zeka etkileşimi, Smart assistants, Natural language processing, E-health, Blood, Clinical laboratory techniques, Virtual assistant, Health literacy, Medical informatics applications, Human-artificial intelligence interaction
- Yıl: 2026
- Dil: Türkçe
- Üniversite: Fırat Üniversitesi
- Enstitü: Fen Bilimleri Enstitüsü
- Ana Bilim Dalı: Yazılım Mühendisliği Ana Bilim Dalı
- Bilim Dalı: Belirtilmemiş.
- Sayfa Sayısı: Belirtilmemiş.
Özet
Klinik laboratuvar raporları, içerdikleri yoğun terminoloji ve sayısal veri nedeniyle tıp eğitimi almamış hastalar için güç bir okuma metnidir; sağlık okuryazarlığı düşük olduğunda hasta sonucunu yanlış yorumlayabilir, gereksiz kaygıya kapılabilir ya da kritik bir bulguyu gözden kaçırabilir. Bu tez, e-Nabız kan tahlil raporlarını hasta-dostu bir dille açıklayan, uçtan uca bir kişisel sağlık asistanı prototipi sunar. Sistem, metin katmanlı e-Nabız PDF'lerinden parametre adı, ölçüm değeri ve referans aralıklarını pdfplumber ile çıkarır; düzenli ifadeler ve satır temelli bir ayrıştırıcıyla yapılandırır; adlandırma farklılıklarını rapidfuzz tabanlı esnek eşleştirmeyle giderir. Her parametreye Normal, Takip veya Kritik etiketi, ölçülen değerin referans aralığından bağıl sapmasına dayanan ve %80 sapma eşiğini kullanan deterministik bir kuralla atanır; bu karar öğrenilmiş bir modele değil sabit bir ölçüte bağlıdır. Düşük sıcaklıkta (temperature = 0,3) ve JSON çıktı kipinde çalıştırılan Gemini 2.0 Flash Lite modeli, bu etiketli bağlamı hastanın öyküsüyle (şikâyet, ilaç, yaşam tarzı ve bilinen hastalıklar) birleştirerek hasta-dostu bir açıklamaya dönüştürür ve kişiye özel, hekime yönlendiren öneriler üretir; belirleyici risk kararı yine deterministik kurala aittir ve model tanı, tedavi ya da doz önerisi üretmez. Değerlendirme, 13 katılımcıya ait 55 e-Nabız raporundan oluşan bir veri kümesi üzerinde yürütülmüştür. Örneklenen 25 raporda benzersiz parametre düzeyinde doğrulanan çıkarım %99,5 duyarlılık, %90,0 kesinlik ve %94,5 F1 skoru vermiş; tüm kümede altın standart etiket dağılımı Normal %87,9, Takip %10,8 ve Kritik %1,3 olarak belirlenmiştir. Üç hekimin toplam 15 raporu bütüncül değerlendirdiği pilot bir klinik incelemede ortalama Likert puanları tıbbi doğruluk için 3,67/5, anlaşılabilirlik için 4,00/5 olmuş; dört maddelik“kırmızı çizgi”güvenlik kontrol listesinde hiçbir değerlendirmede halüsinasyona rastlanmamış (0/3), açıklamaların tamamı hastaya gösterilebilir bulunmuş (3/3), kritik değer atlamama ve doğru hekim yönlendirmesinde ise üçte iki olumlu sonuç alınmıştır (2/3). Bulgular, deterministik bir güvenlik katmanıyla desteklenen LLM tabanlı bir asistanın hastaların kendi sağlık verilerini anlamasına yardımcı olabileceğine işaret eder; sınırlı örneklem ve pilot ölçek nedeniyle sonuçlar bir kavram kanıtı (proof-of-concept) niteliğindedir ve daha geniş, çok hekimli bir değerlendirmeyle doğrulanmalıdır.
Özet (Çeviri)
Clinical laboratory reports are a core component of diagnosis and follow-up, yet the dense terminology and numerical data they contain make them a difficult text for patients without medical training. Where health literacy is low, a patient may misinterpret a result, experience unnecessary anxiety, or overlook a critical finding. This thesis presents an end-to-end personal health assistant prototype that explains e-Nabız blood test reports in patient-friendly language. The system extracts parameter names, measured values, and reference ranges from text-layer e-Nabız PDF files usingpdfplumber; structures them with regular-expression patterns and a line-based parser; and resolves naming variations through rapidfuzz-based fuzzy matching. The Normal, Follow-up, or Critical label of each parameter is assigned by a deterministic rule operating on the relative deviation of the measured value from its reference range; this decision depends not on a learned model but on a fixed criterion based on an 80% deviation threshold. The language model turns this labeled context — combined with the patient's history (symptoms, medications, lifestyle, harmful habits, and known conditions) — into a patient-friendly explanation and personalized, physician-referring recommendations, while the risk decision remains with the deterministic rule and the model makes no diagnosis, treatment, or dosage suggestion. For this purpose, configured to return JSON output and run at low temperature (temperature = 0.3), the Gemini 2.0 Flash Lite model is used; the system also supports llama-3.3-70b-versatile via Groq Cloud as a configurable alternative, although all results in this thesis — including the clinical evaluation — were produced with Gemini. Evaluation was carried out on a dataset of 55 e-Nabız reports from 13 participants. On 25 reports sampled from this set, parameter extraction was verified at the level of unique within-report parameter keys, yielding 99.5% recall, 90.0% precision, and a 94.5% F1 score; the ground-truth label distribution across the full dataset was Normal 87.9%, Follow-up 10.8%, and Critical 1.3%. In a pilot clinical evaluation in which three physicians holistically assessed 15 reports in total (five each), mean Likert scores were 3.67/5 for medical accuracy and 4.00/5 for readability; on a four-item“red-line”safety checklist no hallucination was observed in any assessment (0/3) and all generated explanations were judged safe to show to the patient (3/3); on the critical-value-omission and correct-referral items, two of the three assessments were positive (2/3). Preliminary findings suggest that an LLM-based assistant supported by a deterministic safety layer can help patients understand their own health data. Owing to the limited sample size and the pilot-scale clinical evaluation, these results constitute a proof-ofconcept and require validation on a larger cohort with multi-physician assessment.
Benzer Tezler
- Yeni Cami'nin akustik açıdan performans değerlendirmesi
Evaluation of the acoustical performance of the New Mosque
EVREN YILDIRIM
Yüksek Lisans
Türkçe
2003
Mimarlıkİstanbul Teknik ÜniversitesiMimarlık Ana Bilim Dalı
PROF. DR. SEVTAP YILMAZ DEMİRKALE
- An investigation of the performance of text mining-based text representation and classification methods on different datasets
Farklı veri kümeleri üzerinde metin madenciliği tabanlı metin temsili ve sınıflandırma yöntemlerinin performansının incelenmesi
ABDULKERİM BEKAR
Yüksek Lisans
İngilizce
2026
Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve Kontrolİstanbul Teknik ÜniversitesiVeri Mühendisliği ve İş Analitiği Ana Bilim Dalı (disiplinlerarası)
DR. ÖĞR. ÜYESİ MEHMET ALİ ERGÜN
- Gestion de performance avec DEA en utilisant les extensions de controle des poids, d'efficacite croisee et d'analyse de fenetre
Ağırlık kısıtlamaları, çapraz etkinlik ve pencere analizi yöntemleri kullanılarak veri zarflama analizi ile performans yönetimi
FİRÜZAN İŞCAN
Yüksek Lisans
Fransızca
1999
Endüstri ve Endüstri MühendisliğiGalatasaray ÜniversitesiEndüstri Mühendisliği Ana Bilim Dalı
DOÇ. DR. E. ERTUĞRUL KARSAK
- Stance detection in Turkish dataset on Russia-Ukraine war
Rusya-Ukrayna savaşı hakkında Türkçe verisetinde duruş tespiti
ERAY FIRAT
Yüksek Lisans
İngilizce
2023
Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve KontrolÇankaya ÜniversitesiBilgisayar Mühendisliği Ana Bilim Dalı
DR. ÖĞR. ÜYESİ SERDAR ARSLAN
- Hakem atama otomasyonu için bir karar destek sistemi: Doğal dil işleme ve veri-güdümlü optimizasyon ile bütünleşik bir yaklaşım
A decision support system for reviewer assignment automation: An integrated approach with natural language processing and data-driven optimization
MELTEM AKSOY
Doktora
Türkçe
2023
Endüstri ve Endüstri Mühendisliğiİstanbul Teknik ÜniversitesiEndüstri Mühendisliği Ana Bilim Dalı
DOÇ. DR. SEDA YANIK ÖZBAY
PROF. DR. MEHMET FATİH AMASYALI