Geri Dön

Using data mining for analyzing effects of biomarkers on decision of depression levels

Bioişaretlerin depresyon düzeyine karar vermedeki etkisinin veri madenciliği kullanarak analizi

  1. Tez No: 740120
  2. Yazar: RAHMİ KAVAK
  3. Danışmanlar: PROF. DR. SELMA AYŞE ÖZEL
  4. Tez Türü: Yüksek Lisans
  5. Konular: Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve Kontrol, Computer Engineering and Computer Science and Control
  6. Anahtar Kelimeler: Biyobelirteçler, Depresyon, Sınıflandırma, Veri madenciliği, Ön işlemler, Biomarkers, Depression, Classification, Data mining, Pre-transactions
  7. Yıl: 2022
  8. Dil: İngilizce
  9. Üniversite: Çukurova Üniversitesi
  10. Enstitü: Fen Bilimleri Enstitüsü
  11. Ana Bilim Dalı: Bilgisayar Mühendisliği Ana Bilim Dalı
  12. Bilim Dalı: Belirtilmemiş.
  13. Sayfa Sayısı: Belirtilmemiş.

Özet

Depresyon, kalıcı bir üzüntü hissine ve ilgi kaybına neden olan bir duygu durum bozukluğudur. Birçok duygusal ve fiziksel etkene bağlı olduğu için teşhis edilmesi zor bir sağlık sorunudur. Depresyonun erken teşhis edilmesi, intihar gibi ciddi sonuçları olan durumları önlemeye yardımcı olmaktadır. Bu çalışmanın amacı, veri ön işleme tekniklerini kullanarak eksik ve gürültülü sağlık verilerinden düzenli bir veri seti elde etmek ve bu veri seti üzerinde ilk kez veri madenciliği yöntemleri uygulanarak depresyon seviyesi tanısında psikoterapistlere yardımcı olacak bir model geliştirmektir. Ayrıca veri setinde yer alan kan biyobelirteçlerinin depresyon ile ilişkisi incelenmektedir. Önerilen modelin öğrenilmesi ve test edilmesi için Adana Dr. Ekrem Tok Ruh Sağlığı Hastanesi'nden alınan veri seti kullanılmaktadır. Eksik veri tamamlama için k-En Yakın Komşu (kNN), Zincirlenmiş Denklemlerle Çok Değişkenli İmputasyon (MICE) ve Rastgele Orman (missForest) yöntemleri uygulanmıştır. Tıbbi veri setleri üzerinde daha önce uygulanmış ve başarısı ispatlanmış olan k-En Yakın Komşu (kNN), Rastgele Orman (RF) ve Çok Katmanlı Algılayıcı (MLP) sınıflayıcıları uygulanarak veri seti sınıflandırılmıştır. Performans değerlendirme kriteri olarak doğruluk ve F-skoru metrikleri kullanılmıştır. En iyi başarı oranı Rastgele Ormanlar sınıflayıcısı ile elde edilmiştir (Doğruluk=0.557 ve F-skoru=0.268). Üç özellik seçim yöntemi tarafından ortaklaşa seçilen en önemli 5 biyobelirteç şu şekildedir: Kreatinin (kanda), HIV Combi, Üre, HBs Ab ve HBsAg.

Özet (Çeviri)

Depression is a mood disorder that causes a persistent feeling of sadness and loss of interest. It is a difficult health problem to diagnose because it depends on many emotional and physical factors. Early detection of depression helps prevent situations with serious consequences such as suicide. The aim of this study is to obtain a clean data set from an incomplete and noisy health data using data preprocessing techniques and to develop a model that will help psychotherapists in the diagnosis of depression for the first time by applying data mining methods. In addition, the relationship between the blood biomarkers in the data set and depression is examined. To train and test the classification model, the data set from Adana Dr. Ekrem Tok Mental Health Hospital is obtained and used. For missing data completion, k-Nearest Neighbor (kNN), Multivariate Imputation by Chained Equations (MICE) and Random Forest (missForest) methods were applied. The data set was classified by applying the k-Nearest Neighbors (kNN), Random Forests (RF) and Multilayer Perceptron (MLP) classifiers, which were previously applied and proven to be successful on medical data sets. Accuracy and F-measure metrics were used as performance evaluation criteria. The best success rate was obtained with the Random Forests classifier (Accuracy=0.557 and F-measure=0.268). The 5 most important biomarkers that are jointly selected by the three feature selection methods are as follows: Creatinin (in blood), HIV Combi, Urea, HBs Ab and HBsAg.

Benzer Tezler

  1. Analysing effects of global warming on earth using data mining methods

    Küresel ısınmanın dünyaya etkilerinin veri madenciliği yöntemi ile analizi

    KIVANÇ KILIÇER

    Yüksek Lisans

    İngilizce

    İngilizce

    2006

    Bilim ve TeknolojiBahçeşehir Üniversitesi

    Bilgi Teknolojileri Ana Bilim Dalı

    YRD. DOÇ. DR. ADEM KARAHOCA

  2. Sakarya büyükşehir belediyesine ait evrak verilerinin veri madenciliği yöntemleri ile incelenmesi

    Analysis of document datas of sakarya metropolitan municipality using data mining methods

    ENGİN UÇAR

    Yüksek Lisans

    Türkçe

    Türkçe

    2025

    Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve KontrolSakarya Üniversitesi

    Bilgisayar Mühendisliği Ana Bilim Dalı

    PROF. DR. NİLÜFER YURTAY

  3. Sağlık harcamaları belirleyicilerinin veri madenciliği yöntemleri ile modellenmesi

    The modeling of determinants of health expenditures using data mining methods

    MELİHA MELİŞ GÜNALTAY

    Doktora

    Türkçe

    Türkçe

    2024

    Sağlık YönetimiAnkara Üniversitesi

    Sağlık Yönetimi Ana Bilim Dalı

    PROF. DR. GÜLBİYE YAŞAR

  4. Web portallarında kullanıcı davranışlarının yerinde tespiti ve web madenciliğinde kullanımı için yenilikçi bir yaklaşım

    An innovative approach for on-premises detection of user behaviors on web portals and its use in web mining

    ÖZKAN CANAY

    Doktora

    Türkçe

    Türkçe

    2024

    Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve KontrolSakarya Üniversitesi

    Bilgisayar Mühendisliği Ana Bilim Dalı

    PROF. DR. ÜMİT KOCABIÇAK

  5. Machine learning analysis of biofuels using published data

    Yayınlanmış veriler ile biyoyakıtların makine öğrenimi analizi

    AHMET COŞGUN

    Doktora

    İngilizce

    İngilizce

    2024

    Kimya MühendisliğiBoğaziçi Üniversitesi

    Kimya Mühendisliği Ana Bilim Dalı

    PROF. DR. RAMAZAN YILDIRIM