Geri Dön

Enhancing COVID-19 patient prediction with over-sampling and genetic feature selection

Başlık çevirisi mevcut değil.

  1. Tez No: 796437
  2. Yazar: YASIR ALI MOHAMMED ALI AL-TAHHAN
  3. Danışmanlar: DR. ÖĞR. ÜYESİ OĞUZ ATA
  4. Tez Türü: Yüksek Lisans
  5. Konular: Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve Kontrol, Computer Engineering and Computer Science and Control
  6. Anahtar Kelimeler: Belirtilmemiş.
  7. Yıl: 2022
  8. Dil: İngilizce
  9. Üniversite: Altınbaş Üniversitesi
  10. Enstitü: Lisansüstü Eğitim Enstitüsü
  11. Ana Bilim Dalı: Elektrik ve Bilgisayar Mühendisliği Ana Bilim Dalı
  12. Bilim Dalı: Belirtilmemiş.
  13. Sayfa Sayısı: Belirtilmemiş.

Özet

COVID-19 (koronavirüs hastalığı) üreten SARS-CoV2 virüsü dünyaya yayılmış ve bir pandemi haline gelmiştir. Hasta sayısı her geçen gün arttığı için laboratuvar verilerinin değerlendirilmesi için zamana ihtiyaç duyulmakta, bu da ilaçların ortaya çıkmasına ve kısıtlılıkların keşfine yol açmaktadır. Bu sınırlamaların bir sonucu olarak, öngörücü algoritmaları içeren bir klinik politika sistemi gereklidir. Hastalıkları tanımlayarak, öngörücü algoritmalar sağlık sistemleri üzerindeki baskıyı hafifletebilir. Bu çalışmada, COVID-19'lu potansiyel olarak enfekte olmuş hastaları tanımlayan makine öğrenimi klinik tahmin modelleri oluşturmak için laboratuvar verileriyle aşırı örnekleme ve genetik özellik seçiminin (GF'ler) bir kombinasyonu önerilmiştir. İlk olarak, aşırı örnekleme yöntemi, tüm sınıflar için dağılım verilerini tekdüze hale getirerek dengesizlik sorununun üstesinden gelmek için kullanılır. İkincisi, GF'ler gürültüyü ve alakasız özellikleri verilerden çıkarmak için kullanılır. Modelimizin performansını hesaplamak ve değerlendirmek için birçok metrik kullanıldı: doğruluk, geri çağırma, F1 skoru, AUC ve hassasiyet puanları. Burada rastgele ilk (RF), karar ağacı (DT) ve çok katmanlı algılayıcının (MLP) COVID-19 hastalarını %96'dan fazla doğrulukla sınıflandırabileceği kanıtlanmıştır.

Özet (Çeviri)

SARS-CoV 2, the cause of COVID-19 (coronavirus disease) become a global pandemic. Because the number of patients is growing more and more every day, evaluating test data takes time, which leads to the emergence of drugs and the discovery of limitations. As a result of these limitations, a clinical policy system that includes predictive algorithms is required. By identifying diseases, predictive algorithms can relieve pressure on health care systems. In this study, a combination of over-sampling and genetic feature selection (GFs) with laboratory data is proposed to build machine-learning clinical prediction models that identify potentially infected patients with COVID-19. Firstly, the oversampling method is used to overcome the problem of imbalance by uniforming the distribution data for all classes. Second, the GFs is used to remove the noise and irrelevant features from the data. To compute and evaluate our performance of the proposed method, many metrics were used: accuracy, recall, F1-score, AUC, and precision scores. It is proven here that random forest (RF), decision tree (DT), and multilayer perceptron (MLP), can classify COVID-19 patients with more than 96% accuracy.

Benzer Tezler

  1. Batı Anadolu linyitlerinin koklaşabilme özelliklerinin incelenmesi

    The Investigation of cokingability properties of west-anatolia lignites

    JALE YANIK

    Doktora

    Türkçe

    Türkçe

    1987

    KimyaEge Üniversitesi

    Kimya Ana Bilim Dalı

    DOÇ. DR. MEHMET SAĞLAM

  2. Protein biyosentez inhibitörlerinin bazı bitki viruslarına etkileri üzerinde araştırmalar

    Research on the effects of protein biosynthesis inhibitors on some plant viruses

    SEBİLA AKSOY

    Yüksek Lisans

    Türkçe

    Türkçe

    1988

    ZiraatAnkara Üniversitesi

    Bitki Koruma Ana Bilim Dalı

    DOÇ. DR. GÜRSEL ERDİLLER