Mikroarray gen ekspresyon veri setlerinde random forest ve naıve bayes sınıflama yöntemleri yaklaşımı
Random forest and naïve bayes approach in microarray gene expressions data sets
- Tez No: 329788
- Danışmanlar: DOÇ. DR. ERDEM KARABULUT
- Tez Türü: Yüksek Lisans
- Konular: Genetik, Biyoistatistik, Genetics, Biostatistics
- Anahtar Kelimeler: Random Forest, Naive Bayes, DNA Mikroarray, Sınıflama, Biyoistatistik, Gen ifadesi, Mikrodizilim analizi, Sınıflandırma, Random Forest, Naive Bayes, DNA Microarray, Classification, Bioistatistics, Gene expression, Microarray analysis
- Yıl: 2013
- Dil: Türkçe
- Üniversite: Hacettepe Üniversitesi
- Enstitü: Sağlık Bilimleri Enstitüsü
- Ana Bilim Dalı: Biyoistatistik Ana Bilim Dalı
- Bilim Dalı: Biyoistatistik Bilim Dalı
- Sayfa Sayısı: Belirtilmemiş.
Özet
Ebru KORKEM Mikroarray Gen Ekspresyon Veri Setlerinde Random Forest ve Naive Bayes Sınıflama Yöntemleri Yaklaşımı. Hacettepe Üniversitesi Sağlık Bilimleri Enstitüsü, Biyoistatistik Programı Yüksek Lisans Tezi, ANKARA, 2012. Bu tez çalışmasında çeşitli kanser türlerine ilişkin farklı büyüklükteki ve farklı sınıf sayılarındaki veri setleri üzerinde, Random Forest ve Naive Bayes sınıflama yöntemleri karşılaştırılmıştır. İki sınıflama yönteminin de her bir veri seti için ayrı ayrı doğru sınıflama oranları, iki sınıflı veri setlerinde (hasta, sağlam) yöntemlerin başarısını karşılaştırmak için ise duyarlılık, seçicilik, kesinlik, F-ölçütü gibi performans ölçüleri hesaplanmıştır. Ayrıca Random Forest yönteminde her veri seti için önemli genler ?doğru sınıflama oranındaki ortalama azalma? değerlerine göre hesaplanmış ve ilk 10 önemli genin gerçekte de sınıflar arasında farklılık gösterip gösterilmediğine bakılmıştır. Random Forest yönteminde ağaçlardaki en uygun değişken sayısına karar vermek için 5 farklı mtry değeri üzerinde çalışılmış (0.5P, 0.1P, P, 1.2 ?P, ?P ) ve en uygun mtry değerine göre sınıflama yapılmıştır. Random Forest ve Naive Bayes'in kanser veri setleri üzerindeki performansları bu değerlerle karşılaştırılmıştır. Her iki sınıflama yönteminin hem ikili hem de çoklu sınıflama da performansları incelenmiş olup sonuçlarda, iki yöntem arasında fark gözlenmemiştir.
Özet (Çeviri)
Ebru KORKEM Random Forest and Naïve Bayes Approach in Microarray Gene Expressions Data Sets. Hacettepe University Institute of Health Sciences, Biostatistic Program Master Degree Thesis, ANKARA, 2012. In this study, two classification methods, Random Forest and Naive Bayes, were compared about various types of cancer on the data sets which are different in size or in number of classes. Correct classification rates of two classification methods for each data set were separately calculated and additionally in two-class data sets (patient-healthy), performance measures like sensitivity, specifity, precision and F-measure were calculated for success comparison of the methods. Also in Random Forest method, for each data set important genes were calculated according to the values of ?mean decrease in accuracy? and it was investigated if in reality first 10 important genes were differed between the classes. In Random Forest method, five different mtry values (0.5P, 0.1P, P, 1.2 ?P, ?P ) were studied to determine the appropriate number of variables in the trees and classification procedure was performed according to that appropriate mtry value. Performances of Random Forest and Naive Bayes on cancer data sets were compared with these values. Each classification method?s performance was examined in binary and multi-class classification and in conclusion it was observed that there weren?t any differences between those two methods.
Benzer Tezler
- New approach to unsupervısed based classıfıcatıon on mıcroarray data
Mi̇krodi̇zi̇li̇m veri̇lerden danışmansız öğrenmeye dayalı sınıflamada yeni̇ yaklaşım
ERDAL COŞGUN
Doktora
İngilizce
2013
BiyoistatistikHacettepe ÜniversitesiBiyoistatistik Ana Bilim Dalı
PROF. DR. ERGUN KARAAĞAOĞLU
- Cancer subtyping and multi-omics analysis of common precursor B Acute Lymphoblastic Leukemias
B hücreli (Common Precursor B) akut lenfoblastik lösemilerin kanser alt tiplemesi ve çoklu omic analizi
BARAN ALKAN
Yüksek Lisans
İngilizce
2026
Biyoistatistikİstanbul Medeniyet ÜniversitesiBiyoistatistik ve Tıp Bilişimi Ana Bilim Dalı
DOÇ. DR. ELİF KUBAT ÖKTEM
PROF. DR. HANDAN ANKARALI
- Mikrodizi verilerinde farklı yapı ve sayıda ortaya çıkan eksik verilerin 1.tip hata üzerine etkisinin araştırılması
Researching effect of missing values occured different structures and numbers onto TYPE I error in microarray datas
ASENA AYÇA ÖZDEMİR
Yüksek Lisans
Türkçe
2015
BiyoistatistikMersin ÜniversitesiBiyoistatistik ve Tıbbi Bilişim Ana Bilim Dalı
PROF. DR. EMİNE ARZU KANIK
- Yaşa bağlı makula dejenerasyonu (YBMD) etyolojisinden sorumlu genlerin in silico analiz ile değerlendirilmesi ve klinik yaklaşımla doğrulanması
Evaluation of genes responsible for the etiology of age-related macular degeneration (AMD) via in silico analysis and validation through clinical approach
SALİH ERKAN
Tıpta Uzmanlık
Türkçe
2026
Göz HastalıklarıSağlık Bilimleri ÜniversitesiGöz Hastalıkları Ana Bilim Dalı
DOÇ. DR. IŞIL KUTLUTÜRK KARAGÖZ
- Development of mirna biomarkers for the differentiation between gingivitis and periodontitis: A pilot study
Gingivitis ve periodontitis ayrımı için mirna biyobelirteçlerinin geliştirilmesi: Pilot çalışma
DHAFIR LATIEF FAYADH FAYADH
Doktora
İngilizce
2023
BiyokimyaSüleyman Demirel ÜniversitesiKimya Ana Bilim Dalı
PROF. DR. MUSTAFA CALAPOĞLU