Öznitelik mühendisliği kullanılarak finansal zaman serisi hareketinin tahmininde makine öğrenmesi yöntemlerinin karşılaştırılması
Comparison of machine learning methods in forecasting financial time series movement prediction using feature engineering
- Tez No: 928491
- Danışmanlar: DOÇ. DR. ÖYKÜM ESRA YİĞİT
- Tez Türü: Yüksek Lisans
- Konular: İstatistik, Statistics
- Anahtar Kelimeler: Belirtilmemiş.
- Yıl: 2021
- Dil: Türkçe
- Üniversite: Yıldız Teknik Üniversitesi
- Enstitü: Fen Bilimleri Enstitüsü
- Ana Bilim Dalı: İstatistik Ana Bilim Dalı
- Bilim Dalı: İstatistik Bilim Dalı
- Sayfa Sayısı: Belirtilmemiş.
Özet
Borsa İstanbul (BIST) tarafından işlem hacmi en yüksek 100 farklı hisse senedi değeri ile hesaplanan BIST 100 endeksi, yatırımcılar tarafından dikkatle takip edilmekte ve ekonominin önemli bir göstergesi olarak kabul edilmektedir. BIST 100 endeksinin gelecekteki davranışına ait tutarlı ve güvenilir tahminler, riskten kaçınan ve kârını maksimize etmek isteyen yatırımcılar açısından hayati bir kavram niteliği taşımaktadır. Zaman serileri; doğası gereği gürültülü, durağan olmayan ve kaotik bir yapıya sahiptir ve bu yapı finansal zaman serilerini tahminleme sürecinde araştırmacıları oldukça zorlamaktadır. Geleneksel tahmin yöntemleri arasında bulunan ARIMA (Autoregressive Integrated Moving Average), özellikle geçtiğimiz 10 sene öncesine kadar geniş bir uygulama alanına sahipti. Ancak geleneksel yöntemlerin sahip olduğu bazı varsayımların gerçek hayat verilerinde yol açtığı önemli kısıtlamalar, araştırmacıları daha esnek çalışma imkânı sunan alternatiflere yöneltmiştir. Son yıllarda bilgi teknolojilerinin hızla gelişmesi ile edinilmiş bilgilere dayanarak gelecek için gerçeğe çok yakın tahminler yapmada otomatik tekniklerin geliştirildiği makine öğrenmesi yöntemleri, geleneksel yöntemlere kıyasla oldukça iyi performans üreten bir alternatif olarak görülmektedir. Bu çalışmada BIST 100 endeksi günlük getiri yönünün tahmin edilmesinde kapsamlı bir öznitelik mühendisliği işlemi uygulanmış ve farklı makine öğrenmesi algoritmaları (Karar Ağaçları (KA), Rasgele Orman (RO), k-En Yakın Komşu (k-NN), Naïve Bayes (NB), Lojistik Regresyon (LR), Destek Vektör Makineleri (DVM) kullanılarak modellemeler gerçekleştirilmiştir. Modellerin performanslarının kıyaslanmasında doğruluk oranı (DO), F1-skor gibi metriklerden yararlanılmış ve en iyi sınıflandırıcının RO algoritması olduğu sonucuna varılmıştır. İlgili sınıflandırıcı yaklaşık %83 oranında doğru tahminler yaparken, modele girdi olarak alınan öznitelikler BIST 100 endeksi zaman serisinin özetleyici istatistiklerine, seriye ait örnekleme dağılımının ek karakteristiklerine ve serinin non-linear/komplex yapısını yansıtan gözlenen dinamiklerine bağlı olarak çıkartılmış ve dışsal değişken kullanmadan da sınıflandırma performanslarının oldukça yüksek olduğu gösterilmiştir.
Özet (Çeviri)
Calculated by Borsa İstanbul (BIST) with the highest trading volume of 100 different stocks, the BIST 100 index is carefully followed by investors and considered an important indicator of the economy. Consistent and reliable estimates of the future behavior of the BIST 100 index are a vital concept for risk-averse investors who want to maximize their profits. Time series; It has a noisy, unstable and chaotic nature due to its nature, and this structure makes it difficult for researchers in the process of forecasting financial time series. ARIMA (autoregressive integrated moving average), one of the traditional forecasting methods, had a wide application area, especially for the 10 years. However, the significant limitations caused by some assumptions of traditional methods in real life data have led researchers to seek alternatives that offer more flexible working opportunities. Machine learning methods, in which automatic techniques are developed to make very close predictions for the future based on the rapid development of information technologies in recent years, are seen as an alternative that produces very good performances compared to traditional methods. In this study, a comprehensive feature engineering process has been performed in estimating the daily return direction of the BIST 100 index and modeling has been carried out using different machine learning algorithms. In the comparison of the performances of the models, metrics such as accuracy rate and F1-score were used and it was concluded that the best classifier was the Random Forest algorithm. While the relevant classifier makes approximately 83% correct estimates, the features taken as input to the model were extracted depending on the summative statistics of the BIST 100 index time series, the additional characteristics of the sampling distribution of the series and the observed dynamics reflecting the non-linear/complex structure of the series, and the classification performances without using external variables that have been shown to be quite high.
Benzer Tezler
- Structures discursives dans“la grande peur dans la montagne”de Charles-Ferdinand Ramuz
Başlık çevirisi yok
NİLGÜN SÖKMEN
Yüksek Lisans
Fransızca
1985
Fransız Dili ve EdebiyatıCumhuriyet ÜniversitesiBatı Dilleri ve Edebiyatları Ana Bilim Dalı
YRD. DOÇ. DR. TUNA ERTEM
- Farabi'de determinizm
Başlık çevirisi yok
RAHMİ KARAKUŞ
Yüksek Lisans
Türkçe
1987
Felsefeİstanbul ÜniversitesiTürk-İslam Düşüncesi Tarihi Ana Bilim Dalı
PROF. DR. NİHAT KEKLİK
- Konut sorununa çözüm yolu olarak önerilen düşük metrekareli konutlar üzerine bir inceleme
Başlık çevirisi yok
İRFAN YILDIZHAN
Yüksek Lisans
Türkçe
1988
MimarlıkKaradeniz Teknik ÜniversitesiMimarlık Ana Bilim Dalı
DOÇ. DR. KUTSAL ÖZTÜRK
- Türkiye'nin ekonomik gelişmesinde tarımın parasal sorunları ve tarımsal kredi uygulaması
Başlık çevirisi yok
AHMET CEMAL SİVASLIGİL