Feature selection for sentiment analysis in turkish texts
Tezin Türü: Doktora
Tezin Yürütüldüğü Kurum: Çukurova Üniversitesi, Fen Bilimleri Enstitüsü, Elektrik-Elektronik Mühendisliği, Türkiye
Tezin Onay Tarihi: 2016
Tezin Dili: İngilizce
Öğrenci: TUBA PARLAR
Danışman: Selma Ayşe Özel
Açık Arşiv Koleksiyonu: AVESİS Açık Erişim Koleksiyonu
Özet:Duygu analizi yorum belgelerinde ifade edilen duygunun sınıflandırılmasıdır. Diğer bütün sınıflandırma işlevlerinde olduğu gibi, veri önişleme, nitelik seçimi ve metin sınıflandırma adımlarından oluşur. Bu çalışmanın amaçlarından biri, Türkçe yorumların duygu analizinde çeşitli veri önişleme kombinasyonlarının incelenmesi ve hangi nitelik seçimi yöntemleri ile etkin sonuçlar elde edildiğinin araştırılmasıdır. Bir diğer amacımız ise duygu analizindeki en değerli niteliklerin seçiminde yeni bir nitelik seçimi yönteminin önerilmesidir. Duygu analizi için kullanılan Ki-kare, Information Gain, Document Frequency Difference ve Optimal Orthogonal Centroid gibi nitelik seçimi yöntemleri ile duygu analizi sürecinin doğruluk ve verimlilik özelliklerini geliştirmek hedeflenmiştir. Ayrıca bu yöntemlerle önerdiğimiz yeni nitelik seçimi yöntemi karşılaştırılmıştır. Deneyler için yaygın olarak kullanılan dört sınıflandırıcı tercih edilmiştir: Naïve Bayes Multinomial, Destek Vektör Makineleri, Logistic Regression ve Karar Ağacı. Türkçe yorumların analizinde belirli noktalama işaretlerini ve etkisiz kelimeleri nitelik olarak tutmanın olumlu katkı sağladığını ve kullandığımız nitelik seçim yöntemleriyle de daha iyi sonuçlar elde etmeye katkı sağladığını gözlemledik. Ayrıca dört temel terim ağırlıklandırma yöntemlerinin duygu analizi üzerindeki etkileri incelenmiştir. Bu yöntemlerin farklı nitelik seçimi yöntemleri üzerindeki etkileri ve bu yöntemlerin azaltılmış nitelikler ile nasıl sonuç verdikleri incelenerek analiz edilmiştir. Sonuç olarak, Türkçe yorumlar üzerine uygulanan deneyler, İngilizce yorumlar üzerinde de uygulanmış ve farklılıklar incelenmiştir.