Diskriminant (Ayırma) Analizi
85 soru
Bir pazar araştırmacısı, müşterilerin kredi risk profillerini (düşük, orta, yüksek riskli) belirleyebilmek amacıyla demografik ve finansal değişkenleri kullanarak Adım Adım (Stepwise) Diskriminant Analizi uygulamaktadır. Araştırmacı, modele bağımsız değişkenlerin hangi sırayla ekleneceğini ve modelden nasıl çıkarılacağını belirleyen istatistiksel kriterleri değerlendirmektedir.
Bu analizin değişken seçme ve çıkarma süreciyle ( ve kriterleri) ilgili aşağıdaki ifadelerden hangisi doğrudur?
Bir banka, kredi başvurusunda bulunan müşterilerini "Onaylananlar" (Grup 1) ve "Reddedilenler" (Grup 2) olarak sınıflandırmak amacıyla İki Gruplu Diskriminant Analizi uygulamıştır. Analizde bağımsız değişkenler olarak (Aylık Gelir, bin TL) ve (Borç/Gelir Oranı, %) kullanılmıştır.
Analiz sonucunda elde edilen bazı istatistikler şunlardır:
- Wilks' (Lambda) değeri:
- Standardize edilmemiş diskriminant fonksiyonu:
- Standardize edilmiş diskriminant katsayıları: ve
Buna göre, aylık geliri 5 bin TL () ve borç/gelir oranı %2 () olan yeni bir başvuru sahibinin analiz sonuçlarıyla değerlendirilmesine ilişkin aşağıdaki ifadelerden hangisi doğrudur?
Bir araştırmacı, üç farklı müşteri segmentini harcama alışkanlıklarına göre sınıflandırmak amacıyla diskriminant (ayırma) analizi uygulamaktadır. Analizde modele alınan ve bağımsız değişkenlerinin grupları ayırma güçleri incelenmiş ve bu değişkenlere ait Wilks' Lambda () istatistikleri sırasıyla ve olarak hesaplanmıştır. Ayrıca modelin genel ayırma gücünü test etmek için gruplar arası Mahalanobis uzaklıkları () da incelenmiştir.
Bu analiz sonuçlarının ayırma gücü bağlamında değerlendirilmesiyle ilgili aşağıdakilerden hangisi doğrudur?
Bir araştırmacı, iki farklı müşteri segmentine (Segment 1 ve Segment 2) sahip bir bankanın müşterilerini risk profillerine göre ayırmak amacıyla diskriminant analizi uygulamış ve aşağıdaki sınıflandırma (karmaşıklık) matrisini elde etmiştir:
| Gerçek Sınıf | Tahmin Edilen (Segment 1) | Tahmin Edilen (Segment 2) | Toplam |
|---|---|---|---|
| Segment 1 | 140 | 60 | 200 |
| Segment 2 | 60 | 240 | 300 |
| Toplam | 200 | 300 | 500 |
Araştırmada aşağıdaki ek bilgiler verilmiştir:
- Bankanın tüm müşteri kitlesindeki öncelik (prior) olasılıkları Segment 1 için ve Segment 2 için 'dir.
- Gerçekte Segment 1'de olan bir müşteriyi Segment 2'ye yanlış atamanın maliyeti TL'dir.
- Gerçekte Segment 2'de olan bir müşteriyi Segment 1'e yanlış atamanın maliyeti TL'dir.
Buna göre, görünür (apparent) hata oranlarına dayalı olarak hesaplanan beklenen yanlış sınıflandırma maliyeti () tahmini değeri kaçtır?
Bir araştırmacı, işletmelerin finansal başarı durumlarını "başarılı", "kısmen başarılı" ve "başarısız" olmak üzere üç grupta sınıflandırmak ve yeni kurulacak işletmelerin hangi başarı grubunda yer alacağını tahmin etmek amacıyla bir model kurmak istemektedir. Bu amaçla işletmelerin kârlılık oranı, borçluluk oranı ve aktif büyüklüğü gibi finansal göstergelerini kullanacaktır.
Buna göre, bu araştırmada uygulanacak diskriminant (ayırma) analizi ve varsayımları ile ilgili aşağıdakilerden hangisi yanlıştır?
Bir kamu kurumu uzmanı, illeri gelişmişlik endekslerine göre (Düşük, Orta, Yüksek) üç farklı kategoriye ayırmak için çeşitli sosyo-ekonomik göstergeleri kullanarak aşamalı (stepwise) diskriminant çözümlemesi yürütmektedir. Analiz sürecinde, hangi sosyo-ekonomik göstergelerin sınıflandırma fonksiyonunda kalacağına F istatistikleri ve Wilks' Lambda () katsayıları yardımıyla karar verilmektedir.
Bu analizin değişken seçimi ve değerlendirme aşamalarına ilişkin aşağıdaki ifadelerden hangisi doğrudur?
Bir finansal analist, şirketleri "Düşük", "Orta" ve "Yüksek" riskli olmak üzere 3 gruba ayırmak amacıyla 4 farklı finansal oran () kullanarak bir diskriminant (ayırma) analizi uygulamıştır. Analiz sonucunda elde edilen iki diskriminant fonksiyonuna ( ve ) ait temel istatistikler ve standartlaştırılmış diskriminant katsayıları aşağıdaki tabloda verilmiştir:
| İstatistik / Değişken | Fonksiyonu | Fonksiyonu |
|---|---|---|
| Wilks' (Lambda) | ||
| Özdeğer () | ||
| Katsayısı | ||
| Katsayısı | ||
| Katsayısı | ||
| Katsayısı |
Bu analiz sonuçları ve diskriminant katsayılarının yorumlanması ile ilgili aşağıdakilerden hangisi doğrudur?
Bir kamu kurumu uzmanı, ilçeleri sosyoekonomik durumlarına göre "Gelişmiş", "Gelişmekte Olan" ve "Az Gelişmiş" şeklinde önceden belirlenmiş üç farklı sınıfa ayırmak ve yeni verisi gelen bir ilçenin hangi sınıfa atanacağını tahmin etmek için bir sınıflandırma modeli geliştirmektedir. Uzman, tahmin edici olarak eğitim, sağlık ve altyapı harcamaları gibi sürekli ölçüme sahip çeşitli göstergeleri sürece dahil etmiştir.
Bu uzmanın tercih ettiği diskriminant analizi yöntemi ve dayandığı varsayımlar dikkate alındığında, aşağıdaki yargılardan hangisi istatistiksel olarak doğrudur?
Bir bankanın bireysel kredi değerlendirme sürecinde, müşteriler "Krediyi Geri Ödeyenler" () ve "Krediyi Geri Ödeyemeyenler" () olmak üzere iki gruba ayrılmaktadır. Geçmiş verilere dayalı olarak geliştirilen bir diskriminant fonksiyonu için şu bilgiler elde edilmiştir:
- Krediyi geri ödeyen müşterileri doğru sınıflandırma oranı %90'dır.
- Krediyi geri ödeyemeyen müşterileri doğru sınıflandırma oranı %75'tir.
- Başvuru yapan müşteriler arasında krediyi geri ödeyememe oranı (öncel olasılık) %20'dir.
Banka, krediyi geri ödeyemeyecek bir müşteriyi "geri ödeyen" olarak sınıflandırıp kredi vermenin maliyetini, krediyi geri ödeyecek bir müşteriyi "geri ödeyemeyen" olarak sınıflandırıp reddetmenin maliyetinin tam 10 katı olarak belirlemiştir.
Buna göre, bu sınıflandırma kuralının Beklenen Yanlış Sınıflandırma Maliyeti (ECM), krediyi geri ödeyecek bir müşteriyi reddetme maliyeti () cinsinden aşağıdakilerden hangisidir?
Bir araştırmacı, hastaları hastalığın şiddetine göre "Hafif", "Orta", "Ağır" ve "Kritik" olmak üzere gruba ayırmak amacıyla, hastaların farklı klinik ölçüm değerini (kan basıncı, nabız vb.) bağımsız değişken olarak kullanıp Çok Gruplu Diskriminant Analizi uygulamıştır.
Analiz sonucunda hesaplanan Wilks' Lambda istatistiği olarak bulunmuş; sınıflandırma (karmaşıklık) matrisinde ise toplam gözlemden 'ının köşegen (diyagonal) üzerinde yer aldığı görülmüştür.
Bu araştırma ve elde edilen bulgular ile ilgili aşağıdaki ifadelerden hangisi doğrudur?
Türkiye İstatistik Kurumu (TÜİK) bünyesinde çalışan bir araştırmacı, haneleri tüketim harcamaları alışkanlıklarına göre 'Düşük Tüketim', 'Orta Tüketim' ve 'Yüksek Tüketim' olmak üzere önceden tanımlanmış üç sınıfa ayırmıştır. Araştırmacı, hanelerin aylık gelirleri, hanehalkı büyüklüğü ve kredi kartı borç yükü gibi faktörlerin bu sınıflamayı ne derece açıkladığını belirlemek ve yeni hanelerin hangi sınıfa gireceğini tahmin etmek amacıyla bir diskriminant (ayırma) analizi modeli kurmuştur.
Bu araştırmacının uygulayacağı diskriminant analizinin temel amacı ve varsayımları dikkate alındığında, aşağıdaki ifadelerden hangisi doğrudur?
Diskriminant (ayırma) analizinde kurulan matematiksel modelin geçerliliği ve sınıflandırma kurallarının doğruluğu, veri setinin belirli istatistiksel varsayımları sağlamasına bağlıdır. Bu varsayımların ihlali, modelin hata oranlarını doğrudan etkiler ve ayırma fonksiyonlarının güvenirliğini düşürür.
Buna göre, diskriminant analizinin istatistiksel varsayımları ve temel amacı dikkate alındığında, aşağıda verilen ifadelerden hangisi doğrudur?
Bir Sosyal Güvenlik Kurumu (SGK) müfettişi, işletmeleri prim borcu ödeme alışkanlıklarına göre (Düzenli Ödeyenler) ve (Düzensiz Ödeyenler) olmak üzere iki sınıfa ayırmak için bir diskriminant fonksiyonu elde etmiştir. Elde edilen fonksiyon kullanılarak 200 işletmelik bir örneklem üzerinde aşağıdaki sınıflandırma matrisi (karmaşıklık matrisi) oluşturulmuştur:
| Gerçek Sınıf | Atanan Sınıf: | Atanan Sınıf: | Toplam |
|---|---|---|---|
| (Düzenli) | 45 | 5 | 50 |
| (Düzensiz) | 45 | 105 | 150 |
| Toplam | 90 | 110 | 200 |
Buna göre, kurulan diskriminant fonksiyonunun görünür hata oranı (APER) ile gerçekte düzensiz ödeyen bir işletmenin düzenli ödeyen olarak sınıflandırılma olasılığı sırasıyla aşağıdakilerden hangisidir?
Çok değişkenli istatistiksel analiz yöntemlerinden biri olan Diskriminant (Ayırma) Analizi'nin amacı ve temel varsayımları üzerine aşağıdaki değerlendirmeler yapılmıştır:
I. Analizin uygulanabilmesi için temel şartlardan biri, bağımlı (grup) değişkenin eşit aralıklı veya oran ölçeğinde ölçülmüş sürekli bir değişken olmasıdır.
II. Bağımsız değişkenlerin her birinin tek değişkenli (marjinal) normal dağılıma sahip olması, modelin gerektirdiği çok değişkenli normal dağılım varsayımının sağlandığını matematiksel olarak garanti eder.
III. Gruplara ait kitle varyans-kovaryans matrislerinin homojenliği varsayımı (Box's M testi ile sınanan varsayım) ihlal edildiğinde, sınıflandırma işleminde doğrusal (linear) yerine karesel (quadratic) diskriminant fonksiyonlarının kullanılması teorik olarak daha doğru sonuçlar üretir.
IV. Elde edilen ayırma fonksiyonlarının gücünü sınamak için hesaplanan Wilks' Lambda () istatistiğinin değerinin 1'e yaklaşması, gruplar arası varyansın maksimize edildiğini ve modelin ayırma gücünün mükemmele yakınsadığını gösterir.
Diskriminant analizinin teorik altyapısı dikkate alındığında, yukarıdaki ifadelerden hangileri kesinlikle yanlıştır?
Bir Bölgesel Kalkınma Ajansı uzmanı, illeri gelişmişlik düzeylerine göre "Çok Yüksek", "Yüksek", "Orta", "Düşük" ve "Çok Düşük" olmak üzere 5 farklı kategoriye ayırmak amacıyla, illere ait 7 farklı sürekli makroekonomik göstergeyi bağımsız değişken olarak kullandığı bir Çok Gruplu Diskriminant Analizi gerçekleştirmektedir.
Buna göre, analizde elde edilebilecek maksimum diskriminant fonksiyonu sayısı ve modelin ayırma gücünü değerlendirmede kullanılan istatistiklerin yorumu ile ilgili aşağıdakilerden hangisi doğrudur?
Bir bölge kalkınma ajansında görevli analist, illeri sosyoekonomik gelişmişlik düzeylerine göre üç farklı gruba ayırmak için dört adet sürekli değişken kullanarak çoklu diskriminant (ayırma) analizi gerçekleştirmiştir.
Yapılan analiz sonucunda, grup içi kareler ve çarpımlar toplamı matrisinin tersi ile gruplar arası kareler ve çarpımlar toplamı matrisinin çarpımına () ait sıfırdan farklı özdeğerler ve olarak elde edilmiştir. (Sınıflandırma modelinde öncelik olasılıkları eşit varsayılmaktadır.)
Buna göre, modelin ayırma gücünün değerlendirilmesi ile ilgili aşağıdakilerden hangisi doğrudur?
Bir e-ticaret platformunun veri bilimi ekibi, müşterileri satın alma davranışlarına göre "Aktif", "Durgun" ve "Kayıp" olmak üzere üç farklı gruba ayırmak amacıyla Çoklu Diskriminant Analizi uygulamıştır. Analizde üç adet bağımsız değişken kullanılmıştır: (Platformda Geçirilen Ortalama Süre), (Aylık Ortalama Sipariş Tutarı) ve (Müşteri Şikayet Sayısı).
Analiz sonucunda elde edilen birinci ayırma fonksiyonu () için Wilks' istatistiği , ikinci ayırma fonksiyonu () için ise Wilks' istatistiği olarak hesaplanmıştır. Ayrıca, birinci diskriminant fonksiyonu () için elde edilen standardize edilmiş diskriminant katsayıları sırasıyla; için , için ve için olarak bulunmuştur.
Buna göre, gerçekleştirilen diskriminant analizi ve elde edilen bulgularla ilgili aşağıdaki ifadelerden hangisi kesinlikle doğrudur?
Bir araştırmacı, hastaları klinik bulgularına göre "Hafif", "Orta" ve "Ağır" olmak üzere üç kategoriye ayırmak amacıyla Çoklu Diskriminant Analizi uygulamıştır. Hastaların sistolik kan basıncı (), kolesterol seviyesi () ve açlık kan şekeri () bağımsız değişkenler olarak modele alınmıştır.
Analiz sonucunda elde edilen birinci diskriminant fonksiyonunun () standartlaştırılmış diskriminant katsayıları sırasıyla 0,82, -0,64 ve 0,35 olarak hesaplanmıştır. Modelin genel Wilks' (Lambda) değeri ise 0,18 olarak bulunmuştur.
Bu analiz sonuçları ve diskriminant analizinin teorik yapısı dikkate alındığında, aşağıdaki ifadelerden hangisi doğrudur?
Bir tarım araştırma enstitüsünde, elde edilen buğday tohumları morfolojik özelliklerine göre A türü () ve B türü () olarak sınıflandırılmaktadır. Geçmiş yıllardaki ekim verilerine göre, tohumların 'ının A türü, 'ının ise B türü olduğu bilinmektedir.
Geliştirilen bir diskriminant fonksiyonu, 200 adet tohumdan oluşan bir test verisine uygulanmış ve aşağıdaki sınıflandırma matrisi elde edilmiştir:
| Gerçek Tür | 'e Atanan | 'ye Atanan | Toplam |
|---|---|---|---|
| ** (A Türü)** | 135 | 15 | 150 |
| ** (B Türü)** | 25 | 25 | 50 |
Buna göre, hatalı sınıflandırma maliyetlerinin eşit olduğu varsayımı altında, bu diskriminant fonksiyonu için hesaplanan Beklenen Hata Oranı kaçtır?
Bir araştırmacı, işletmelerin finansal durumlarını öngörebilmek amacıyla "iflas edenler" ve "faaliyetine devam edenler" şeklinde iki gruba ayrılmış bir veri seti üzerinde Fisher'in doğrusal diskriminant (ayırma) analizini uygulamaktadır. Araştırmacı, işletmelerin borçluluk oranı, kârlılık marjı ve likidite oranı gibi bağımsız değişkenlerini kullanarak sınıflandırma kurallarını belirlemeyi amaçlamaktadır.
Bu analizin temel varsayımları, sürecin işleyişi ve sonuçların yorumlanması ile ilgili aşağıdaki ifadelerden hangisi doğrudur?