Bir iktisatçı, bir bölgedeki konut fiyatlarını (); konutun büyüklüğü (), konutun yaşı (), şehir merkezine uzaklığı () ve oda sayısı () bağımsız değişkenleri ile tahmin etmek istemektedir. Tüm değişkenlerin modele dahil edildiği tam model aşamasında, anlamlılık düzeyinde yapılan t-testleri sonucunda katsayılara ilişkin p-değerleri aşağıda sunulmuştur:
| Değişken | p-değeri |
|---|---|
Geriye doğru eleme yöntemi (backward elimination) kullanılarak model seçimi yapıldığı düşünüldüğünde, algoritmanın bu aşamasındaki uygulamasıyla ilgili aşağıdakilerden hangisi doğrudur?
- değişkeni modelden çıkarılmalı ve kalan değişkenlerle regresyon denklemi yeniden tahmin edilmelidir.Answer
- BP-değeri anlamlılık düzeyinden büyük olan ve değişkenleri modele anlamlı katkı sağlamadığı için bu aşamada birlikte çıkarılmalıdır.
- CModel seçimine boş bir modelle başlanmalı ve p-değeri en küçük olan değişkeni modele ilk olarak dahil edilmelidir.
- DModel bu haliyle en iyi modeldir ve p-değeri anlamlılık düzeyine en yakın olan değişkeni çıkarılmadan sürece son verilmelidir.
- EDüzeltilmiş belirtme katsayısını () maksimize etmek için sadece p-değeri en düşük olan değişkeni modelde bırakılmalıdır.
Answer
P-değeri belirlenen anlamlılık düzeyinden büyük olan değişkenler arasında en yüksek p-değerine sahip olan değişken () modelden çıkarılmalı ve süreç devam etmelidir.
Geriye doğru eleme yönteminin temel kuralı, modeldeki tüm bağımsız değişkenlerle başlayıp, her adımda istatistiksel olarak en anlamsız (en yüksek p-değerine sahip) olan değişkeni tek başına modelden çıkarmaktır. Verilen tabloda değişkeninin p-değeri (), eşik değerinden büyüktür ve anlamsız değişkenler arasındaki en yüksek değerdir. Bu nedenle ilk olarak bu değişkenin çıkarılması gerekir.
Step-by-Step Solution
Key Concept
Geriye Doğru Eleme Algoritması