Büyük ölçekli bir tarım arazisinde toprak kalitesini incelemek isteyen bir ziraat mühendisi, araziyi eşit büyüklükte parsellere ayırmıştır. Mühendis, sistematik seçim kuralını benimseyerek sadece ilk parsele ait başlangıç numarasını kura ile belirlemiş ve ardından periyodik atlamalarla numunelerini toplamıştır. Veri analizi aşamasına geçildiğinde mühendis, elindeki veri setiyle kitle ortalamasına ait yansız (unbiased) bir varyans tahmini hesaplamanın matematiksel olarak mümkün olmadığını görmüştür.
Toplanan bu veri seti üzerinden yansız bir varyans tahmininin yapılamamasının kavramsal dayanağı ve literatürde bu sorunun üstesinden gelmek için önerilen en temel pratik yöntem aşağıdakilerden hangisinde doğru şekilde eşleştirilmiştir?
- ANeden: Numunelerin iadesiz olarak seçilmesine rağmen, klasik varyans hesaplama yöntemlerinde sonlu kitle düzeltme çarpanının () ihmal edilmesidir.
Çözüm: Veri setinin basit rastgele örneklem varsayımıyla analiz edilmesi ve varyans tahmini formülüne düzeltme katsayısının manuel olarak eklenmesi. - Neden: Sadece ilk parselin kura ile belirlenmesi, elde edilen tüm numunelerin teknik olarak hacimli tek bir küme gibi davranmasına yol açarak serbestlik derecesini sıfıra indirmesidir.
Çözüm: Toplam örneklem hacmini koruyarak tek bir atlama dizisi yerine, birden fazla rastgele başlangıca dayanan tekrarlı sistematik örnekleme (multiple starts) veya ardışık farklar yönteminin kullanılması.Cevap - CNeden: Parsellerin örnekleme aralığına tam bölünemediği durumlarda yapılan ondalıklı yuvarlamaların, bazı birimlerin seçilme olasılıklarını asimetrik hale getirmesidir.
Çözüm: Seçim işlemine arazinin sonundan başına dönecek biçimde devam edilen dairesel sistematik örnekleme kurgusuna geçiş yapılması. - DNeden: Toprak yapısındaki olası periyodik (döngüsel) değişimlerin, alınan numuneler arasındaki varyansı yapay olarak düşürerek tahminin etkinliğini her koşulda artırmasıdır.
Çözüm: Arazideki periyodikliğin sağladığı bu yüksek etkinlikten faydalanarak varyans tahmini için doğrudan tabakalı rastgele örnekleme formüllerinin uyarlanması. - ENeden: Sistematik örnekleme kuramının, sürekli değişkenlerin ortalamasından ziyade yalnızca kitle oranına () dayalı yansız tahminleyiciler sunabilmesidir.
Çözüm: Analiz öncesinde toprak kalitesi verilerinin ikili (binary) formata dönüştürülmesi ve varsayımıyla hesaplanan maksimum varyansın kullanılması.
Cevap
Tek rastgele başlangıç seçimiyle belirlenen örneklemin hacimli tek bir küme oluşturması nedeniyle serbestlik derecesinin sıfır olması ve bu sorunun çözümü olarak tekrarlı sistematik örnekleme veya ardışık farklar yönteminin kullanılmasıdır.
Sistematik örneklemede kitle, her biri eşit sayıda eleman içeren bağımsız kümeler olarak düşünülebilir. Sadece bir tane başlangıç noktasının rastgele seçilmesi, bu kümelerden yalnızca 1 tanesinin seçilmesi demektir. Örneklem birimleri (kümeler) arası değişim olan varyansı yansız olarak tahmin edebilmek için en az 2 birime (kümeye) ihtiyaç vardır. Tek seçim yapıldığında serbestlik derecesi olacağından yansız bir tahmin elde edilemez. Çözüm olarak birden fazla başlangıç noktası seçilerek (tekrarlı sistematik örnekleme) serbestlik derecesi artırılır veya veriler üzerinde ardışık farklar (successive differences) yöntemi uygulanır.
Adım Adım Çözüm
Anahtar Kavram
Sistematik Örneklemede Varyans Tahmini ve Serbestlik Derecesi Problemi
Tahmini Süre:2m 0s