Açık Tahmin Galton, 1907a

Kavanozda kaç şeker var?

Tek başına tahminin muhtemelen isabetsiz; peki yüzlerce isabetsiz tahmin bir araya gelince ne olur?

20 snsürer 1katılım Anonimkayıt gerekmez
?
EXP. 006

Kavanozdaki şekerleri saymadan, kaç tane olduğunu tahmin et ve yaz.

Deney yükleniyor… JavaScript kapalıysa deney çalışmaz; bilim kutusunu ve makaleyi aşağıda okuyabilirsin.

Önce deneye katıl.

Bilimi okumak cevabını etkileyebilir. Katıldıktan sonra her şey açılır; istersen yine de şimdi okuyabilirsin.

Deneye dön
Bilim kutusu

Birbirinden habersiz tahminlerin ortancası, çoğu bireyden daha isabetli olabilir.

Ne ölçüyoruz

Kavanozdaki şekerleri tek tek saymadan tahmin ediyorsun. Herkesin tahminini topluyor, kalabalığın ortanca (medyan, yani tahminler sıralandığında tam ortadaki değer) tahmininin gerçek sayıya ne kadar yaklaştığını ve senin tahmininin kalabalığın içinde nerede durduğunu gösteriyoruz.

Araştırmalar ne diyor

Francis Galton 1907'de Nature'da, Plymouth'taki bir hayvancılık fuarında kesilip temizlenecek bir öküzün ağırlığı için yapılmış 787 geçerli tahmini inceledi: ortanca tahmin 1.207 libre, gerçek ağırlık 1.198 libreydi, yani fark yalnızca %0,8'di. Galton aynı yıl yazdığı ikinci mektupta tahminlerin ortalamasının da 1.197 libre civarında olduğunu belirtti. Kao ve arkadaşları (2018) kavanozdaki nesneleri sayma deneylerinde tahminlerin log-normal dağıldığını, ortalamanın gerçek sayıyı çoğunlukla abarttığını, ortancanın ise çoğunlukla hafifçe altında kaldığını gösterdi. Lorenz ve arkadaşları (2011) 144 kişilik bir deneyde, başkalarının tahminlerini görmenin görüş çeşitliliğini daralttığını ve kalabalığın bilgeliğini zayıflattığını buldu.

Neden böyle

Bağımsız tahminlerdeki hatalar farklı yönlere dağıldığında birbirini kısmen götürür; geriye ortak bilgi kalır. Ama gözle büyük miktarları tahmin ederken hatalar simetrik değildir: kalibrasyon olmadan genellikle eksik söyleriz (Izard ve Dehaene, 2008), ara sıra gelen devasa tahminler ise ortalamayı yukarı çeker. Bu yüzden ortanca ya da tahminlerin logaritmasının ortalaması (geometrik ortalama) aritmetik ortalamadan daha sağlam bir özettir.

Sınırlılık

Ekrana çizilmiş bir kavanozda derinlik yoktur ve ekran boyutu kişiden kişiye değişir; bu, gerçek bir kavanozdan farklı bir görevdir. Sonuçları gördükten sonra tekrar deneyenler ya da tahminini arkadaşlarıyla paylaşanlar bağımsızlığı bozar; bu yüzden kalabalığın değerini yalnızca tahminini yaptıktan sonra gösteriyoruz.

1.207 / 1.198 libre (%0,8 fark, n=787)Galton'un öküzü: ortanca tahmin / gerçek ağırlıkGalton, 1907a
~1.197 libreGalton'un verisinde tahminlerin ortalamasıGalton, 1907b
çoğunlukla gerçeğin biraz altında (5 veri setinin 4'ü)Kavanoz deneylerinde ortancaKao vd., 2018
çoğunlukla gerçeğin üstünde (5 veri setinin 4'ü)Kavanoz deneylerinde aritmetik ortalamaKao vd., 2018
  1. Galton, F. (1907). Vox populi. Nature, 75(1949), 450–451. Kaynağa git ↗
  2. Galton, F. (1907). The ballot-box. Nature, 75(1952), 509–510. Kaynağa git ↗
  3. Lorenz, J., Rauhut, H., Schweitzer, F., & Helbing, D. (2011). How social influence can undermine the wisdom of crowd effect. Proceedings of the National Academy of Sciences, 108(22), 9020–9025. Kaynağa git ↗
  4. Kao, A. B., Berdahl, A. M., Hartnett, A. T., Lutz, M. J., Bak-Coleman, J. B., Ioannou, C. C., Giam, X., & Couzin, I. D. (2018). Counteracting estimation bias and social influence to improve the wisdom of crowds. Journal of the Royal Society Interface, 15(141), 20180130. Kaynağa git ↗
  5. Izard, V., & Dehaene, S. (2008). Calibrating the mental number line. Cognition, 106(3), 1221–1247. Kaynağa git ↗
  6. Treynor, J. L. (1987). Market efficiency and the bean jar experiment. Financial Analysts Journal, 43(3), 50–53. Kaynağa git ↗

Bir öküz, 787 bilet

İngiltere'nin Plymouth kentinde düzenlenen West of England Fat Stock and Poultry Exhibition adlı fuarda bir yarışma yapıldı: ziyaretçiler altı peni karşılığında bir bilet alıyor, sergilenen öküzün kesilip temizlendikten sonra kaç libre geleceğini yazıyordu. En yakın tahminler ödül kazanacaktı. İstatistiğin öncülerinden Francis Galton, yarışma bittikten sonra biletleri incelemek için ödünç aldı.

Galton'un 1907'de Nature dergisinde 'Vox Populi' (halkın sesi) başlığıyla yayımladığı kısa yazıya göre yaklaşık 800 bilet satılmış, 13'ü okunaksız ya da eksik olduğu için ayıklanmış, geriye 787 tahmin kalmıştı. Katılımcılar arasında kasaplar ve çiftçiler gibi uzmanlar da vardı, hayvanlardan anlamayan meraklılar da. Galton tahminleri sıraladığında ortadaki değerin 1.207 libre olduğunu gördü. Öküzün gerçek ağırlığı ise 1.198 libreydi: kalabalık yalnızca 9 libre, yani %0,8 yanılmıştı.

Ortanca mı, ortalama mı?

Galton bu deneyi bir demokrasi metaforu olarak gördü: 'bir kişi, bir oy' ilkesine göre her tahmin, ortadaki değeri kendi yönüne çeker; ortanca da tam bu yüzden kalabalığın kararıdır. Ortancanın bir avantajı var: tek bir aşırı uç tahmin, örneğin biri şaka olsun diye 100.000 yazsa bile, ortanca neredeyse hiç kıpırdamaz. Ortalama ise bu tür uçlara karşı savunmasızdır.

İlginç bir ayrıntı: aynı yıl Nature'da yayımlanan 'The Ballot-Box' başlıklı mektubunda Galton, bir okurun kendi tablosundan yaptığı yaklaşık hesapla ortalamayı 1.196 libre bulduğunu, doğru değerin ise 1.197 libre olduğunu yazdı. Bu öküz için ortalama da gerçeğe çok yakındı. Ama her durumda böyle değildir; özellikle şeker kavanozu gibi sayı tahminlerinde ortalama ile ortanca belirgin biçimde ayrışabilir.

Kalabalık ne zaman bilge?

Gazeteci James Surowiecki, 2004'te yayımladığı The Wisdom of Crowds kitabıyla bu fikri geniş kitlelere taşıdı. Kitaba göre bir kalabalığın akıllıca karar verebilmesi için görüşlerin çeşitli olması, insanların birbirinden bağımsız düşünmesi, bilginin merkezileşmemiş olması ve tek tek görüşleri birleştiren bir yöntemin bulunması gerekir.

Bağımsızlık koşulu özellikle kırılgandır. Jan Lorenz ve arkadaşları 2011'de 144 kişiyle yaptıkları deneyde katılımcılara olgusal sorular sordu ve bazı gruplara diğerlerinin tahminlerini gösterdi. Başkalarının tahminlerini gören gruplarda görüşler birbirine yaklaştı ama kalabalığın hatası azalmadı; gerçek değer tahminlerin kenarına itildi ve insanların kendine güveni, isabetleri artmadığı halde yükseldi. Yani birbirini dinleyen bir kalabalık daha emin ama daha bilge değil.

Kavanozun özel sorunu: sayılar logaritmik

Kavanozdaki şekerleri tahmin etmek, öküzün ağırlığını tahmin etmekten farklıdır. İnsanlar büyük miktarları gözle tahmin ederken sistematik olarak eksik söyleme eğilimindedir. Véronique Izard ve Stanislas Dehaene (2008), nokta kümeleri gösterdikleri katılımcıların tahminlerinin miktarla birlikte arttığını ama gerçeğin altında kaldığını buldu; birkaç denemede 'bu ekranda 30 nokta var' bilgisinin verilmesi ise tüm aralıktaki tahminleri ayarlamaya yetti.

Albert Kao ve arkadaşları (2018) 54 ile 27.852 arasında nesne içeren kavanozlarla yaptıkları deneylerde, tahminlerin normal değil log-normal dağıldığını gösterdi: çoğu tahmin gerçeğe yakın ya da biraz altında toplanır, az sayıda tahmin ise çok yükseğe uzanır. Topladıkları beş veri setinin dördünde aritmetik ortalama gerçeğin üstünde, ortanca ise gerçeğin altında kaldı. Bu yüzden kavanoz tahminlerinde tek bir 'doğru' özet yoktur; ortanca ve geometrik ortalama genellikle aritmetik ortalamadan daha güvenilirdir.

Sınıftaki fasulye kavanozu

Finans profesörü Jack Treynor, 1987'de Financial Analysts Journal'da yayımladığı yazıda öğrencileriyle yaptığı bir fasulye kavanozu deneyini piyasaların verimliliği için bir benzetme olarak kullandı. Aktarıldığına göre grubun ortalama tahmini, öğrencilerin neredeyse hepsinden daha isabetliydi; ama öğrencilere kavanozla ilgili yanıltıcı bir bilgi verildiğinde grup tahmini belirgin biçimde kötüleşti.

Treynor'un dersi açık: kalabalığın gücü, hataların birbirinden bağımsız olmasından gelir. Herkes aynı yanlış bilgiyle aynı yöne saparsa hatalar birbirini götürmez, üst üste biner. Bu ilke, piyasalardan seçimlere ve uzman panellerine kadar pek çok alanda karşımıza çıkar.

Bu deneyi nasıl okumalı?

Bizim kavanozumuz ekrana çizilmiş bir kavanoz; derinlik yok, şekerlerin bir kısmı üst üste biniyor ve ekran boyutu herkeste farklı. Yine de görevin özü aynı: saymadan, bir bakışta büyük bir miktarı tahmin etmek. Kalabalığın ortancasını ve geometrik ortalamasını gerçek sayıyla karşılaştırıyoruz; literatüre bakılırsa ortancanın gerçeğin biraz altında kalmasını bekleyebiliriz.

Sonucu gördükten sonra arkadaşına tahminini söylemeden önce testi yapmasını iste: kalabalığın bilgeliği, herkes kendi kafasıyla tahmin ettiği sürece işler.

Sık sorulanlar

Kalabalığın bilgeliği nedir?

Birbirinden bağımsız çok sayıda tahminin ortanca ya da ortalamasının, çoğu zaman tek tek bireylerin tahminlerinden daha isabetli olmasıdır. En bilinen örneği, Galton'un 1907'de incelediği öküz ağırlığı yarışmasıdır.

Neden ortalama yerine ortanca gösteriyorsunuz?

Ortanca, uç tahminlerden neredeyse etkilenmez. Kavanoz tahminleri log-normal dağıldığı için aritmetik ortalama genellikle gerçeği abartır (Kao vd., 2018); ortanca ve geometrik ortalama daha sağlam özetlerdir.

Kavanozdaki şeker sayısını daha iyi nasıl tahmin ederim?

Bir sıradaki ya da bir katmandaki şekerleri sayıp kavanozun kaç sıra ya da katmandan oluştuğunu tahmin etmek, tek bakışlık bir tahminden genellikle daha iyidir. Şekerlerin arasında boşluk kaldığını, yani kavanozun hacminin tamamen dolu olmadığını da hesaba kat.

Başkalarının tahminini görmek neden sonucu bozar?

Lorenz ve arkadaşlarının (2011) deneyinde başkalarının tahminlerini görenlerin görüşleri birbirine yaklaştı ama kalabalığın hatası azalmadı, insanların kendine güveni ise arttı. Bağımsız hatalar birbirini götürür; ortaklaşan hatalar götürmez.

Tartışma 0 yorum

Yorum yazmak ve oy vermek için gönüllü ol. 20 saniye sürer.
GirişGönüllü ol
Henüz yorum yok. İlk yazan sen ol.

Bu deney hakkında konular

Yeni konu aç →
Bu deney için açılmış ayrı bir konu yok. Yöntemi eleştirmek, bir makale paylaşmak ya da yeni bir soru sormak için konu açabilirsin.