Yöntem kartı · Özgüven

Ne kadar eminsin?.

On sayısal soru: her birinde doğru cevabın yüzde 90 olasılıkla içinde kalacağı bir aralık verebilir misin?

Deneye git4 dk sürer1 gerçek ilk cevap

Özgün çalışma

  1. Alpert, M., & Raiffa, H. (1982). A progress report on the training of probability assessors. In D. Kahneman, P. Slovic, & A. Tversky (Eds.), Judgment under uncertainty: Heuristics and biases (pp. 294–305). Cambridge University Press. Kaynak
  2. Lichtenstein, S., Fischhoff, B., & Phillips, L. D. (1982). Calibration of probabilities: The state of the art to 1980. In D. Kahneman, P. Slovic, & A. Tversky (Eds.), Judgment under uncertainty: Heuristics and biases (pp. 306–334). Cambridge University Press. Kaynak
  3. Soll, J. B., & Klayman, J. (2004). Overconfidence in interval estimates. Journal of Experimental Psychology: Learning, Memory, and Cognition, 30(2), 299–314. Kaynak
  4. Moore, D. A., & Healy, P. J. (2008). The trouble with overconfidence. Psychological Review, 115(2), 502–517. Kaynak
  5. Haran, U., Moore, D. A., & Morewedge, C. K. (2010). A simple remedy for overprecision in judgment. Judgment and Decision Making, 5(7), 467–476. Kaynak
  6. Moore, D. A., Tenney, E. R., & Haran, U. (2015). Overprecision in judgment. In G. Keren & G. Wu (Eds.), The Wiley Blackwell handbook of judgment and decision making (pp. 182–209). Wiley. Kaynak

Uyarlamamız

Alpert ve Raiffa'nın (1982) %90 güven aralığı görevinin on sorulu uyarlaması. Her soruda doğru cevabın %90 olasılıkla içinde kaldığına inanılan bir alt ve bir üst sınır yazılır. Sorular iki gruba ayrılır; ilk grubun sonunda yalnızca kaç aralığın doğru cevabı içerdiği söylenir, doğru cevaplar ve kaynakları en sonda gösterilir. Doğru cevaplar soruların yanında belirtilen kaynaklardaki değerlerdir.

Özgün çalışmadan farklar

  • On soru azdır: şans isabet oranını kolayca 10–20 puan oynatabilir.
  • Cevabı internette aramak mümkündür; süre sınırı yoktur.
  • Sorular Türkiye'ye ilişkin bilgiler de içerir; bazı katılımcılara daha tanıdık gelebilir.

Ölçülen değişkenler

Açık veri dosyasındaki sütunlar. Liste biçimindeki alanlar numaralı sütunlara açılır (örneğin rt_60, est_3); JSON sütunlarında yalnızca sayılar ve sabit uyaran adları bulunur.

SütunTürAçıklama
intervalsJSONOn sorunun aralıkları: [[alt, üst] × 10] (alt > üst girildiyse sunucuda yer değiştirilir).
hitsintegerDoğru cevabı içeren aralık sayısı (0–10; iyi kalibre biri için beklenen yaklaşık 9).
hit_1numberHer soruda aralık doğru cevabı içeriyor mu (1 = evet); sütun sonundaki sayı soru sırasıdır. (1. öğe)
hit_2numberHer soruda aralık doğru cevabı içeriyor mu (1 = evet); sütun sonundaki sayı soru sırasıdır. (2. öğe)
hit_3numberHer soruda aralık doğru cevabı içeriyor mu (1 = evet); sütun sonundaki sayı soru sırasıdır. (3. öğe)
hit_4numberHer soruda aralık doğru cevabı içeriyor mu (1 = evet); sütun sonundaki sayı soru sırasıdır. (4. öğe)
hit_5numberHer soruda aralık doğru cevabı içeriyor mu (1 = evet); sütun sonundaki sayı soru sırasıdır. (5. öğe)
hit_6numberHer soruda aralık doğru cevabı içeriyor mu (1 = evet); sütun sonundaki sayı soru sırasıdır. (6. öğe)
hit_7numberHer soruda aralık doğru cevabı içeriyor mu (1 = evet); sütun sonundaki sayı soru sırasıdır. (7. öğe)
hit_8numberHer soruda aralık doğru cevabı içeriyor mu (1 = evet); sütun sonundaki sayı soru sırasıdır. (8. öğe)
hit_9numberHer soruda aralık doğru cevabı içeriyor mu (1 = evet); sütun sonundaki sayı soru sırasıdır. (9. öğe)
hit_10numberHer soruda aralık doğru cevabı içeriyor mu (1 = evet); sütun sonundaki sayı soru sırasıdır. (10. öğe)
interval_scorenumberOrtalama aralık puanı (Gneiting ve Raftery, 2007): (genişlik + 20 × ıskalama mesafesi) / |doğru cevap|; düşük olan daha iyi.
pointsintegerKalibrasyon puanı: round(100 / (1 + interval_score)), 0–100.
Her dosyada bulunan ortak sütunlar (14)
row_idstringSatır kodu. Her sürümde yeniden ve rastgele üretilir; kişiyi tanımlamaz, sürümler ya da deneyler arasında eşleştirilemez.
experimentstringDeneyin kısa adı (adres kısaltması).
experiment_versionintegerCevap biçiminin sürümü. Biçim değişen deneylerde yalnızca güncel biçim yayımlanır.
dateYYYY-MM-DD | YYYY-Www | YYYY-MMCevabın verildiği gün (İstanbul saati). Aynı gün, dil ve cihazda 5 kişiden az cevap varsa ISO haftasına, o da yetmezse aya kabalaştırılır.
date_precisionday | week | monthdate sütununun inceliği.
langtr | en | (boş)Arayüz dili. Dil kaydı Ekim 2026’nın ilk haftasında başladı; daha önceki cevaplarda yalnızca uyaranı dile bağlı deneylerde bilinir, bilinmiyorsa boş.
devicedesktop | mobile | tablet | (boş)Tarayıcının tanıttığı cihaz sınıfı (yalnızca sınıf; tarayıcı bilgisi saklanmaz ve yayımlanmaz).
sourcesite | embedCevabın geldiği yer: balabs sitesi ya da başka bir sitede gömülü deney. Gömen sitenin adresi yayımlanmaz.
modefree | daily | challenge | race | session | (boş)Puanlı deneylerde oynama biçimi: serbest, günün turu, meydan okuma, yarış odası, deney oturumu. Puansız deneylerde ve biçimi saklanmayan eski cevaplarda boş.
color_visionnormal | rg | by | contrast | (boş)Renge dayalı deneylerde katılımcının seçtiği renk görüşü modu: normal, kırmızı-yeşil, mavi-sarı ya da yüksek kontrast. Modlarda uyaranlar farklı eksenlerde üretilir; karşılaştırmalar mod içinde yapılmalıdır. Diğer deneylerde boş.
first_play1Her satır bir deneğin bu deneydeki ilk oynayışıdır (her zaman 1). Tekrar oynayışlar yalnızca sıralama puanı olarak saklanır ve açık veriye girmez.
seen_beforeyes | no | unsure | (boş)Katılımcının bu deneyi ya da bilinen cevabını daha önce görüp görmediğine dair kendi beyanı (soran deneylerde).
duration_snumberDeneyin başından cevabın gönderilmesine kadar geçen süre, saniye (istemcide ölçülür, 0,1 s).
play_scorenumberİlk oynayışın sıralama puanı (puanlı deneylerde; tanımı yöntem kartında). Puansız deneylerde boş.

Dışlama ölçütleri

Sunucu on sorunun her biri için iki sınırın sorunun izin verilen aralığında olduğunu doğrular; eksik gönderim reddedilir. İsabet ve puanlar sunucuda hesaplanır.

  • Yalnızca her deneğin bu deneydeki ilk cevabı; tekrar oynayışlar girmez.
  • Simülasyon satırları, botlar, engellenmiş ve örnek hesaplar girmez.
  • 3 Ekim 2026 öncesindeki cevaplar girmez (açık veri notunun yayında olduğu ilk gün).

Puanlama

Sıralama puanı: kalibrasyon puanı (0–100); hem dar hem isabetli aralıklar ödüllendirilir. Yüksek olan daha iyi.

Sıralama ölçüsü: kalibrasyon (yüksek daha iyi). Açık verideki play_score sütunu ilk oynayışın bu puanıdır.

Sürüm notları

  • Ekim 2026

    Puanlı deneylerde oynama biçimi (serbest, günlük, meydan okuma, yarış, oturum) cevapla birlikte saklanmaya başladı; önceki cevaplarda mode sütunu boş.

  • Ekim 2026

    Arayüz dili (lang) cevapla birlikte saklanmaya başladı; önceki cevaplarda yalnızca uyaranları dile bağlı deneylerde biliniyor, ötekilerde boş.