Ne kadar eminsin?.
On sayısal soru: her birinde doğru cevabın yüzde 90 olasılıkla içinde kalacağı bir aralık verebilir misin?
Özgün çalışma
- Alpert, M., & Raiffa, H. (1982). A progress report on the training of probability assessors. In D. Kahneman, P. Slovic, & A. Tversky (Eds.), Judgment under uncertainty: Heuristics and biases (pp. 294–305). Cambridge University Press. Kaynak
- Lichtenstein, S., Fischhoff, B., & Phillips, L. D. (1982). Calibration of probabilities: The state of the art to 1980. In D. Kahneman, P. Slovic, & A. Tversky (Eds.), Judgment under uncertainty: Heuristics and biases (pp. 306–334). Cambridge University Press. Kaynak
- Soll, J. B., & Klayman, J. (2004). Overconfidence in interval estimates. Journal of Experimental Psychology: Learning, Memory, and Cognition, 30(2), 299–314. Kaynak
- Moore, D. A., & Healy, P. J. (2008). The trouble with overconfidence. Psychological Review, 115(2), 502–517. Kaynak
- Haran, U., Moore, D. A., & Morewedge, C. K. (2010). A simple remedy for overprecision in judgment. Judgment and Decision Making, 5(7), 467–476. Kaynak
- Moore, D. A., Tenney, E. R., & Haran, U. (2015). Overprecision in judgment. In G. Keren & G. Wu (Eds.), The Wiley Blackwell handbook of judgment and decision making (pp. 182–209). Wiley. Kaynak
Uyarlamamız
Alpert ve Raiffa'nın (1982) %90 güven aralığı görevinin on sorulu uyarlaması. Her soruda doğru cevabın %90 olasılıkla içinde kaldığına inanılan bir alt ve bir üst sınır yazılır. Sorular iki gruba ayrılır; ilk grubun sonunda yalnızca kaç aralığın doğru cevabı içerdiği söylenir, doğru cevaplar ve kaynakları en sonda gösterilir. Doğru cevaplar soruların yanında belirtilen kaynaklardaki değerlerdir.
Özgün çalışmadan farklar
- On soru azdır: şans isabet oranını kolayca 10–20 puan oynatabilir.
- Cevabı internette aramak mümkündür; süre sınırı yoktur.
- Sorular Türkiye'ye ilişkin bilgiler de içerir; bazı katılımcılara daha tanıdık gelebilir.
Ölçülen değişkenler
Açık veri dosyasındaki sütunlar. Liste biçimindeki alanlar numaralı sütunlara açılır (örneğin rt_60, est_3); JSON sütunlarında yalnızca sayılar ve sabit uyaran adları bulunur.
| Sütun | Tür | Açıklama |
|---|---|---|
intervals | JSON | On sorunun aralıkları: [[alt, üst] × 10] (alt > üst girildiyse sunucuda yer değiştirilir). |
hits | integer | Doğru cevabı içeren aralık sayısı (0–10; iyi kalibre biri için beklenen yaklaşık 9). |
hit_1 | number | Her soruda aralık doğru cevabı içeriyor mu (1 = evet); sütun sonundaki sayı soru sırasıdır. (1. öğe) |
hit_2 | number | Her soruda aralık doğru cevabı içeriyor mu (1 = evet); sütun sonundaki sayı soru sırasıdır. (2. öğe) |
hit_3 | number | Her soruda aralık doğru cevabı içeriyor mu (1 = evet); sütun sonundaki sayı soru sırasıdır. (3. öğe) |
hit_4 | number | Her soruda aralık doğru cevabı içeriyor mu (1 = evet); sütun sonundaki sayı soru sırasıdır. (4. öğe) |
hit_5 | number | Her soruda aralık doğru cevabı içeriyor mu (1 = evet); sütun sonundaki sayı soru sırasıdır. (5. öğe) |
hit_6 | number | Her soruda aralık doğru cevabı içeriyor mu (1 = evet); sütun sonundaki sayı soru sırasıdır. (6. öğe) |
hit_7 | number | Her soruda aralık doğru cevabı içeriyor mu (1 = evet); sütun sonundaki sayı soru sırasıdır. (7. öğe) |
hit_8 | number | Her soruda aralık doğru cevabı içeriyor mu (1 = evet); sütun sonundaki sayı soru sırasıdır. (8. öğe) |
hit_9 | number | Her soruda aralık doğru cevabı içeriyor mu (1 = evet); sütun sonundaki sayı soru sırasıdır. (9. öğe) |
hit_10 | number | Her soruda aralık doğru cevabı içeriyor mu (1 = evet); sütun sonundaki sayı soru sırasıdır. (10. öğe) |
interval_score | number | Ortalama aralık puanı (Gneiting ve Raftery, 2007): (genişlik + 20 × ıskalama mesafesi) / |doğru cevap|; düşük olan daha iyi. |
points | integer | Kalibrasyon puanı: round(100 / (1 + interval_score)), 0–100. |
Her dosyada bulunan ortak sütunlar (14)
row_id | string | Satır kodu. Her sürümde yeniden ve rastgele üretilir; kişiyi tanımlamaz, sürümler ya da deneyler arasında eşleştirilemez. |
experiment | string | Deneyin kısa adı (adres kısaltması). |
experiment_version | integer | Cevap biçiminin sürümü. Biçim değişen deneylerde yalnızca güncel biçim yayımlanır. |
date | YYYY-MM-DD | YYYY-Www | YYYY-MM | Cevabın verildiği gün (İstanbul saati). Aynı gün, dil ve cihazda 5 kişiden az cevap varsa ISO haftasına, o da yetmezse aya kabalaştırılır. |
date_precision | day | week | month | date sütununun inceliği. |
lang | tr | en | (boş) | Arayüz dili. Dil kaydı Ekim 2026’nın ilk haftasında başladı; daha önceki cevaplarda yalnızca uyaranı dile bağlı deneylerde bilinir, bilinmiyorsa boş. |
device | desktop | mobile | tablet | (boş) | Tarayıcının tanıttığı cihaz sınıfı (yalnızca sınıf; tarayıcı bilgisi saklanmaz ve yayımlanmaz). |
source | site | embed | Cevabın geldiği yer: balabs sitesi ya da başka bir sitede gömülü deney. Gömen sitenin adresi yayımlanmaz. |
mode | free | daily | challenge | race | session | (boş) | Puanlı deneylerde oynama biçimi: serbest, günün turu, meydan okuma, yarış odası, deney oturumu. Puansız deneylerde ve biçimi saklanmayan eski cevaplarda boş. |
color_vision | normal | rg | by | contrast | (boş) | Renge dayalı deneylerde katılımcının seçtiği renk görüşü modu: normal, kırmızı-yeşil, mavi-sarı ya da yüksek kontrast. Modlarda uyaranlar farklı eksenlerde üretilir; karşılaştırmalar mod içinde yapılmalıdır. Diğer deneylerde boş. |
first_play | 1 | Her satır bir deneğin bu deneydeki ilk oynayışıdır (her zaman 1). Tekrar oynayışlar yalnızca sıralama puanı olarak saklanır ve açık veriye girmez. |
seen_before | yes | no | unsure | (boş) | Katılımcının bu deneyi ya da bilinen cevabını daha önce görüp görmediğine dair kendi beyanı (soran deneylerde). |
duration_s | number | Deneyin başından cevabın gönderilmesine kadar geçen süre, saniye (istemcide ölçülür, 0,1 s). |
play_score | number | İlk oynayışın sıralama puanı (puanlı deneylerde; tanımı yöntem kartında). Puansız deneylerde boş. |
Dışlama ölçütleri
Sunucu on sorunun her biri için iki sınırın sorunun izin verilen aralığında olduğunu doğrular; eksik gönderim reddedilir. İsabet ve puanlar sunucuda hesaplanır.
- Yalnızca her deneğin bu deneydeki ilk cevabı; tekrar oynayışlar girmez.
- Simülasyon satırları, botlar, engellenmiş ve örnek hesaplar girmez.
- 3 Ekim 2026 öncesindeki cevaplar girmez (açık veri notunun yayında olduğu ilk gün).
Puanlama
Sıralama puanı: kalibrasyon puanı (0–100); hem dar hem isabetli aralıklar ödüllendirilir. Yüksek olan daha iyi.
Sıralama ölçüsü: kalibrasyon (yüksek daha iyi). Açık verideki play_score sütunu ilk oynayışın bu puanıdır.
Sürüm notları
- Ekim 2026
Puanlı deneylerde oynama biçimi (serbest, günlük, meydan okuma, yarış, oturum) cevapla birlikte saklanmaya başladı; önceki cevaplarda mode sütunu boş.
- Ekim 2026
Arayüz dili (lang) cevapla birlikte saklanmaya başladı; önceki cevaplarda yalnızca uyaranları dile bağlı deneylerde biliniyor, ötekilerde boş.