Yöntem kartı · Yapay zekâ

İnsan mı yazdı, yapay zekâ mı?.

Yunus Emre’nin, Karacaoğlan’ın, Namık Kemal’in ve Tevfik Fikret’in dizelerini, onların üslubunda yazan bir yapay zekâdan ayırt edebilir misin?

Deneye git3 dk sürer1 gerçek ilk cevap

Özgün çalışma

  1. Porter, B., & Machery, E. (2024). AI-generated poetry is indistinguishable from human-written poetry and is rated more favorably. Scientific Reports, 14, 26133. Kaynak
  2. Köbis, N., & Mossink, L. D. (2021). Artificial intelligence versus Maya Angelou: Experimental evidence that people cannot differentiate AI-generated from human-written poetry. Computers in Human Behavior, 114, 106553. Kaynak

Uyarlamamız

Porter ve Machery'nin (2024) insan ve yapay zekâ şiiri ayırt etme deneyinin kısa parçalarla uyarlaması. Dört şairin (Türkçede Yunus Emre, Karacaoğlan, Namık Kemal, Tevfik Fikret; İngilizcede Shakespeare, Keats, Whitman, Dickinson) her birinden iki parça gösterilir; havuzda her şair için 1929 öncesi kamu malı eserlerden iki gerçek parça ve Claude'un (Anthropic) o şairin üslubunda yazdığı iki parça vardır. Her parça önce 1–5 arasında beğeniyle puanlanır, sonra 'insan' ya da 'yapay zekâ' diye tahmin edilir. Çözüm sonuç ekranında gösterilir.

Özgün çalışmadan farklar

  • Bütün şiirler değil, dört dizelik parçalar kullanılır.
  • Yapay zekâ parçalarını tek bir model yazdı ve onları biz seçtik.
  • Türkçe ve İngilizce havuzlar farklıdır; dil sütunuyla ayrılmalıdır.

Ölçülen değişkenler

Açık veri dosyasındaki sütunlar. Liste biçimindeki alanlar numaralı sütunlara açılır (örneğin rt_60, est_3); JSON sütunlarında yalnızca sayılar ve sabit uyaran adları bulunur.

SütunTürAçıklama
rJSONParçalar: [[havuz parçası, karar 0 insan / 1 yapay zekâ, beğeni 1–5, süre ms, doğru 1/0] × 8].
scoreintegerDoğru tahmin sayısı (0–8).
ofintegerParça sayısı (8).
Her dosyada bulunan ortak sütunlar (14)
row_idstringSatır kodu. Her sürümde yeniden ve rastgele üretilir; kişiyi tanımlamaz, sürümler ya da deneyler arasında eşleştirilemez.
experimentstringDeneyin kısa adı (adres kısaltması).
experiment_versionintegerCevap biçiminin sürümü. Biçim değişen deneylerde yalnızca güncel biçim yayımlanır.
dateYYYY-MM-DD | YYYY-Www | YYYY-MMCevabın verildiği gün (İstanbul saati). Aynı gün, dil ve cihazda 5 kişiden az cevap varsa ISO haftasına, o da yetmezse aya kabalaştırılır.
date_precisionday | week | monthdate sütununun inceliği.
langtr | en | (boş)Arayüz dili. Dil kaydı Ekim 2026’nın ilk haftasında başladı; daha önceki cevaplarda yalnızca uyaranı dile bağlı deneylerde bilinir, bilinmiyorsa boş.
devicedesktop | mobile | tablet | (boş)Tarayıcının tanıttığı cihaz sınıfı (yalnızca sınıf; tarayıcı bilgisi saklanmaz ve yayımlanmaz).
sourcesite | embedCevabın geldiği yer: balabs sitesi ya da başka bir sitede gömülü deney. Gömen sitenin adresi yayımlanmaz.
modefree | daily | challenge | race | session | (boş)Puanlı deneylerde oynama biçimi: serbest, günün turu, meydan okuma, yarış odası, deney oturumu. Puansız deneylerde ve biçimi saklanmayan eski cevaplarda boş.
color_visionnormal | rg | by | contrast | (boş)Renge dayalı deneylerde katılımcının seçtiği renk görüşü modu: normal, kırmızı-yeşil, mavi-sarı ya da yüksek kontrast. Modlarda uyaranlar farklı eksenlerde üretilir; karşılaştırmalar mod içinde yapılmalıdır. Diğer deneylerde boş.
first_play1Her satır bir deneğin bu deneydeki ilk oynayışıdır (her zaman 1). Tekrar oynayışlar yalnızca sıralama puanı olarak saklanır ve açık veriye girmez.
seen_beforeyes | no | unsure | (boş)Katılımcının bu deneyi ya da bilinen cevabını daha önce görüp görmediğine dair kendi beyanı (soran deneylerde).
duration_snumberDeneyin başından cevabın gönderilmesine kadar geçen süre, saniye (istemcide ölçülür, 0,1 s).
play_scorenumberİlk oynayışın sıralama puanı (puanlı deneylerde; tanımı yöntem kartında). Puansız deneylerde boş.

Dışlama ölçütleri

Sunucu parçaların oyuncunun diline ait olduğunu, her şairden tam iki parça geldiğini doğrular ve isabetleri kendisi hesaplar.

  • Yalnızca her deneğin bu deneydeki ilk cevabı; tekrar oynayışlar girmez.
  • Simülasyon satırları, botlar, engellenmiş ve örnek hesaplar girmez.
  • 3 Ekim 2026 öncesindeki cevaplar girmez (açık veri notunun yayında olduğu ilk gün).

Puanlama

Sıralama puanı: doğru tahmin sayısı (0–8); yüksek olan daha iyi.

Sıralama ölçüsü: doğru tahmin (yüksek daha iyi). Açık verideki play_score sütunu ilk oynayışın bu puanıdır.

Sürüm notları

  • Ekim 2026

    Arayüz dili (lang) cevapla birlikte saklanmaya başladı; önceki cevaplarda yalnızca uyaranları dile bağlı deneylerde biliniyor, ötekilerde boş.