Bir şiirin yazarını dizelerden bilebilir misin?
Yunus Emre’nin sadeliği, Karacaoğlan’ın türküleri, Namık Kemal’in coşkusu, Tevfik Fikret’in hüznü: bu şairlerin sesleri o kadar tanıdık ki, bir dizeyi duyunca kime ait olduğunu bildiğimizi düşünürüz. Peki bir yapay zekâ aynı sesi taklit ederse ne olur?
Bu deneyde dört şairin her birinden iki kısa parça okuyorsun. Her parça ya şairin kendi eserinden ya da onun üslubunda yazan bir yapay zekâdan. Önce parçayı ne kadar beğendiğini söylüyor, sonra kimin yazdığını tahmin ediyorsun. Sonuç ekranında bütün parçaların kaynaklarını ve kalabalığın en çok hangi parçada yanıldığını görebilirsin.
Porter ve Machery’nin deneyi
Brian Porter ve Édouard Machery (2024), Chaucer’dan Dorothea Lasky’ye on İngilizce şairin her birinden beş şiir topladı ve ChatGPT-3.5’ten her şairin üslubunda beş şiir yazmasını istedi. Yapay zekânın ilk yazdığı beş şiiri olduğu gibi kullandılar; en iyilerini seçmediler. 1.634 katılımcının her biri bir şairin beş gerçek ve beş yapay zekâ şiirini okuyup her birinin kimin elinden çıktığını tahmin etti.
Doğruluk %46,6’ydı: şans düzeyinin biraz altında. Daha da çarpıcısı, katılımcılar yapay zekâ şiirlerine gerçek şiirlerden daha sık “insan yazdı” diyordu. “İnsan” denme oranı en düşük beş şiirin beşi de gerçek şairlere aitti; en yüksek beş şiirin dördü yapay zekâ yazımıydı.
Daha çok beğeniyoruz ama bilince küçümsüyoruz
İkinci çalışmada 696 katılımcı aynı şiirleri ritim, imge, güzellik, anlam gibi 14 nitelik üzerinden puanladı. Yapay zekâ şiirleri bu niteliklerin çoğunda gerçek şiirlerden daha yüksek puan aldı. Ama katılımcılara bir şiirin yapay zekâ tarafından yazıldığı söylendiğinde, aynı şiire verilen puanlar düştü.
Yazarlar bunu şöyle açıklıyor: uzman olmayan okurlar, duyguyu ve fikri daha doğrudan ve anlaşılır biçimde söyleyen yapay zekâ şiirlerini daha çok beğeniyor; ama yapay zekâ şiirinin kötü olacağını bekliyorlar. Bu yüzden beğendikleri şiiri insanın yazdığını düşünüyor, anlamakta zorlandıkları karmaşık şiirleri ise yapay zekâya yakıştırıyorlar.
Eski modeller, yeni modeller
Birkaç yıl önce tablo farklıydı. Köbis ve Mossink (2021), GPT-2 ile yazılmış şiirleri gerçek şiirlerle karşılaştırdı. Yapay zekânın yazdıkları arasından rastgele bir şiir seçildiğinde katılımcılar onu ayırt edebiliyordu; ama bir insan en iyi şiiri seçtiğinde ayırt edemiyordu. Katılımcılar ayrıca yapay zekâ şiirlerine karşı hafif bir isteksizlik gösteriyordu.
Porter ve Machery’nin sonuçları, daha yeni bir modelle, insanın seçim yapmadığı durumda bile ayrımın kaybolduğunu gösteriyor. Bu deneyde kullandığımız yapay zekâ parçaları ise bir yapay zekâ modeline (Claude, Anthropic) yazdırıldı ve bizim tarafımızdan seçildi; yani “insanın döngüde olduğu” koşula daha yakın.
Neden bir yapay zekâ stüdyosu bu deneyi yapıyor?
ba creative labs bir yapay zekâ stüdyosu ve bu laboratuvar onun vitrini. Yapay zekânın neler yapabildiğini göstermenin en dürüst yolu, insanlara kendileri sınayabilecekleri bir deney sunmak ve sonra her şeyi açıklamak. Bu yüzden yapay zekâ parçalarının hepsini çözüm bölümünde işaretliyoruz ve gerçek parçaların kaynaklarını veriyoruz.
Sonuç ne çıkarsa çıksın, bir şey değişmiyor: Yunus Emre’nin “Bu can gövdeye konuktur” dizesi yedi yüz yıllık bir hayatın ve bir dünya görüşünün ürünü. Yapay zekâ onun sesini taklit edebilir; ama taklit edebilmesi, o sesin değerini azaltmıyor. Belki de asıl soru “ayırt edebilir miyiz?” değil, “ayırt etmek bizim için neden önemli?”