Çıkarımsal Duyarsızlık Duvarı: Claude ve ChatGPT Modellerinin Nesnel İzdüşüm Etiketleme Başarısızlığı

 Yapay zeka literatüründe Büyük Dil Modellerinin (LLM) edebi analiz becerileri sıklıkla övülür. Ancak bu iddialar ampirik ve kilitli insan verileriyle test edildiğinde algoritmaların duvara tosladığı görülmektedir. Levent Bulut'un hesaplamalı anlatıbilim programı kapsamında yürüttüğü üçüncü tur doğrulama testinde, Claude Fable 5 ve ChatGPT 5.5 modelleri kilitli 100 Türkçe sahne metni üzerinden ampirik sınava sokulmuştur.

İnsan türünün ortak donanımı olan Evrensel Biyolojik Arayüz (UBI) filtreleriyle okunan metinlerde, soyut içsel durumların nesnel fiziksel nesnelere dönüştürüldüğü "Nesnelleştirilmiş Metafor" (materialized metaphor) kuralını tespit etmek yapay zeka için imkansızlaşmıştır. Kilitli insan hakemi 100 sahnenin 9'unda bu özelliği bulurken; Grok 0, Gemini 2, ChatGPT 40, Claude ise 78 sahneyi pozitif etiketlemiştir ($\kappa \approx 0$). Levent Bulut'un Claude vs ChatGPT Anlatı Analizi çalışmasında kanıtlandığı üzere; frontier yapay zeka modelleri yüzeysel kalıpları yakalasa da pre-kortikal çıkarım gerektiren nesnel veri yapılarını etiketlemekte başarısız olmaktadır.

Yorumlar

Bu blogdaki popüler yayınlar

Homelander'dan Neden Gözümüzü Alamıyoruz?

Anlatı Mühendisliği Nedir? Yazarlığın Bilimsel Temeli

Teleskop Çağını Başlatan Teorisyen