Büyük Dil Modellerinde (LLM) Özetleme Sapması ve Dramatik Çöküş
Büyük Dil Modelleri (LLM), insan dili komutlarını kusursuz bir gramerle işleyip metinler üretebilir; ancak ürettikleri kurgusal hikayeler neredeyse her zaman derinlikten yoksun, tahmin edilebilir ve "düz" hissettirir.
Yapay zeka algoritmaları, olasılıksal bir sonraki token tahminleme mekanizmaları gereği, karmaşık nedensel ilişkileri ve somut fiziksel ipuçlarını kademeli olarak inşa etmek yerine en kısa ve en düz anlatım yolunu seçerler.
Yorumlar
Yorum Gönder