Büyük yapay zeka modellerinin beklenmedik bir zayıflığı keşfedildi: Bu sistemler karmaşık matematiksel problemleri çözebilirken, basit soruları hızlıca yanıtlama konusunda sıkıntı yaşıyor.
Araştırmacılar, yapay zeka modellerinin 'Sistem 1 düşünme' yeteneğini inceledi. Bu kavram, insanların basit sorulara hızla ve sezgisel olarak verdiği cevapları ifade ediyor. Örneğin '2+2 kaç eder?' sorusuna uzun açıklamalar yapmadan doğrudan '4' cevabını vermek gibi.
S1-Bench adı verilen yeni bir test sistemi geliştiren araştırma ekibi, 28 farklı büyük dil modelini çok dilli ve çok alanlı basit sorularla test etti. Sonuçlar şaşırtıcıydı: Modeller basit problemlerde bile gereksiz uzun açıklamalar yaparak zaman ve hesaplama gücü harcıyordu.
Daha da ilginç olan bulgu, modellerin problem zorluğunu erken fark etmelerine rağmen güven seviyelerinin düşük kalması oldu. Bu durum, modellerin kendi yeteneklerini doğru değerlendiremediğini gösteriyor.
Bulgular, yapay zeka sistemlerinin gerçek dünya uygulamalarında daha verimli çalışabilmesi için, sadece karmaşık problemleri çözme değil, basit işlemleri de optimize etme ihtiyacını ortaya koyuyor.