Beyin Öğrenirken Sıkıştırıyor: Ödül Fonksiyonları ve Çalışma Belleği
İnsanlar yeni ve soyut hedeflere değer atfedebilir; bu da pekiştirmeli öğrenmeyi mümkün kılar. Ancak bu esneklik bilişsel açıdan maliyetlidir. Yeni bir araştırma, hedef odaklı öğrenmenin başlangıçta kapasitesi sınırlı olan çalışma belleğine dayandığını öne sürüyor. Deneyim arttıkça beyin, hedef kuralını basitleştirerek bir tür 'sıkıştırılmış' ödül fonksiyonu oluşturuyor ve bunu uzun süreli belleğe aktarıyor. Bu süreç, geri bildirim alındığında değerlendirmeyi neredeyse otomatik hale getiriyor; böylece çalışma belleği serbest kalıyor ve öğrenme verimliliği artıyor. Altı farklı deneyde test edilen bu model, hedef uzayının büyüklüğünün öğrenmeyi zorlaştırdığını, ancak bu uzayın sıkıştırmaya uygun bir yapıya sahip olması durumunda öğrenmenin hızlandığını gösteriyor. Ayrıca ödül sinyallerinin daha hızlı işlenmesinin daha iyi öğrenme performansıyla bağlantılı olduğu da saptandı. Çalışma, verimli hedef odaklı öğrenmenin merkezinde bilişsel sıkıştırma mekanizmalarının yattığını ileri sürüyor.