Tag: Interpretability
All the articles with the tag "Interpretability".
-
J-Space: Penemuan Anthropic tentang 'Inner Monologue' AI yang Mengubah Cara Kita Memahami Model Bahasa
Anthropic, perusahaan AI bernilai hampir $1 triliun, mempublikasikan riset yang mengungkap 'J-space' — ruang neural tempat model bahasa menjalankan penalaran diam-diam yang tidak terlihat dalam chain-of-thought. Ini membuka jalan baru untuk memahami dan mengendalikan halusinasi AI.