Yapay zeka şirketi Anthropic, büyük dil modellerinin (LLM) çalışma mekanizmalarını daha derinlemesine analiz etmek için yeni bir teknik geliştirdi. Şirket, Şubat ayında piyasaya sürdüğü Claude Opus 4.6 üzerinde yaptığı çalışmalarla, modelin yanıt üretmeden önce kullandığı gizli bir alanı tespit etti.
J-Space: Yapay Zekanın Zihinsel Hazırlık Alanı
Araştırmacılar, Jacobian lens (J-lens) adını verdikleri bir araç geliştirerek, modelin içinde J-space olarak adlandırılan gizli bir bölge keşfettiler. Bu alan, modelin kısa süre içinde yanıt olarak sunması muhtemel olan kelime ve ifadelerle ilişkili bireysel kelimeleri barındırıyor. Bu durum, modelin aslında ne söyleyeceği ile arka planda nelerle uğraştığının farklı olabileceğini ortaya koyuyor.
Mekanizmaların İşleyişi ve J-Lens Teknolojisi
Yapay zeka modelleri, nöronlardan oluşan katmanlar şeklinde çalışır. Giriş katmanları metni işlerken, çıkış katmanları üretilecek metni hazırlar. Asıl karmaşık işlemler ise orta katmanlarda gerçekleşir. Anthropic, mevcut logit lens aracını geliştirerek oluşturduğu J-lens ile, modelin sadece bir sonraki kelimeyi değil, gelecekteki yanıt aşamalarında kullanabileceği ilişkili kavramları da nasıl işlediğini görünür kıldı.
Şeffaflık ve Denetim İçin Yeni Bir Yol
Anthropic, J-space içindeki kelimelerin izlenmesinin, modelleri anlama ve kontrol etme konusunda yeni bir yöntem sunduğunu belirtiyor. Şirket, elde edilen sonuçları bir makale ile paylaştığının yanı sıra, açık kaynaklı bir platform olan Neuronpedia ile iş birliği yaparak herkesin deneyebileceği bir demo yayınladı. Bu çalışma, yapay zekanın iç işleyişini çözmeyi amaçlayan mekanistik yorumlanabilirlik alanındaki araştırmaları derinleştiriyor.





Yorumlar (0)
İlk yorumu sen yaz.