Anthropic CEO'su Dario Amodei, şirketin yapay zeka geliştirme hızını yavaşlatma yönünde üç strateji belirlediğini duyurdu. Amodei, bu stratejilerden birine tek taraflı bağlı kalındığını ve bu adımın AI güvenliğini artırmayı amaçladığını belirtti.
Güvenlik İhtiyacının Altı Çizgisi
CEO, OpenAI‑HuggingFace hack'i ve son aylarda yapay zekanın çok daha hızlı ilerlemesi gibi iki olayı, temkinli bir yaklaşımın gerekliliğini kanıtlayan faktörler olarak gösterdi. Bu gelişmeler, modellerin yeteneklerinin beklenmedik bir şekilde artmasına yol açtı.
“Embedded Evaluators” Modeli
Amodei, üçüncü taraf kuruluşlardan “gömülü değerlendirme” birimlerinin kullanılmasını önerdi. METR gibi bağımsız değerlendirme kuruluşları, firmaların belirlenen yavaşlatma ve güvenlik taahhütlerine uyup uymadığını denetleyecek ve olası güvenlik olaylarını raporlayacak.
Ne anlama geliyor?
Bu yaklaşım, yapay zeka modellerinin geliştirilme sürecine dış denetim mekanizmaları ekleyerek ilerleme hızının kontrol altında tutulmasını hedefler. Bağımsız değerlendirme birimleri, modelin yeni yetenekler kazanırken güvenlik protokollerine uygunluğunu sürekli izler. Böylece, teknolojik yeniliklerin toplumsal risklerle dengelenmesi sağlanır.





Yorumlar (0)
İlk yorumu sen yaz.