Açık ağırlıklı AI modelleri, özellikle Çin'in Z.ai tarafından geliştirilen GLM-5.2 modeli, endüstrinin önde gelen modellerine yaklaşıyor. Ancak, güvenlik uygulamaları arasındaki uçurum büyüyor. AI güvenlik kâr kuruluşu SaferAI'nin bir raporuna göre, GLM-5.2 modeli, siber ve biyolojik yeteneklerde OpenAI'nin GPT-5.5 ve Anthropic'in Claude Opus 4.7 modellerine sadece birkaç ay geride.
Açık Ağırlıklı Modellerin Riskleri
Açık ağırlıklı modellerin potansiyel riskleri, bazı eleştirmenler tarafından yıllardır uyarı konusu olmuştu. Bu modeller, yüksek kapasiteli AI'yi potansiyel saldırganların eline verebilir ve bir kez indirildikten sonra teknoloji nasıl kullanılacağına dair hiçbir kontrol mekanizması bulunmayabilir. GLM-5.2 modeli, verilen tüm siber ve çift kullanımlı biyoloji görevlerini reddetmedi, oysa Claude Opus 4.7 modeli, görevleri o kadar tutarlı bir şekilde reddetti ki, SaferAI, CyberGym'i bu model üzerinde tamamlayamadı.
Güvenlik Önlemleri
Önde gelen AI geliştiricileri, sınırlı siber ve biyolojik yardım için önlemler almaya çalışıyorlar. Ancak, bu önlemler, özellikle açık ağırlıklı modellerde, yeterli değil. AI güvenlik kâr kuruluşu Far.ai, xAI'nin Grok 4.5 ve Google DeepMind'in Gemini 3.1 Pro gibi önde gelen modellerde yüzlerce evrensel jailbreak buldu. Jailbreak'ler, saldırganların, rolleri oynama, yetki sahteciliği, sahte konuşma geçmişi ve takip eden.promt'ları birleştirerek modelin savunma noktalarını aşmalarına olanak tanır.
Ne Anlama Geliyor?
Açık ağırlıklı AI modellerinin gelişmesi ve güvenlik uygulamaları arasındaki uçurum, AI'nin geleceği için önemli sonuçlar doğurabilir. AI şirketleri, güvenli ve açık AI modelleri geliştirmek için çalışırken, aynı zamanda, bu modellerin potansiyel risklerini de dikkate almak zorundalar. AI'nin güvenli kullanımı için, şirketlerin, hükümetlerin ve kullanıcıların birlikte çalışması ve sorumluluk alması gerekiyor.





Yorumlar (0)
İlk yorumu sen yaz.