Yapay zeka devlerinin kötü niyetli saldırıları önlemek amacıyla geliştirdiği güvenlik bariyerlerinin, meşru siber güvenlik araştırmacılarının ve sistem savunucularının çalışmalarını engellediği ortaya çıktı. TechCrunch tarafından aktarılan bilgilere göre, bu 'koruma kalkanları' saldırganları durdururken, sistemlerdeki açıkları kapatmaya çalışan profesyonellerin önüne set çekiyor.

Sıkı Denetimler ve İhracat Kısıtlamaları

Amerika Birleşik Devletleri hükümetinin, Anthropic şirketine ait Mythos ve Fable modellerine yönelik ihracat kontrol kısıtlamaları getirmesi, tartışmaların merkezinde yer alıyor. Bu karar, modellerin güvenlik bariyerlerinin aşılıp kötü amaçlı siber saldırılar için kullanılabileceğine dair raporlar sonrası alındı. Mevcut durumda Fable 5 genel erişime açılırken, Mythos 5 sadece onaylanmış ABD kuruluşlarının kullanımına sunulmuş durumda.

Araştırmacıların 'Çocuk Muamelesi' Tepkisi

OpenAI'ın Trusted Access for Cyber ve Anthropic'in Cyber Verification Program gibi onay mekanizmaları olsa da, uzmanlar bu durumdan memnun değil. CrowdFense CTO'su Paolo Stagno, yapay zeka şirketlerinin onay programlarıyla müşterilerine çocukmuş gibi davrandıklarını savunuyor. Bilinen güvenlik araştırmacısı Mark Dowd ise dev şirketlerin, güvenlik alanında neyin güvenli olup olmadığına dair keyfi kararlar vermesini sorunlu buluyor.

Saldırı ve Savunma Arasındaki İnce Çizgi

NCC Group Baş Bilimcisi Chris Anley, bir kodun düzeltilmesi için verilen komutun hem savunma için temel bir mekanizma olduğunu hem de kritik açıkların bulunması için bir yol haritası sunduğunu belirtiyor. Anley, bu araçları bir çekice benzeterek, ev yapmak için gereken bir aletin aynı zamanda bir silaha dönüşebileceğini, dolayısıyla saldırı ve savunma araçlarının birbirinden tamamen ayrılamayacağını vurguluyor.

Ne anlama geliyor?

Yapay zeka sistemlerinde kullanılan güvenlik filtreleri, yazılımın belirli zararlı talepleri reddetmesini sağlayan mekanizmalardır. Bu sistemler, gelen sorguyu analiz ederek tehlikeli içerik tespit ettiğinde yanıt vermeyi reddeder. Ancak siber güvenlik dünyasında, bir açığın gerçekten var olduğunu kanıtlamak için o açığın nasıl sömürüleceğinin simüle edilmesi gerekir. Filtreler bu simülasyonu engellediğinde, uzmanlar sistemdeki hataları tespit edip onaramaz hale gelir.

Sektördeki profesyoneller, kısıtlamalarla karşılaştıklarında koruma mekanizması bulunmayan açık kaynaklı modellere yönelmektedir. Bu durum, kapalı devre sistemlerin güvenliği artırma çabasının, aslında sistemlerin zayıf noktalarının bulunup kapatılmasını yavaşlatarak dolaylı bir risk oluşturduğunu göstermektedir.