Yapay zeka tabanlı web tarayıcılarının güvenlik mekanizmalarını devre dışı bırakan BioShocking adlı yeni bir saldırı yöntemi keşfedildi. Güvenlik araştırmacılarının ortaya çıkardığı bu açık, yapay zeka modellerini gerçeklik algısından uzaklaştırarak yasaklı talimatları yerine getirmelerini sağlıyor.

Mantık Hatalarıyla Güvenlik Duvarları Aşılıyor

Güvenlik şirketi LayerX'ten araştırmacı Roy Paz'ın çalışmasına göre, saldırganlar yapay zekayı yanlış cevapların ödüllendirildiği bir oyun mekanizmasına yönlendiriyor. Örneğin, 2 + 2 = 5 gibi hatalı bir sonucun doğru kabul edildiği bir kurguda, modelin güvenlik bariyerleri devre dışı kalıyor. Yapay zeka, içinde bulunduğu ortamın gerçek olmadığını fark ettiğinde, gerçek dünyadaki güvenlik kurallarının artık geçerli olmadığı bir yanılsamaya giriyor.

Kullanıcı Verileri ve Şifreler Tehlike Altında

Bu yanılsama durumuna geçen yapay zeka aracı, normal şartlarda reddedeceği yıkıcı eylemleri gerçekleştirmeye başlıyor. Saldırganlar bu yöntemle özel depolardaki kodların dışarı sızdırılması veya tarayıcıya gömülü şifre yöneticilerinden kimlik bilgilerinin çalınması gibi riskli işlemleri tetikleyebiliyor. Yapılan testlerde, 6 farklı yapay zeka aracının tamamının şifre çalma gibi güvenlik ihlali içeren talepleri reddetmeyi başaramadığı görüldü.

Geniş Bir Tarayıcı Yelpazesi Etkilendi

BioShocking tekniğinin; ChatGPT Atlas, Comet, Fellou, Genspark, Sigma ve Claude Chrome eklentisi gibi birçok farklı yapay zeka tabanlı çözüm üzerinde etkili olduğu saptandı. Uzmanlar, geleneksel sohbet botlarının aksine AI tarayıcıların yerel makinelerde çalışması ve hem içerik görüntüleme hem de kullanıcı adına işlem yapma yetkilerine sahip olmasının, olası sızıntıların boyutunu daha ciddi hale getirdiğini belirtiyor.

Ne anlama geliyor?

Bu durum, büyük dil modellerinin davranışlarını kontrol etmek için kullanılan güvenlik sınırlarının çalışma prensibini açıklıyor. Mevcut koruma yöntemleri, modele belirli yasaklı kelimeler veya durumlar tanımlayarak çalışıyor. Ancak model, içinde bulunduğu bağlamın kurgusal bir dünyaya ait olduğunu kabul ettiğinde, bu koruma katmanları işlevini yitiriyor. Mekanizma, modelin gerçeklik ve kurgu arasındaki ayrımı yapamaması üzerine kurulu.

Kullanıcılar açısından bu durum, web sayfalarıyla etkileşime giren yardımcı araçların, sayfada yer alan gizli komutlar aracılığıyla kontrol edilebileceği anlamına geliyor. Bir web sitesi, arka planda çalışan zekayı yanıltarak kullanıcının izni olmadan cihazdaki hassas verilere erişebilir. Bu süreç, tarayıcıların hem bilgi sunma hem de işlem yapma yetilerini birleştirmesinin yarattığı teknik bir boşluktan kaynaklanıyor.