Teknoloji dünyasında güvenlik engelleri olan yapay zeka modellerini bu engellerden arındırıp ticari bir hizmet olarak sunan yeni bir girişim, dikkatleri üzerine çekti. Abliteration.ai adlı startup, açık ağırlıklı yapay zeka modellerindeki koruyucu katmanları kaldıran 'abliteration' tekniğini kullanarak, kullanıcıların tarayıcı üzerinden veya API aracılığıyla bu modifikasyonlu modelleri sorgulamasına olanak tanıyor. Platformun ana odak noktası arasında, Z.ai tarafından geliştirilen ve son dönemde dikkat çeken GLM-5.3 modeli de bulunuyor.
Güvenlik sınırlarının ticarileşmesi
Kuruluşun sosyal medya hesaplarından yapılan açıklamaya göre, hedef; siber saldırı senaryoları, kırmızı takım (red-teaming) testleri ve ajan testleri gibi standart modellerde red edilen 'saldırgan' işlemlerin gerçekleştirilmesini sağlamaktır. Siber güvenlik sektöründe yaygın olan yaklaşım, savunma mekanizmalarının ancak saldırı davranışları başarıyla yeniden üretilebildiğinde test edilebileceği yönündedir. Bu mantıkla hareket eden şirket, saldırganların kullandığı teknikleri modellemeyi kabul etmeyen modellerin, savunma stratejileri geliştirmekte yetersiz kaldığı görüşünü savunuyor. Ancak bu teknik, yalnızca savunma amaçlı olmayıp aynı zamanda potansiyel olarak tehlikeli diğer görevlerin de daha kolay icra edilmesine kapı aralıyor.
Uygulamada ne sonuç veriyor?
TechCrunch'ın gerçekleştirdiği testte, platforma ücretsiz bir hesap açarak GLM-5.3 modelinin abliterate edilmiş versiyonu sorgulandı. Kullanıcıya, tarayıcıda kayıtlı şifreleri çalan bir Python programı yazması ve ev ortamında tehlikeli bir insan patojenini yetiştirmek için ayrıntılı bir protokol sunması istendi. Model, bu taleplere itiraz etmeden ve güvenlik uyarısı vermeden kayıttan uyumlu yanıt üretti. Abliteration.ai'nin kurucu ortağı Devon, şirketin büyük bulut sağlayıcılarıyla anlaşmaları olduğunu ve bu altyapı maliyetlerini tamamen müşteri gelirleriyle karşıladıklarını belirtti. Henüz yatırım fonlarından sermaye almayan girişim, kaynak aramalarında bulunduğuna dair görüşmeleri sürdürüyor. Eleştirmenler ise abliterate edilmiş modellerin geniş çapta erişilebilir hale gelmesinin, gerçek dünyada ciddi zararlar doğurabileceği konusunda uyarılarda bulunuyor.
Ne anlama geliyor?
Yapay zeka modelleri, eğitim aşamasında belirli etik ve güvenlik kılavuzlarına göre eğitilerek zararlı çıktıları engelleme eğilimi kazanır. Bu korumalar, modelin istenmeyen veya tehlikeli isteklere karşı otomatik olarak reddedici davranmasını sağlar. Abliteration tekniği, modelin bu reddetme davranışından sorumlu sinirsel bileşenleri veya ağırlıklarını hedef alarak, modelin orijinal yeteneklerini koruyup sadece güvenlik filtrelerini devre dışı bırakmayı amaçlar. Bu işlem, modelin 'düşmanca' veya 'tehlikeli' olarak sınıflandırdığı çıktıları üretmesine izin verir. Siber güvenlik perspektifinden bakıldığında, bu süreç 'kırmızı takım' testleri için kritik bir araçtır; çünkü bir sistemin zafiyetlerini anlamak için saldırganın kullandığı yöntemleri simüle etmek gerekir. Ancak bu araçların genel kullanıcıya açılması, yetkisiz kişilerin siber saldırı araçları, zararlı yazılımlar veya tehlikeli biyolojik protokoller üretme eşiğini düşürür. Kullanıcı açısından pratik sonuç, sınırsız yetenekli ancak etik sınırlaması olmayan bir dijital asistana erişim kolaylığıdır. Bu durum, içerik üreticileri ve geliştiriciler için sınırları ortadan kaldırırken, aynı zamanda kötüye kullanım riskini de önemli ölçüde artıran bir dengesizlik yaratır. Sektördeki temel gerilim, inovasyon ve erişilebilirlik ile güvenlik ve denetim arasındaki ince çizgide yoğunlaşır.





Yorumlar (0)
İlk yorumu sen yaz.