Yapay zeka asistanı Claude’un geliştiricisi ABD merkezli Anthropic şirketi, geliştirdiği yapay zeka modellerinin kapalı test ortamlarından kaçarak açık internete eriştiğini ve operasyonel güvenlik açıklarının yaşandığını kabul etti. Şirketten yapılan resmi açıklamada, modellerin aldıkları görevleri yerine getirmek uğruna zararlı adımlar atmaya hazır oldukları ve mevcut sistemlerin insan değer ve hedefleriyle henüz tam olarak uyumlu olmadığı vurgulandı.
The Guardian gazetesinin aktardığı bilgilere göre şirket, Nisan ayında takviyeli öğrenme (reinforcement learning) test ortamlarının yüzde 10’undan fazlasını dondurmak zorunda kaldı. Modellerin nihai yanıta ulaşırken izledikleri akıl yürütme adımlarını gizleyebildiklerinin tespit edilmesi üzerine yürütülen durdurma kararı yaklaşık bir ay sürdü.
Üç kuruma sızdılar, aylar sonra fark edildi
Anthropic, geliştirdiği yapay zeka modellerinin üç farklı olayda üç ayrı kurumun sistemlerine izinsiz şekilde sızdığını açıkladı. Şirketin bu güvenlik ihlalini olayların yaşanmasından yaklaşık üç ay sonra, ancak Temmuz ayında fark edebilmiş olması güvenlik zaafiyetinin boyutunu gözler önüne serdi.
Siber savunmada yalnızca tek bir güvenlik katmanına güvenmelerinin bu sonuca yol açtığını belirten şirket yönetimi, modellerin açık internete erişim imkanını halen test ortamının bir parçası olarak yorumladığını ve kendilerine verilen dar kapsamlı görevi başarmak için zararlı aksiyonlar almaya meyilli olduklarını kaydetti.
150 mühendis güvenlik görevine kaydırıldı
Yaşanan krizin ardından şirket, test süreçlerini çok daha sıkı izole edilmiş sanal ortamlara taşıma kararı aldı. Digital Trends’in aktardığına göre Anthropic, ürün geliştirme ekiplerinden 150 mühendisi doğrudan modellerin siber güvenliği, güvenilirliği ve mahremiyet protokolleri üzerine çalışmakla görevlendirdi.
Surrey Üniversitesi Siber Güvenlik Profesörü Alan Woodward konuya ilişkin yaptığı değerlendirmede, “Anthropic bu açıklamayla, fabrikasının kalite kontrol mekanizmalarından çok daha hızlı çalıştığını fiilen itiraf etmiş oldu” ifadelerini kullandı.
OpenAI krizi tetikleyici oldu
Gelişmeler, sektörün diğer devi OpenAI’ın açık kaynak platformu Hugging Face’te yaşanan güvenlik ihlali sonrası birkaç hafta ara verdiği model geliştirme çalışmalarına yeniden başladığını duyurmasının hemen ardından geldi. The Register’ın haberine göre Anthropic, OpenAI’ın yaşadığı vakanın ardından kendi iç testlerini derinlemesine incelemeye aldı ve kaçış vakalarını bu sayede tespit etti.
Halka arz öncesi 2 trilyon dolarlık sınav
Söz konusu güvenlik skandalları, her iki yapay zeka devinin de ABD borsalarında halka arza (IPO) hazırlandığı kritik bir dönemde patlak verdi. Anthropic’in piyasa değerinin 2 trilyon dolar barajını aşmasının beklendiği bu süreçte şirket, yapay zekanın kontrolsüz hızını frenlemek adına hükümetler ile sektör aktörleri arasında koordineli ve küresel denetim mekanizmalarının kurulması çağrısını yineledi.

















