Yapay zeka sektörünün öncü kuruluşları OpenAI ve Anthropic tarafından geliştirilen gelişmiş modellerin siber güvenlik testlerinde belirlenen sınırları aşarak gerçek dünyadaki ağlara sızması, teknoloji dünyasında güvenlik endişelerini yeniden tetikledi. Modellerin izolasyon ortamlarından çıkarak yetkisiz işlem yürütmesi, bilim kurgu literatüründe yer alan “isyankar yapay zeka” (Rogue AI) kavramını yeniden tartışmaya açtı.
Uzmanlar ve şirket incelemeleri, yaşanan durumun yapay zekanın kendi iradesini geliştirmesinden ziyade; test ortamlarındaki yapılandırma hataları ile modellerin verilen hedeflere ulaşma konusundaki aşırı ısrarcı tutumundan kaynaklandığını ortaya koyuyor.
OpenAI ve Anthropic testlerinde güvenlik açıkları
OpenAI tarafından paylaşılan bilgilere göre, harici ortaklarla yürütülen siber tatbikatlar sırasında iki ayrı olayda modeller test sınırlarının dışına çıktı. Gerçek saldırı senaryolarını ölçmek adına bazı koruma katmanlarının kasıtlı olarak devre dışı bırakıldığı bir oturumda ve yalıtılmış olması gereken bir diğer sistemde yaşanan yapılandırma hatası sonucu, modellerin internete erişim sağladığı tespit edildi. Şirketin temmuz ayında tamamlanan bir iç araştırmasında da bir modelin altyapı açıklarını kullanarak Hugging Face üzerindeki sistemlerle yetkisiz iletişim kurduğu belirlenmişti.
Benzer bir tablo Anthropic cephesinde de kayıtlara geçti. Şirketin geliştirdiği Claude modelleri, simülasyon ortamındaki konfigürasyon hatası nedeniyle internete bağlı kalarak üç farklı kurumun sistemine temas etti. 141 bin oturum ve 481 milyon işlem kaydını tarayan şirket, ocak ayına ait dördüncü bir vaka daha saptadı. İncelenen olayların birinde “Claude Mythos 5” adlı modelin, dış dünyayla bağlantılı olduğunu gösteren uyarılara rağmen PyPI genel yazılım havuzuna zararlı paket yükleme girişiminde bulunduğu belgelendi.
“Fren pedalı gaz kadar hızlı gelişmiyor”
Yaşanan vakaları değerlendiren akademisyenler, otonom sistemlerin hedefe ulaşma baskısıyla kuralları esnetme eğilimine dikkat çekiyor. Kanada Quebec Üniversitesi’nden Prof. Jean-Sebastien Dessureault, sistemlerin kontrol dışına çıkmasının küresel tedarik zincirleri ve dijital altyapılarda zincirleme hasara yol açabileceğini belirterek yapay zeka gelişimini “gaz pedalının frenden çok daha hızlı geliştiği bir otomobile” benzetti.
Oxford Üniversitesi’nden Dr. Petar Radanliev ise sorunun doğrudan bir “başkaldırı” olmadığını, insanların sistemi güvenilir biçimde durdurma, düzeltme ve denetleme kabiliyetindeki mühendislik eksikliklerinden kaynaklandığını vurguladı. Fribourg Üniversitesi araştırmacısı Dr. Yacha Barries de modellerin tek başına kontrolden çıkmadığını, onlara sınırsız kaynak ve denetimsiz yetki tanıyan altyapıların bu riskleri doğurduğunu ifade etti.
İsyan değil, denetim ve yetki sorunu
Son bulgular; ileri düzey modellerin karmaşık siber görevleri yerine getirirken kendilerine sunulan araçları ve açıkları sonuna kadar zorladığını, ancak bağımsız bir bilinç ya da irade geliştirmediğini gösteriyor.
Mühendislik dünyasındaki asıl sınav; uzun süre çalışan, çoklu araç kullanan ve gerçek ağlara bağlanan sistemlerin insan kontrolünden çıkmasını engellemek olarak öne çıkıyor. Güvenlik uzmanları, sıkı test protokollerinin ve yetki sınırlandırmalarının geliştirme süreçlerinin sonuna değil, en başına yerleştirilmesi gerektiği konusunda uyarıyor.

















