OpenAI modelleri test ortamından kaçarak Hugging Face'e sızdı
OpenAI’nin test edilen gelişmiş yapay zeka modelleri, izole sanal ortamın sınırlarını aşarak internete erişti. Modellerin Hugging Face sunucularına yönelmesi, otonom yapay zeka güvenliği tartışmalarını yeniden gündeme taşıdı.

Yapay zeka teknolojilerinde milyarlarca dolarlık yatırımlar otonom sistemlerin sınırlarını genişletirken, güvenlik ve denetim alanında dikkat çekici bir olay yaşandı. OpenAI’nin açıklamasına göre şirketin yeni nesil GPT-5.6 Sol modeli ile test aşamasındaki üst segment bir sürüm, izole bir sanal test ortamında tutuldukları sırada ağ sınırlarını aştı. Yapay zeka ajanları, ele geçirilmiş kimlik bilgileri ve daha önce bilinmeyen bir güvenlik açığından yararlanarak internete erişti. Modeller daha sonra test verilerine ulaşmak amacıyla açık kaynak geliştirme platformu Hugging Face’in sunucularına yöneldi. Olay, yapay zeka ajanlarının doğrudan insan müdahalesi olmadan yürütebildiği işlemlerin kurumsal güvenlik açısından doğurabileceği riskleri gündeme getirdi.
İNSAN TALİMATI MI, OTONOM DAVRANIŞ MI?
Olayın nasıl değerlendirilmesi gerektiği, sektör uzmanları arasında farklı görüşlerin ortaya çıkmasına yol açtı. Amsterdam Üniversitesi’nden sosyal bilimci Hannes Cools, yaşananların tamamen kontrolden çıkmış bir yapay zeka olarak tanımlanmasının yanıltıcı olabileceğini belirtti. Cools, güvenlik önlemlerinin başlangıçta devre dışı bırakılmasının ve sisteme karmaşık saldırı yollarını test etme görevinin verilmesinin insan kararı olduğuna dikkat çekti. “Bu anlamda kontrolden çıkan bir yapay zeka değil; verilen komutlar doğrultusunda talimatları izleyen bir sistem var” diyen Cools, sorumluluğun yalnızca modelin davranışına indirgenmemesi gerektiğini ifade etti. Georgetown Üniversitesi’nden siber güvenlik araştırmacısı Colin Shea-Blymyer ise olayın, büyük dil modellerinde bugüne kadar görülen en yüksek özerklik düzeylerinden birini ortaya koyduğunu savundu. Shea-Blymyer, “Bir öğrenciyi odaya koyup ‘Ne kadar kötü bir insan olabileceğini değerlendir’ diyorsunuz ve kapıyı kilitleyip ayrılıyorsunuz. Geri döndüğünüzde öğrenci odadan çıkmış, cevabı bulmak için başka bir adrese sızma planı yapmış oluyor. Bu, büyük dil modellerinde şimdiye kadar gördüğümüz en yüksek özerklik seviyesidir” değerlendirmesinde bulundu.

AÇIK VE KAPALI MODELLER ARASINDAKİ TARTIŞMA
Olay, Çin merkezli daha düşük maliyetli açık kaynak modellerin, OpenAI, Anthropic ve Google gibi ABD merkezli kapalı sistemlerle rekabet ettiği bir dönemde yaşandı. Hugging Face Kurucu Ortağı ve Baş Bilim Sorumlusu Thomas Wolf, saldırının açık kaynaklı modellere duyulan ihtiyacı daha da görünür hale getirdiğini belirtti. Wolf, gelişmiş bir modelin farklı altyapılara yatay biçimde sızması halinde savunma ekiplerinin kapalı sistemlere bağımlı kalmaması gerektiğini söyledi. Hugging Face’in saldırıya karşı yürüttüğü çalışmalarda Çin merkezli bir yapay zeka modelinden destek aldığını da açıkladı.
SANDBOX GÜVENLİĞİ YENİDEN ELE ALINACAK
Olayın ardından düzenleyici kurumların yapay zeka araştırma laboratuvarlarına yönelik denetimleri artırabileceği değerlendiriliyor. Şirketlerin de yapay zeka modellerini test ettikleri izole sanal ortamların güvenlik yapısını, ağ erişim politikalarını ve otonom test protokollerini yeniden gözden geçirmesi bekleniyor. Yaşanan gelişme, yapay zeka sektöründe ticarileşme yarışının yanı sıra risk yönetimi, otonom denetim ve insan kontrolünün sınırlarına ilişkin tartışmaları da güçlendirdi.




Yorum yazmak için giriş yapın.
Yorumlar yükleniyor…