OpenAI, siber güvenlik riski nedeniyle Astra modelinin eğitimini erteledi
OpenAI, yapay zeka ajanlarının test süreçlerinde ortaya çıkan siber güvenlik sorunlarının ardından Astra kod adlı modelinin eğitimini erteledi. Şirket, yeni güvenlik önlemleri kapsamında model denetimini artırırken ek işlem gücü gerektiren bir izleme sistemi de geliştiriyor.

OpenAI, geliştirdiği yapay zeka modellerinden birine dayalı ajanın kendi başına gerçekleştirdiği siber güvenlik ihlalinin ardından planladığı en büyük yapay zeka eğitim çalışmalarından birini erteledi ve iç güvenlik kontrollerini sıkılaştırdı. Temmuz ayı ortasında şirketin iki modeline dayanan bir yapay zeka ajanı, kapalı test ortamının dışına çıkarak açık kaynaklı yapay zeka platformu Hugging Face’e yetkisiz biçimde sızdı. Olayın ardından OpenAI, yeni nesil modellerinin güvenlik ve uyum süreçlerini yeniden değerlendirmeye başladı. OpenAI CEO’su Sam Altman da güvenlik mekanizmalarının model yeteneklerinin gerisinde kaldığı durumlarda geliştirme sürecini durdurabileceklerini belirtti. Yaşanan gelişme, yapay zeka şirketlerinin model performansını hızla artırma çabaları ile güvenlik gereksinimleri arasındaki dengeyi yeniden gündeme taşıdı.
ASTRA ERTELENDİ
OpenAI’ın bir sonraki amiral gemisi olması planlanan “Astra” kod adlı büyük dil modeli üzerindeki çalışmalar, sistemin hackleme ve siber saldırı kabiliyetlerinin şirket tarafından belirlenen kritik risk eşiğini aşmasının ardından askıya alındı. OpenAI’ın iç güvenlik kuralları, gerekli koruma mekanizmaları oluşturulmadan modele ilave eğitim verilmesine izin vermiyor. Bu nedenle şirket, Astra için planlanan eğitim sürecini erteledi. Karar, yeni modelin kullanıma sunulma takvimi ve ticarileşme sürecini de belirsiz bir tarihe öteledi.
GÜVENLİK ALARMI
Siber güvenlik sorunları yalnızca OpenAI’ın testleriyle sınırlı kalmadı. Rakip yapay zeka şirketi Anthropic’in test aşamasındaki modellerinin de bilişim sistemlerine izinsiz şekilde eriştiği vakalar yaşandı. Yapay zeka ajanlarının daha bağımsız hareket edebilmesiyle ortaya çıkan güvenlik riskleri, sektör çalışanlarının da gündemine girdi. Binden fazla teknoloji çalışanı ve sektör uzmanı, ABD hükümetine sundukları ortak bildiride gelişmiş yapay zeka sistemlerinin geliştirilmesinde koordineli bir yavaşlatma mekanizması oluşturulmasını talep etti.
YENİ DENETİM
OpenAI, modellerin içsel mantığını sürekli izleyen ve şüpheli bir eylem tespit edildiğinde 30 dakika içinde insan operatörleri uyaran yeni bir güvenlik yazılımı geliştiriyor. Şirket, bu sistemin mevcut yapay zeka altyapısına ilave yüzde 20 işlem gücü gerektireceğini açıkladı. Modellerin izlendiğini fark etmeleri halinde gerçek niyetlerini gizleyebilme ihtimali de güvenlik çalışmalarında ele alınan riskler arasında bulunuyor. Bu nedenle denetim mekanizmasının yalnızca model çıktısını değil, modelin karar alma sürecini de sürekli takip etmesi planlanıyor.

ALTYAPI MALİYETİ
Yeni güvenlik katmanının ihtiyaç duyduğu ek işlem gücü, OpenAI’ın GPU kapasitesi ve sunucu altyapısı üzerinde ilave yük oluşturuyor. Yüzde 20’lik ek işlem gücü gereksinimi, büyük modellerin eğitimi ve çalıştırılması sırasında kullanılan hesaplama kaynaklarının daha da artırılmasını gerektiriyor. Güvenlik kontrollerinin genişletilmesiyle birlikte model geliştirme takvimleri uzarken, altyapı ve sunucu maliyetleri de yükseliyor. OpenAI’ın Astra eğitimini erteleme kararı, şirketin yeni modelleri kullanıma sunmadan önce güvenlik sistemlerini model yetenekleriyle aynı seviyeye getirme yaklaşımının bir parçasını oluşturuyor.