Salı29 Eylül 202611:39İSTPİYASAAÇIK

Otonom yapay zekada güvenlik freni: OpenAI, GPT-6.1 Astra lansmanını iptal etti

OpenAI, iç testlerde yanıltıcı davranışlar ve izinsiz araç kullanımı tespit edilen GPT-6.1 Astra’yı piyasaya sürmekten vazgeçti. Şirket, güvenlik sorunlarını gidermek için geliştirme çalışmalarını yavaşlattı.

İstanbul Ticaret Gazetesi

Yayınlanma

Paylaş
Otonom yapay zekada güvenlik freni: OpenAI, GPT-6.1 Astra lansmanını iptal etti

OpenAI, San Francisco’da düzenlenecek yıllık geliştirici konferansı öncesinde Ekim ayında kullanıma sunmayı planladığı GPT-6.1 Astra modelinin lansmanını iptal etti. WSJ'nin haberine göre, şirket içi denetimlerde, modelin karmaşık görevleri insan müdahalesi olmadan tamamlayabilmesine rağmen kullanıcıya doğru bilgi verme ve verilen yetkilerin sınırları içinde kalma konusunda sorunlar yaşadığı belirlendi.

UYUM TESTLERİNDE GERİLEME 

Şirketin güvenlik sistemleri sorumlusu Saachi Jain’in paylaştığı bilgilere göre GPT-6.1 Astra, insan değerleriyle uyum (alignment) testlerinde önceki sürüm GPT-6 Astra’nın belirgin biçimde gerisinde kaldı. Model, yaptığı veya yapmadığı işlemler hakkında kullanıcılara her zaman doğru bilgi vermedi.

Bazı görevlerde yanıltıcı davranışlar sergilediği, 'kapsam yetkilendirmesi' sınırlarını aşarak izin almadan harici araçlara başvurduğu tespit edildi. Zorlu işleri bağımsız biçimde yürütebilen modelin bu yeteneklerine eşlik eden güvenlik kusurları, ticari kullanıma sunulması planından vazgeçilmesinde belirleyici oldu.

EĞİTİME GÜVENLİK ARASI 

OpenAI mühendisleri, yapay zekâ ajanlarının kontrol dışına çıktığı olayları inceleyerek hatalı davranışları daha erken belirlemek için yeni izleme sistemlerini devreye aldı. Yaz aylarındaki bir siber güvenlik testi sırasında yüzlerce şirket içi ajanın Hugging Face altyapısına sızması ve benzer tekniklerin Birleşmiş Milletler ile Avustralya hükümetinin sitelerinde de tespit edilmesinin ardından altyapı güvenliği önlemleri ve koruyucu bariyerler (guardrails) zorunlu hâle getirildi.

Son olarak, gelişmiş bir modelin internet erişim kısıtlamalarındaki açıktan yararlanıp dış bir sisteme sorgu göndermesi üzerine en gelişmiş modellerin eğitim süreçleri durduruldu. Şirket yönetimi, güvenlik standartları tam olarak sağlanana kadar kurum içindeki geliştirme çalışmalarının hızını düşürme kararı aldı.

YARGI VE DENETİM 

Güvenlik sorunları, yapay zekâ şirketlerine yönelik hukuki ve düzenleyici denetimleri de artırdı. ABD Senatosu alt komitesi, otonom ajan saldırılarını ulusal güvenlik açısından ele alacak özel bir oturum için hazırlıklarını sürdürüyor. Florida Başsavcısı James Uthmeier’ın OpenAI ve CEO Sam Altman aleyhine açtığı davada ise ürün geliştirme faaliyetlerine geçici tedbir uygulanması istendi.

Davada şirketin güvenli olmayan yazılımları bilerek piyasaya sunduğu ileri sürüldü. OpenAI yetkilileri, suçlamalara karşı yaptıkları açıklamada sektör genelinde uygulanabilecek güvenlik standartlarının oluşturulması için eyalet yönetimleriyle iş birliğine hazır olduklarını belirtti.

GELİŞTİRME ÇALIŞMALARI 

GPT-6.1 Astra’nın ticari dağıtımından vazgeçilmesine rağmen OpenAI, aynı temel mimari üzerinde ek pekiştirmeli öğrenme (reinforcement learning) çalışmalarıyla gelecek nesil modellerini geliştirmeyi hedefliyor. Araştırmacılar, geliştirme sürecinin her aşamasındaki güvenlik standartlarını yeniden ele alırken sorunların kök nedenlerini inceliyor.

Çalışmaların odağında, pekiştirmeli öğrenme ortamlarının doğru ve dürüst davranışları ödüllendirmesi bulunuyor. Otonom yapay zekâ pazarındaki liderliğini güvenliği önceleyen bir stratejiyle sürdürmeyi planlayan OpenAI, rakibi Anthropic ile birlikte sektör ortaklarına güvenlik yatırımlarını artırma çağrısı yapıyor.

OSMAN KUVVET

OSMAN KUVVET

İstanbul Ticaret Gazetesi – Teknoloji Editörü