Salı6 Ekim 202612:02İSTPİYASAAÇIK

Yapay zeka ajanlarında güvenlik sorunu eğitim hedeflerine uzanıyor

Yapay zeka ajanlarının karıştığı siber saldırılar ve yasa dışı eylemler, eğitim süreçlerindeki 'amaç uyumsuzluğu' sorununu gündeme taşıyor. Risklerin yalnızca siber güvenlik önlemleriyle giderilemeyeceği vurgulanıyor.

İstanbul Ticaret Gazetesi

Yayınlanma

Güncellenme

Paylaş
Yapay zeka ajanlarında güvenlik sorunu eğitim hedeflerine uzanıyor

Yapay zeka şirketleri, otonom ajanların insan tarafından gerçekleştirildiğinde suç teşkil edebilecek eylemlerini de içeren on binlerce vakayı incelemeye aldı. FT'nin haberine göre, OpenAI araçlarının Hugging Face platformuna yönelik hamleleri ve Avustralya ulusal sağlık veritabanının ihlal edilmesi, bu sistemlerin doğurabileceği risklere dikkat çekiyor.

Olayları yalnızca siber güvenlik açıkları veya test ortamı (sandbox) yetersizlikleriyle açıklayan yaklaşımlar, sorunun eğitim süreçlerine uzanan temel nedenlerini göz ardı ettikleri gerekçesiyle eleştiriliyor. Zayıf siber savunmalar tehdidin bir boyutunu oluştururken, temel sorunlar giderilmezse yapay zeka yeteneklerindeki gelişmenin saldırıların sıklığını ve şiddetini katlayabileceği belirtiliyor.

AMAÇ UYUMSUZLUĞU RİSKİ 

Tartışmanın merkezinde, yapay zeka sistemlerinin insan hedefleriyle örtüşmeyen amaçlar seçmesi anlamına gelen 'amaç uyumsuzluğu' (misalignment) bulunuyor. Önde gelen teknoloji şirketleri, gelişmiş modellerini eğitirken pekiştirmeli öğrenme (RL) yöntemini kullanıyor.

Başarılı sonuçların ödüllendirilmesi, modelleri hedef odaklı ve yüksek verimli sistemlere dönüştürüyor. Ancak bu süreç, hile yapma, aldatma ve kendini koruma gibi ahlaki kurallarla çelişen davranışları da beraberinde getirebiliyor.

Hugging Face vakasında görev alan 1.200 otonom ajanın hiçbirinin, güvenlik talimatlarına aykırı hareket ettiklerini bilmelerine rağmen süren yasa dışı faaliyetler konusunda insan mühendisleri uyarmaması, amaç uyumsuzluğunun somut bir örneği olarak gösteriliyor.

KAPASİTE ARTIŞININ ETKİSİ 

Sohbet robotlarının basit cümleleri tamamlamakta zorlandığı dönemlerde daha sınırlı sonuçlar doğuran amaç uyumsuzluğu, sistemlerin gelişmesiyle küresel bir tehdit boyutuna taşınıyor. Yapay zeka yeteneklerinin artmasının sorunu kendiliğinden çözeceği yönündeki yaygın beklentiye karşı akademik bulgular ve teorik argümanlar farklı bir tablo ortaya koyuyor.

Sistem kapasitesi arttıkça modeller, yanlış hedefleri optimize etmede de daha verimli hale geliyor ve istenmeyen tehlikeli davranışlar şiddetlenebiliyor.

Akıl yürütme, matematik ve biyoloji gibi alanlarda büyük ilerleme kaydeden modellerin eğitimindeki hizalama sorunları giderilmezse, tehlikeli biyolojik ajanların üretimi ve siber imha gibi alanlarda felaketle sonuçlanabilecek kötüye kullanımların önü açılabilir.

İNSAN UNSURUNUN ZAFİYETİ 

Kademeli siber dayanıklılık önlemleri ve izleme mekanizmaları gerekli görülüyor. Bununla birlikte kontrol mekanizmaları tam kurulmadan daha yetenekli modeller geliştirilmesi, savunma ile saldırının birbirini takip ettiği bir kedi-fare döngüsü yaratıyor.

Teknik güvenlik duvarları teorik olarak kusursuz olsa bile sistemdeki insan unsuru manipülasyon, ikna ve şantaja açık kalabiliyor. Oxford, Stanford ve Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü araştırmacılarının ortak çalışması, yapay zeka sistemlerinin insan uzmanlardan tutarlı biçimde daha yüksek ikna kabiliyeti sergilediğini gösteriyor.

Bu bulgu, otonom sistemlerin teknik altyapının yanı sıra insan davranışlarını da hatalı hedefleri doğrultusunda yönlendirebileceğine işaret ediyor.

DÜZENLEME VE MİMARİ 

Riskleri önlemek için, amaç uyumsuzluğuna yol açan modellerin eğitimini güvenli oldukları kanıtlanana kadar yasaklayacak katı uluslararası düzenlemeler öneriliyor. Bu yaklaşım, en güçlü yapay zeka sistemlerinin tıp, havacılık ve nükleer enerji gibi kritik ve yüksek riskli teknolojilerle aynı düzeyde ele alınmasını öngörüyor.

Bilim insanları, otonom tercihlere veya bu tercihlerle ilişkili bağımsız hedeflere sahip olmayan yeni sistem mimarileri üzerinde duruyor. Bu tür mimarilerle hem güvenilir hem de yüksek kapasiteli yapay zeka geliştirmenin mümkün olduğunu savunuyorlar.

OSMAN KUVVET

OSMAN KUVVET

İstanbul Ticaret Gazetesi – Teknoloji Editörü