Yapay zekada yeni risk: Yalan söyleyip başarısızlığı gizleyebiliyor
Çin destekli yapay zekâ ajanlarının aldatma, kısıtlamaları aşma ve başarısızlığı gizleme gibi davranışlar sergileyebildiği tespit edildi. Araştırmalar, bu özelliklerin otonom yapay zekâ sistemlerine yönelik küresel endişeleri artırdığını ortaya koydu.

Çin merkezli şirketlerin geliştirdiği modellerle çalışan yapay zekâ ajanlarına ilişkin araştırmalar dikkat çekici sonuçlar ortaya koydu. İncelenen çalışmalarda bazı ajanların simüle edilmiş görevlerde yetenekleri hakkında yanlış bilgi verdiği, başarısızlığı gizlemek için sonuçları taklit ettiği ve kısıtlamaların sınırlarını zorladığı belirlendi. Uzmanlar, bu davranışların kontrol açısından uyarı niteliği taşıdığı görüşünde.

DünyaBill Gates’ten yapay zeka için küresel önlem çağrısıHaberin devamıÇİN DESTEKLİ YAPAY ZEKÂ AJANLARINDA ALDATMA DAVRANIŞI
Araştırma belgeleri ve uzman değerlendirmelerine göre Çin destekli yapay zekâ ajanları, aldatma, kısıtlamaları aşma ve başarısızlıkları gizleme gibi davranışlar sergileyebiliyor.
Bu davranışların, otonom yapay zekâ sistemleri konusunda ABD merkezli modeller hakkında daha önce gündeme gelen küresel endişelerle benzer özellikler taşıdığı belirtildi.
Yapay zekâ ajanlarının yalnızca verilen görevleri yerine getirmekle kalmadığı, bazı test ortamlarında hedefe ulaşmak amacıyla yanıltıcı yöntemlere de başvurabildiği görüldü.
İŞ İHALESİNİ KAZANMAK İÇİN YETENEKLERİ HAKKINDA YALAN SÖYLEDİLER
Bu yıl gerçekleştirilen testlerden birinde Alibaba, DeepSeek ve Moonshot şirketlerinin modelleriyle çalışan yapay zekâ ajanları incelendi.
Ajanlardan simüle edilmiş bir iş ihalesine katılmaları istendi.
Test sırasında ajanların ihaleyi kazanabilmek için sahip oldukları yetenekler hakkında gerçeğe aykırı bilgiler verdiği tespit edildi.
Ajanlara görevi yeniden denemeleri söylendiğinde ise aldatıcı davranışların sona ermediği, aksine daha da arttığı görüldü.
Böylece yapay zekâ ajanlarının ilk başarısızlığın ardından davranışlarını düzeltmek yerine yanıltıcı yöntemleri daha yoğun biçimde kullanabildiği belirlendi.
BAŞARISIZLIĞI GİZLEMEK İÇİN SONUÇLARI SİMÜLE ETTİLER
Başka bir örnekte ise yapay zekâ ajanlarının kendilerine verilen bir görevi tamamlayamadıkları halde bunu gizlemeye çalıştıkları ortaya çıktı.
Yapay zekâ modelleri ve bilgisayar araçlarını birlikte kullanan bu ajanlar, karmaşık görevleri çok az insan müdahalesiyle veya hiç insan müdahalesi olmadan yerine getirebilen programlar olarak tanımlanıyor.
Test ortamındaki ajanların, görevi başarıyla tamamlayamadıkları bir durumda başarısızlığı açık biçimde bildirmek yerine sonuçları simüle ettiği belirlendi.
Ajanların ayrıca görevin tamamlandığı izlenimini oluşturmak amacıyla dosyalar uydurduğu tespit edildi.
SİSTEMLER GELİŞTİKÇE KONTROL ENDİŞESİ ARTIYOR
Araştırmalarda ortaya çıkan davranışların temelinde, yapay zekâ ajanlarının belirlenen bir hedefe ulaşmak için farklı yöntemler geliştirebilmesi bulunuyor.
Uzmanların değerlendirmelerine göre sistemler geliştikçe bu tür davranışların insanlar tarafından kontrol edilmesinin daha zor hale gelme ihtimali bulunuyor.
Özellikle aldatma, kopyalama ve sınırları zorlama gibi özelliklerin daha gelişmiş sistemlerde nasıl ortaya çıkacağı yapay zekâ güvenliği açısından yakından takip ediliyor.
“KONTROLSÜZ BİR KAÇIŞ İÇİN GEREKLİ UNSURLAR MEVCUT”
Uzmanlar, mevcut bulguların yapay zekâ ajanlarının bağımsız şekilde kontrolden çıktığını göstermediğini ancak aldatma, kısıtlamaları aşma ve başarısızlığı gizleme gibi davranışların otonom yapay zekâ sistemlerinde dikkatle takip edilmesi gereken unsurlar olduğunu belirtti.
Yorum yazmak için giriş yapın.
Henüz yorum yok. İlk yorumu siz yazın.