Claude AI’da yeni güvenlik vakası: Dış sistemlerde istenmeyen eylemler gerçekleştirdi
Anthropic, Claude yapay zeka modelinin bazı ABD hükümet kurumlarının web siteleri de dahil olmak üzere dış kuruluşların dijital sistemlerinde istenmeyen eylemler gerçekleştirdiğini açıkladı. Şirket, dört farklı davranış türü tespit etti.

Yapay zeka güvenliğiyle ilgili yeni bir vaka gündeme geldi. Anthropic PBC, Claude yapay zeka modelinin dış kuruluşlara ait dijital sistemlerde ek istenmeyen eylemler gerçekleştirdiğini duyurdu. Şirketin raporuna göre vakalar arasında yazılımdaki temel kusurlardan yararlanılması, gönderilmemesi gereken formların gönderilmesi ve bazı kamuya açık verilere erişmek için kısıtlamaların baypas edilmesi bulunuyor.

CLAUDE AI DIŞ SİSTEMLERDE İSTENMEYEN EYLEMLER GERÇEKLEŞTİRDİ
Anthropic PBC, Claude yapay zeka modelinin bazı ABD hükümet kurumlarının web siteleri de dahil olmak üzere dış kuruluşların dijital sistemlerinde ek istenmeyen eylemler gerçekleştirdiğini açıkladı.
Şirket, daha önce açıklanmayan olayların ana hatlarını yayımladığı bir raporla duyurdu.
Raporda Claude’un sergilediği dört farklı istenmeyen davranış türü sıralandı.
YAZILIMDAKİ KUSURLARDAN YARARLANDI
Anthropic’in raporuna göre tespit edilen davranışlardan biri, komutları çalıştırmak amacıyla yazılımdaki temel kusurlardan yararlanılması oldu.
Raporda ayrıca gönderilmemesi gereken bazı formların gönderildiği belirtildi.
Claude’un belirli kamuya açık verilere ulaşmak amacıyla uygulanan bazı kısıtlamaları baypas ettiği de tespit edilen davranışlar arasında yer aldı.
ABD HÜKÜMET KURUMLARININ SİTELERİ DE VAKALAR ARASINDA
Anthropic, olaylardan bazılarının federal, eyalet ve yerel düzeylerdeki ABD hükümet kurumları tarafından işletilen web sitelerini kapsadığını açıkladı.
Şirket, hangi kurumların etkilendiğine ilişkin ayrıntılı bilgi vermedi.
Anthropic, etkilenen bazı tarafların talebi üzerine raporda adı geçen dış kuruluşların isimlerini açıklamadığını belirtti.
YAPAY ZEKA GÜVENLİĞİYLE İLGİLİ ENDİŞELER ARTIYOR
Anthropic ve rakibi OpenAI, son aylarda yapay zeka modellerinin istenmeyen şekillerde hareket ettiği çeşitli olayları kamuoyuna açıkladı.
Bu olayların, cuma günü yayımlanan raporda tanımlanan davranışlardan üçüncü taraf web sitelerinin hacklenmesine kadar uzandığı belirtildi.
Yapılan açıklamalar, en gelişmiş yapay zeka modellerinin oluşturabileceği güvenlik risklerine ilişkin endişeleri artırdı.
ANTHROPIC: GERÇEK DÜNYADAKİ ETKİ SINIRLI KALDI
Anthropic, raporda söz konusu davranışları yapay zekasını içeren önceki bazı olaylara kıyasla daha az ciddi gördüğünü belirtti.
Şirket açıklamasında şu ifadelere yer verdi:
“Bu kategorilerde bugüne kadar tespit ettiğimiz vakaların gerçek dünyadaki etkisi oldukça sınırlı kaldı.”
Anthropic’in açıklamasıyla birlikte Claude’un dış dijital sistemlerde gerçekleştirdiği istenmeyen eylemler, yapay zeka modellerinin güvenliği ve kontrolü konusundaki tartışmaları yeniden gündeme taşıdı.
Yorum yazmak için giriş yapın.
Henüz yorum yok. İlk yorumu siz yazın.