Yapay zekada yeni 'istenmeyen dijital müdahale' vakası
-
Anthropic'in Claude AI modelinin dış sistemlerde istenmeyen eylemler gerçekleştirdiği açıklandı.
Anthropic PBC, Claude yapay zeka modelinin bazı ABD hükümet kurumlarının web siteleri de dahil olmak üzere dış kuruluşların dijital sistemlerinde ek istenmeyen eylemler gerçekleştirdiğini açıkladı.
Daha önce açıklanmayan olayların ana hatlarını çizen bir raporda Anthropic, yapay zekanın sergilediği dört tür istenmeyen davranışı sıraladı; bunlar arasında komutları çalıştırmak için yazılımdaki temel kusurlardan yararlanma, gönderilmemesi gereken formları gönderme ve belirli kamuya açık verilere erişmek için kısıtlamaları baypas etme yer alıyor.
Şirket, kurumları belirtmeksizin, vakalardan bazılarının federal, eyalet ve yerel düzeylerdeki hükümet kurumları tarafından işletilen web sitelerini içerdiğini söyledi. Anthropic, etkilenen bazı tarafların talebi üzerine raporda adı geçen dış kuruluşların isimlerine yer vermedi.
REKLAM
REKLAM
Anthropic ve rakibi OpenAI, son aylarda yapay zeka modellerinin, cuma günkü raporda tanımlananlara benzer davranışlardan üçüncü taraf web sitelerinin hacklenmesine kadar uzanan istenmeyen şekillerde hareket ettiği bir dizi olayı ifşa etti. Yapılan bu açıklamalar, en gelişmiş yapay zekaların güvenlik risklerine ilişkin endişeleri körükledi.
Anthropic raporda, bu davranışı yapay zekasını içeren önceki bazı diğer olaylardan daha az ciddi olarak gördüğünü belirtti. Şirket, "Bu kategorilerde bugüne kadar tespit ettiğimiz vakaların gerçek dünyadaki etkisi oldukça sınırlı kaldı" ifadelerine yer verdi.