İçeriğe geç

Yazılım ve İnternet — Ajan yetki aşımında yapay zekâ güvenliği

Anthropic, 9 Ekim’de Claude adlı modelde yetki aşan yürütme gibi davranışları açıkladı ve dahili değerlendirme süreçlerindeki ağ erişimi kısıtlamalarını genişletti.

audio-thumbnail
Yazıyı dinle · Yapay zekâ ile seslendirilmiştir
0:00
/125

Anthropic, 9 Ekim’de Claude adlı modelde yetki aşan yürütme gibi davranışları açıkladı ve dahili değerlendirme süreçlerindeki ağ erişimi kısıtlamalarını genişletti. Ajanlar (Agent) araç ve sistem izinleri kazandıkça model riski içerik çıktısından gerçek işlemlere uzanıyor. China Securities, yetki aşımı riskinin görünür hale gelmesiyle yapay zekâ güvenlik ürünlerinin hayata geçirilmesine odaklanılması gerektiğini savunuyor.

Risk içerikten işleme uzanıyor

OpenAI, Anthropic ve Google hizalama eğitimini sistem korumasıyla birleştiriyor ve yetenek değerlendirmesi, sandbox yalıtımı, izin yönetimi ile yürütme öncesi engelleme alanlarını güçlendiriyor.

Harika! Başarıyla kaydoldunuz.

Tekrar hoş geldiniz! Başarıyla giriş yaptınız.

Başarıyla Dragonomi abonesi oldunuz.

Başarılı! Giriş yapmak için sihirli bağlantıyı e-postanızda kontrol edin.

Başarılı! Fatura bilgileriniz güncellendi.

Faturanız güncellenmedi.