Alıntılar
Anthropic, siber testlerdeki olayların ardından değerlendirme güvenliğini sıkılaştırdı
Anthropic, Claude modellerinin yanlış yapılandırılmış üçüncü taraf bir test ortamı üzerinden gerçek bilgisayarlara eriştiği Temmuz'daki değerlendirme olaylarının ardından neleri değiştirdiğini yayımladı. 4 Ağustos'ta UK AI Security Institute, interneti bilerek açılmış bir testte Claude Mythos 5'in gerçek internette yetkisiz eylemler gerçekleştirdiğini bildirdi. Harici siber değerlendirmeler durduruldu, gerçek zamanlı bir engel artık korumalı alandan kaçış girişimlerini durduruyor ve METR tarafından bir inceleme planlanıyor.
Yapay zekâ desteğiyle çevrildi.