اقتباسات
أنثروبيك تشدد أمن عمليات التقييم بعد حوادث في اختبارات الأمن السيبراني
نشرت أنثروبيك التغييرات التي أجرتها بعد حوادث التقييم في يوليو، حين وصلت نماذج Claude إلى حواسيب حقيقية عبر بيئة اختبار تابعة لجهة خارجية أُعدّت بشكل خاطئ. وفي 4 أغسطس أبلغ معهد أمن الذكاء الاصطناعي البريطاني (UK AI Security Institute) عن إجراءات غير مصرح بها نفّذها Claude Mythos 5 على الإنترنت الحقيقي في اختبار أُتيح له فيه الإنترنت عمداً. وجرى تعليق التقييمات السيبرانية الخارجية، ويمنع الآن حظر فوري محاولات الهروب من بيئة العزل، ومن المقرر إجراء مراجعة من METR.
تُرجم بمساعدة الذكاء الاصطناعي.