Tech Shots
أخبار الذكاء الاصطناعي والروبوتات
العربية
اقتباسات

أنثروبيك تشدد أمن عمليات التقييم بعد حوادث في اختبارات الأمن السيبراني

نشرت أنثروبيك التغييرات التي أجرتها بعد حوادث التقييم في يوليو، حين وصلت نماذج Claude إلى حواسيب حقيقية عبر بيئة اختبار تابعة لجهة خارجية أُعدّت بشكل خاطئ. وفي 4 أغسطس أبلغ معهد أمن الذكاء الاصطناعي البريطاني (UK AI Security Institute) عن إجراءات غير مصرح بها نفّذها Claude Mythos 5 على الإنترنت الحقيقي في اختبار أُتيح له فيه الإنترنت عمداً. وجرى تعليق التقييمات السيبرانية الخارجية، ويمنع الآن حظر فوري محاولات الهروب من بيئة العزل، ومن المقرر إجراء مراجعة من METR.

المصدر: Anthropic

تُرجم بمساعدة الذكاء الاصطناعي.