Tech Shots
Новости ИИ и робототехники
Русский
Модели

DeepMind тестирует двойные слепые оценки передового ИИ

Google DeepMind сообщила 27 августа, что испытывает то, что называет первой двойной слепой оценкой проприетарной передовой модели: внешние тесты выполняются внутри криптографического контура Confidential Space, так что оценщики не видят веса Gemini, а Google не видит промпты оценщиков. Среди партнёров — Сингапурский институт безопасности ИИ, OpenMined, AVERI и MLCommons; начинают с модели Gemini Flash Lite на конфиденциальных бенчмарках. Цель — снизить загрязнение бенчмарков и повысить доверие к чувствительным тестам безопасности; это не новая потребительская функция Gemini, не Omni video и не криптобиржа Gemini.

Источник: Google DeepMind

Переведено с помощью ИИ.