DeepMind, öncü yapay zekâ için çift kör değerlendirmeyi deniyor
Google DeepMind, 27 Ağustos'ta tescilli bir öncü modelin ilk çift kör değerlendirmesi olarak nitelediği çalışmayı pilot olarak yürüttüğünü açıkladı: harici testler kriptografik bir Confidential Space kutusunda çalışıyor; böylece değerlendiriciler Gemini ağırlıklarını, Google ise değerlendiricilerin istemlerini göremiyor. Ortaklar arasında Singapur Yapay Zekâ Güvenliği Enstitüsü, OpenMined, AVERI ve MLCommons var; başlangıç, gizli kıyaslamalarda bir Gemini Flash Lite modeliyle yapılıyor. Amaç, kıyaslama kirliliğini azaltmak ve hassas güvenlik testlerine güveni artırmak; bu, yeni bir Gemini tüketici özelliği, Omni video ya da Gemini kripto borsası değil.
Yapay zekâ desteğiyle çevrildi.