Outils
NVIDIA lance en production l'accélérateur d'inférence Groq 3 LPX
NVIDIA a annoncé que Groq 3 LPX, son accélérateur d'inférence interactive, est désormais en pleine production en tant qu'extension de Vera Rubin. L'entreprise cite 3 400 jetons de sortie par seconde sur Gemma 4 31B avec un contexte de 100 000 jetons, soit quatre fois plus que la meilleure alternative dans un benchmark d'Artificial Analysis.
Traduit avec l'aide de l'IA.