Tech Shots
Actualités IA et robotique
Français
Outils

NVIDIA lance en production l'accélérateur d'inférence Groq 3 LPX

NVIDIA a annoncé que Groq 3 LPX, son accélérateur d'inférence interactive, est désormais en pleine production en tant qu'extension de Vera Rubin. L'entreprise cite 3 400 jetons de sortie par seconde sur Gemma 4 31B avec un contexte de 100 000 jetons, soit quatre fois plus que la meilleure alternative dans un benchmark d'Artificial Analysis.

Source: NVIDIA

Traduit avec l'aide de l'IA.