Strumenti
NVIDIA avvia la produzione dell'acceleratore di inferenza Groq 3 LPX
NVIDIA ha dichiarato che Groq 3 LPX, il suo acceleratore di inferenza interattiva, è ora in piena produzione come estensione di Vera Rubin. L'azienda cita 3.400 token di output al secondo su Gemma 4 31B con contesto da 100.000 token, quattro volte l'alternativa più vicina in un benchmark di Artificial Analysis.
Tradotto con l'aiuto dell'IA.