Tech Shots
Notizie su IA e robotica
Italiano
Strumenti

NVIDIA avvia la produzione dell'acceleratore di inferenza Groq 3 LPX

NVIDIA ha dichiarato che Groq 3 LPX, il suo acceleratore di inferenza interattiva, è ora in piena produzione come estensione di Vera Rubin. L'azienda cita 3.400 token di output al secondo su Gemma 4 31B con contesto da 100.000 token, quattro volte l'alternativa più vicina in un benchmark di Artificial Analysis.

Fonte: NVIDIA

Tradotto con l'aiuto dell'IA.