Herramientas
NVIDIA pone en producción el acelerador de inferencia Groq 3 LPX
NVIDIA anunció que Groq 3 LPX, su acelerador de inferencia interactiva, ya está en plena producción como extensión de Vera Rubin. La compañía cita 3.400 tokens de salida por segundo en Gemma 4 31B con un contexto de 100.000 tokens, cuatro veces más que la alternativa más cercana en un benchmark de Artificial Analysis.
Traducido con ayuda de IA.