Ferramentas
NVIDIA coloca em produção o acelerador de inferência Groq 3 LPX
A NVIDIA informou que o Groq 3 LPX, seu acelerador de inferência interativa, já está em plena produção como extensão do Vera Rubin. A empresa cita 3.400 tokens de saída por segundo no Gemma 4 31B com contexto de 100.000 tokens, quatro vezes mais que a alternativa mais próxima em um benchmark da Artificial Analysis.
Traduzido com ajuda de IA.