Tech Shots
Notícias de IA e robótica
Português
Ferramentas

NVIDIA coloca em produção o acelerador de inferência Groq 3 LPX

A NVIDIA informou que o Groq 3 LPX, seu acelerador de inferência interativa, já está em plena produção como extensão do Vera Rubin. A empresa cita 3.400 tokens de saída por segundo no Gemma 4 31B com contexto de 100.000 tokens, quatro vezes mais que a alternativa mais próxima em um benchmark da Artificial Analysis.

Fonte: NVIDIA

Traduzido com ajuda de IA.