TradingKey - A Nvidia (NVDA) anunciou nesta segunda-feira que o NVIDIA Groq 3 LPX, desenvolvido com a tecnologia da Groq, entrou em produção em escala total, com sistemas de rack relacionados programados para entrar em operação ainda este ano. Servindo como um componente crucial da plataforma Vera Rubin, o Groq 3 LPX é voltado principalmente para o mercado de inferência de IA em rápido crescimento, aprimorando ainda mais a estrutura computacional da Nvidia, do treinamento de modelos de IA até a implementação no mundo real.
De acordo com informações divulgadas pela Nvidia, cada rack do Groq 3 LPX contém 256 LPUs Groq 3. A Nvidia afirmou que, em determinadas tarefas de inferência de grandes modelos de IA, a combinação do Groq 3 LPX com a Vera Rubin pode aumentar o throughput de inferência por megawatt em até cerca de 35 vezes, além de elevar a carga de trabalho que os data centers de IA conseguem processar sob as mesmas condições de consumo de energia.
No final de 2025, a Nvidia assinou um acordo não exclusivo de licenciamento de tecnologia com a Groq e integrou o fundador da Groq, Jonathan Ross, juntamente com vários membros centrais da equipe. A própria Groq continua operando de forma independente e prossegue com o desenvolvimento do seu negócio GroqCloud. Em agosto deste ano, a Groq tornou-se oficialmente uma Nvidia Cloud Partner.
Ao mesmo tempo, a própria Groq está acelerando a adoção da nova plataforma da Nvidia. A empresa anunciou em 24 de agosto que estará entre os primeiros provedores de serviços em nuvem a trazer o NVIDIA Groq 3 LPX e a Vera Rubin NVL72 para o mercado. Somado à confirmação da Nvidia de que o Groq 3 LPX entrou em produção em escala total, isso indica que a cooperação entre as duas partes migrou gradualmente do licenciamento de tecnologia para a implementação de produtos e a implantação comercial.
Para a Nvidia, a importância do lançamento do Groq 3 LPX este ano reside em fortalecer ainda mais sua competitividade no mercado de inferência de IA. No passado, a demanda por computação de IA era impulsionada principalmente pelo treinamento de grandes modelos; no entanto, à medida que a base de usuários do ChatGPT, do Claude e de vários agentes de IA se expande, a demanda por inferência gerada por modelos em execução diária cresce com rapidez. Por isso, a Nvidia está expandindo a Vera Rubin de uma plataforma puramente de GPUs para uma infraestrutura completa de IA que abrange GPUs, CPUs, LPUs Groq, redes e armazenamento.
Com o início da produção em escala total do Groq 3 LPX e o lançamento planejado para este ano, a parceria entre a Nvidia e a Groq entra oficialmente na fase de comercialização. Se o foco do crescimento computacional na próxima etapa do setor de IA migrar ainda mais do "treinamento de modelos" para a "execução de modelos", a tecnologia de inferência de baixa latência da Groq servirá como um complemento importante para a Nvidia expandir sua cobertura no mercado de chips de IA.