TradingKey - A OpenAI afirmou na quarta-feira que amostras de engenharia do Jalapeno, o primeiro chip customizado co-desenvolvido com a Broadcom (AVGO), foram entregues e estão atualmente passando por testes de laboratório. O CEO da Broadcom, Hock Tan, disse que os resultados preliminares mostram que, sob cargas de trabalho típicas de IA, os custos operacionais do Jalapeno podem ser reduzidos em cerca de 50% em comparação com as GPUs de IA comuns.
O Jalapeno foi projetado principalmente para a inferência de grandes modelos de linguagem, a etapa posterior ao treinamento do modelo na qual os sistemas respondem às solicitações dos usuários e executam tarefas. Richard Ho, chefe de hardware da OpenAI, disse que o chip atinge um equilíbrio entre throughput e velocidade de resposta, permitindo atender a mais usuários a um custo menor, ao mesmo tempo em que reduz o tempo de espera para tarefas com altas exigências de resposta em tempo real. O chip tem uma potência nominal de aproximadamente 700 watts, o que deve reduzir os custos de eletricidade dos data centers.
A OpenAI afirmou que o Jalapeno demonstrou alto desempenho por watt em testes internos e superou os produtos existentes da Nvidia em alguns testes. No entanto, esses resultados continuam sendo divulgações preliminares de testes internos que ainda não foram validados por uma implantação comercial em grande escala. O chip não foi testado contra a Vera Rubin de última geração da Nvidia, nem é usado para o treinamento de modelos de IA, portanto não substituirá os produtos da Nvidia na área de treinamento no curto prazo.
Após a notícia, as ações da Broadcom subiram mais de 1% no início da sessão antes de reduzir os ganhos para 0,66%, sendo negociadas a US$ 361,13.

Gráfico do preço das ações da Broadcom, Fonte: TradingView
De acordo com o plano, a versão final do Jalapeno será implantada nos data centers da Microsoft e de outros parceiros a partir do final deste ano. A Broadcom projetava anteriormente implantar aproximadamente 1,3 gigawatt dos chips no próximo ano, e Tan disse que, como a demanda continua a crescer, a escala real pode superar essa meta. As duas empresas também estabeleceram um mapa de desenvolvimento (roadmap) multigeracional de chips, com o produto da próxima geração previsto para ser lançado em 2028 e passar por iterações contínuas a partir de então.
Esta parceria é um passo importante para a OpenAI expandir suas fontes de fornecimento de chips e reduzir custos de infraestrutura. Além de continuar com compras em grande escala de produtos da Nvidia, a OpenAI também estabeleceu parcerias com fabricantes de chips como AMD e Cerebras, e planeja reforçar o controle sobre chips, memória, redes e sistemas de data centers. A empresa captou aproximadamente US$ 122 bilhões no início deste ano para investir em chips, data centers e talentos. No entanto, como a OpenAI pagará por pedidos de chips em grande escala ainda dependerá de futuros acordos de financiamento.