TradingKey - OpenAI afirmó el miércoles que las muestras de ingeniería de Jalapeno, el primer chip personalizado codesarrollado con Broadcom (AVGO), han sido entregadas y se encuentran actualmente en fase de pruebas de laboratorio. El CEO de Broadcom, Hock Tan, señaló que los primeros resultados muestran que, bajo cargas de trabajo habituales de IA, los costes operativos de Jalapeno podrían reducirse alrededor de un 50% en comparación con las GPU de IA comunes.
Jalapeno está diseñado principalmente para la inferencia en modelos de lenguaje de gran tamaño, la etapa posterior al entrenamiento del modelo en la que los sistemas responden a las solicitudes de los usuarios y ejecutan tareas. Richard Ho, director de Hardware en OpenAI, afirmó que el chip logra un equilibrio entre el rendimiento de procesamiento y la velocidad de respuesta, lo que permite atender a más usuarios a un coste menor al tiempo que reduce los tiempos de espera para tareas con altas exigencias de respuesta en tiempo real. El chip tiene una potencia nominal de aproximadamente 700 vatios, lo que se espera que reduzca los costes de electricidad de los centros de datos.
OpenAI señaló que Jalapeno demostró un alto rendimiento por vatio en las pruebas internas y superó a los productos existentes de Nvidia en algunas pruebas. Sin embargo, estos resultados siguen siendo divulgaciones preliminares de pruebas internas que aún no han sido validadas mediante un despliegue comercial a gran escala. El chip no se comparó con la última generación Vera Rubin de Nvidia, ni se utiliza para el entrenamiento de modelos de IA, por lo que no sustituirá a los productos de Nvidia en el ámbito del entrenamiento a corto plazo.
Tras la noticia, las acciones de Broadcom subieron más de un 1% al principio de la sesión antes de reducir su avance al 0,66%, cotizando a 361,13 dólares.

Gráfico de cotización de Broadcom, Fuente: TradingView
Según el plan, la versión final de Jalapeno se desplegará en los centros de datos de Microsoft y otros socios a partir de finales de este año. Broadcom preveía anteriormente desplegar aproximadamente 1,3 gigavatios de estos chips el próximo año, y Tan afirmó que, a medida que la demanda siga creciendo, la escala real podría superar ese objetivo. Las dos empresas también han establecido una hoja de ruta de chips multigeneracional, y se espera que el producto de próxima generación se lance en 2028 y experimente iteraciones continuas a partir de entonces.
Esta alianza es un paso importante para que OpenAI amplíe sus fuentes de suministro de chips y reduzca los costes de infraestructura. Además de continuar con las compras a gran escala de productos de Nvidia, OpenAI también se ha asociado con fabricantes de chips como AMD y Cerebras, y prevé reforzar el control en todas las áreas de chips, memoria, redes y sistemas de centros de datos. La empresa recaudó aproximadamente 122.000 millones de dólares a principios de este año para invertir en chips, centros de datos y talento. Sin embargo, la forma en que OpenAI pagará los pedidos de chips a gran escala queda por determinar en posteriores acuerdos de financiación.