TradingKey - Nvidia (NVDA) anunció el lunes que el NVIDIA Groq 3 LPX, desarrollado con tecnología de Groq, ha entrado en producción a gran escala, y está previsto que los sistemas en rack asociados comiencen a operar este año. Como componente fundamental de la plataforma Vera Rubin, el Groq 3 LPX está orientado principalmente al mercado de inferencia de IA en rápido crecimiento, perfeccionando aún más la estructura de computación de Nvidia desde el entrenamiento de modelos de IA hasta su despliegue en el mundo real.
Según la información difundida por Nvidia, cada rack de Groq 3 LPX contiene 256 LPUs Groq 3. Nvidia afirmó que, en determinadas tareas de inferencia de grandes modelos de IA, la combinación de Groq 3 LPX con Vera Rubin puede aumentar el rendimiento de la inferencia por megavatio hasta aproximadamente 35 veces, al tiempo que incrementa la carga de trabajo que los centros de datos de IA pueden procesar en las mismas condiciones energéticas.
A finales de 2025, Nvidia firmó un acuerdo de licencia tecnológica no exclusiva con Groq e incorporó al fundador de Groq, Jonathan Ross, junto con varios miembros clave del equipo. La propia Groq sigue operando de manera independiente y continúa desarrollando su negocio GroqCloud. En agosto de este año, Groq se convirtió oficialmente en Nvidia Cloud Partner.
Al mismo tiempo, la propia Groq está acelerando la adopción de la nueva plataforma de Nvidia. La empresa anunció el 24 de agosto que se encontrará entre los primeros proveedores de servicios en la nube en lanzar al mercado NVIDIA Groq 3 LPX y Vera Rubin NVL72. Junto con la confirmación de Nvidia de que Groq 3 LPX ha entrado en producción a gran escala, esto indica que la colaboración entre ambas partes ha pasado gradualmente de la licencia tecnológica a la implementación de productos y al despliegue comercial.
Para Nvidia, la importancia del lanzamiento de Groq 3 LPX este año radica en reforzar aún más su competitividad en el mercado de inferencia de IA. En el pasado, la demanda de computación de IA estaba impulsada principalmente por el entrenamiento de grandes modelos; sin embargo, a medida que la base de usuarios de ChatGPT, Claude y diversos agentes de IA se amplía, la demanda de inferencia generada por la ejecución diaria de los modelos está creciendo rápidamente. Por lo tanto, Nvidia está expandiendo Vera Rubin desde una plataforma puramente de GPUs hacia una infraestructura de IA completa que abarca GPUs, CPUs, LPUs Groq, redes y almacenamiento.
A medida que Groq 3 LPX entra en producción a gran escala y con su lanzamiento previsto para este año, la alianza entre Nvidia y Groq entra oficialmente en la fase de comercialización. Si el foco del crecimiento de la computación en la siguiente etapa de la industria de la IA se desplaza aún más del «entrenamiento de modelos» a la «ejecución de modelos», la tecnología de inferencia de baja latencia de Groq servirá como un complemento importante para que Nvidia amplíe la cobertura de su mercado de chips de IA.