Frente al GB200 y GB300 de Nvidia, OpenAI afirma que Jalapeño ofrece entre 1.5 y 1.9 veces más trabajo de IA por vatio y entre 1.7 y 3.6 veces menor latencia de extremo a extremo en GPT-OSS 120B, DeepSeek R1 y Kimi K2.5 1T.
Para cargas de trabajo altamente interactivas, exactamente el tipo necesario para agentes de IA, OpenAI claiming entre 2.1 y 4.1 veces mayor rendimiento.
El chip tiene una potencia nominal de solo 700W, comparada con 1,200W del GB200 y 1,400W del GB300. OpenAI dice que su potencia sostenida medida se mantuvo en o por debajo de 550W en las cargas de trabajo probadas.
OpenAI planea comenzar a desplegar Jalapeño dentro de su propia infraestructura de cómputo antes de finales de 2026, con la Generación 2 ya en desarrollo y la Generación 3 tomando forma.
Fuente de imagen: Jernej Furman from Slovenia, CC BY 2.0, via Wikimedia Commons
