OpenAI ha dado a conocer Jalapeño, su primer chip de inferencia diseñado internamente, y afirma que sus capacidades superan a las de los actuales aceleradores del mercado en cuestiones de eficiencia energética y velocidad.
Rendimiento sobresaliente en pruebas
Las evaluaciones realizadas utilizaron tres modelos públicos de gran escala: GPT-OSS 120B, DeepSeek R1 670B y Kimi K2.5 1T, aplicando el benchmark InferenceX de SemiAnalysis. Según OpenAI, el chip ofrece entre 1,5 y 1,9 veces más trabajo de IA por vatio en condiciones óptimas, además de reducir la latencia de extremo a extremo entre 1,7 y 3,6 veces en comparación con los chips de Nvidia, como los modelos GB300 y GB200.
Para tareas interactivas, el rendimiento de Jalapeño llegó a ser 4,1 veces superior.
Innovaciones técnicas del chip
La arquitectura de Jalapeño busca resolver la disyuntiva habitual entre velocidad y eficiencia que presentan los chips de inferencia convencionales. Este chip integra ambas capacidades en un solo diseño, permitiendo procesar el texto del usuario y generar respuestas simultáneamente sin comprometer el rendimiento.
Otro aspecto notable es la inclusión de un sistema de red en el chip, que limita la cantidad de datos que deben transferirse entre chips, reduciendo así los retrasos en comunicaciones que pueden ralentizar procesos secuenciales de inferencia.
Bajas cifras de consumo energético
Con una potencia nominal de 700 vatios, OpenAI reporta que durante las pruebas, el consumo se mantuvo en 550 vatios o menos. Comparado con el modelo Kimi K2.5 1T, el chip mostró un rendimiento máximo 1,5 veces superior y una latencia 3,4 veces menor.
Implicación de la inteligencia artificial en el desarrollo
El diseño de Jalapeño involucró las herramientas de OpenAI, donde modelos de la empresa ayudaron a optimizar el proceso de diseño y verificación en un tiempo récord de solo nueve meses.
Además, se utilizó tecnología IA para mejorar el rendimiento de los modelos que no estaban inicialmente en el plan de producción, logrando implementaciones más rápidas que las diseñadas por ingenieros humanos.
Vista hacia el futuro
OpenAI planea incorporar Jalapeño a su infraestructura de cómputo para finales de 2026 y ya trabaja en la próxima generación de chip, evidenciando su compromiso de hacer que la inferencia de modelos de lenguaje sea cada vez más eficiente y rápida, acompañado del crecimiento en sus capacidades tecnológicas.
Artículos Relacionados
Rechazo del Gobierno a Rumores sobre el Cancelamiento del Proyecto del Diamer-Bhasha Dam
29/8/2026
Google invertirá en tres cables submarinos para transformar República Dominicana en nodo digital
29/8/2026
OpenAI suspende modelos de IA para Cursor, intensificando conflicto con Elon Musk
29/8/2026
Kentucky verá la transformación de una fundición en un importante centro de datos para IA
29/8/2026