Jalapeño: el primer chip de inferencia de OpenAI muestra sus resultados
OpenAI publicó las primeras mediciones de Jalapeño, su chip propio para inferencia. En pruebas con modelos abiertos, la compañía afirma que consiguió más trabajo por vatio y respuestas más rápidas que los sistemas comparados.
Los puntos clave
- Fue medido con GPT-OSS 120B, DeepSeek R1 y Kimi K2.5.
- OpenAI reporta entre 1,5 y 1,9 veces más trabajo por vatio en el pico.
- La primera generación comenzaría a desplegarse internamente antes de terminar el año.
Qué significa
La integración entre chip, memoria, red y software puede reducir el costo de cada tarea terminada. También confirma que la competencia en IA se mueve hacia la infraestructura completa, no solo hacia el modelo que encabeza una prueba.
Fuente oficial: consultar el anuncio original.