OpenAI está desarrollando Jalapeño como un acelerador de inferencia diseñado principalmente para cubrir sus propias necesidades de cómputo. Richard Ho, responsable de hardware de la compañía, ha explicado a Tom’s Hardware que el chip podría utilizarse para otros clientes, aunque la prioridad durante los próximos años será atender la creciente demanda interna de OpenAI.
Las claves de Jalapeño en 20 segundos
- Jalapeño es el primer acelerador de inferencia propio de OpenAI, desarrollado junto a Broadcom.
- La compañía prevé desplegarlo dentro de su infraestructura de cómputo a finales de 2026.
- OpenAI asegura que funciona también con modelos externos como DeepSeek R1 y Kimi K2.5.
- Ho deja abierta una futura disponibilidad para terceros, pero la prioridad actual es el consumo interno.
- El diseño forma parte de una plataforma multigeneracional, con Gen 2 ya en desarrollo.
La posición de OpenAI es más pragmática que comercial. La compañía no está presentando Jalapeño como un producto que vaya a competir de inmediato con los aceleradores de NVIDIA en el mercado, sino como una pieza de su propia infraestructura. Ho reconoce que el hardware podría utilizarse fuera de OpenAI, pero considera que la demanda de capacidad dentro de la empresa será suficiente para ocupar buena parte de la producción durante bastante tiempo.
Un chip diseñado alrededor de la inferencia
OpenAI presentó Jalapeño en junio de 2026 junto a Broadcom. La compañía lo define como su primer procesador de inteligencia y como la primera generación de una plataforma de cómputo que tendrá varias generaciones. El chip fue diseñado específicamente para cargas de inferencia de grandes modelos de lenguaje (LLM), en lugar de adaptar un acelerador existente a las necesidades de OpenAI.
El proyecto se desarrolló desde el diseño inicial hasta la fabricación en nueve meses, según OpenAI. Broadcom aporta la implementación de silicio y tecnologías de red, mientras que Celestica participa en la fabricación de placas, sistemas en rack y otros elementos necesarios para llevar el acelerador a instalaciones de gran escala. OpenAI, por su parte, ha diseñado la arquitectura a partir de sus modelos, kernels, software de inferencia y patrones reales de servicio.
La compañía ha explicado que uno de los objetivos principales era mejorar la eficiencia. En un centro de datos dedicado a inteligencia artificial, aumentar el trabajo útil que puede realizar cada vatio puede tener un efecto directo sobre la cantidad de capacidad que se puede desplegar con una determinada infraestructura energética.
Los primeros resultados publicados por OpenAI en agosto apuntan en esa dirección. En sus pruebas con GPT-OSS 120B, DeepSeek R1 y Kimi K2.5 1T, Jalapeño consiguió entre 1,5 y 1,9 veces más trabajo de IA por vatio en el punto de máximo rendimiento frente a los sistemas utilizados como comparación. La compañía también midió una latencia de extremo a extremo entre 1,7 y 3,6 veces menor y, en cargas altamente interactivas, entre 2,1 y 4,1 veces más rendimiento. Son cifras publicadas por OpenAI, por lo que describen sus propias mediciones y metodología.
La puerta a terceros sigue abierta
La posibilidad de que Jalapeño termine fuera de OpenAI no está descartada. Ho explicó a Tom’s Hardware que el acelerador es programable y de propósito general dentro de su ámbito, y que el equipo pudo poner en funcionamiento modelos que OpenAI no había utilizado durante el desarrollo inicial.
Ese punto tiene importancia porque una de las dudas sobre un ASIC, un circuito integrado diseñado para una aplicación concreta, es hasta qué punto queda ligado a un único modelo o carga de trabajo. OpenAI asegura que Jalapeño no está codificado exclusivamente para sus propios modelos.
El equipo demostró esta capacidad con modelos externos. Según OpenAI, Jalapeño ha ejecutado GPT-OSS 120B, DeepSeek R1 y Kimi K2.5 1T. Ho también explicó que los ingenieros consiguieron poner en marcha DeepSeek y Kimi aproximadamente dos meses después de recibir una muestra A0 del chip, antes de la presentación de los resultados en Hot Chips.
Eso no significa que OpenAI vaya a vender Jalapeño como un producto comercial. La respuesta de Ho deja clara la situación actual: la empresa tiene una demanda interna de cómputo que crece con sus usuarios, nuevos modelos, Codex y otras funciones, y quiere cubrir primero esas necesidades. La posibilidad de emplearlo en otros entornos queda abierta, pero sin un calendario ni un anuncio comercial.
También hay una cuestión de capacidad de producción. El despliegue de aceleradores propios a escala requiere no solo fabricar el chip, sino disponer de memoria, redes, placas, sistemas completos y capacidad de centro de datos. La estrategia anunciada con Broadcom contempla despliegues a escala de gigavatios durante varias generaciones, mientras OpenAI continúa utilizando aceleradores de NVIDIA y otros proveedores tanto para entrenamiento como para inferencia.
Jalapeño forma parte de una estrategia más amplia
OpenAI tampoco plantea Jalapeño como un proyecto aislado. La compañía ya habla de una segunda generación en desarrollo y de una tercera que empieza a tomar forma. El objetivo es que cada generación aproveche la experiencia obtenida con las anteriores para mejorar velocidad y eficiencia.
La estrategia encaja con el interés creciente de los grandes desarrolladores de modelos por controlar más partes de la infraestructura. Diseñar conjuntamente modelos, software de inferencia, memoria, redes y silicio permite adaptar el hardware a cargas reales de producción que un fabricante externo debe servir para muchos clientes distintos.
Para OpenAI, esa integración tiene una aplicación directa: ejecutar sus propios modelos con menos consumo energético y menor latencia puede aumentar la capacidad disponible sin depender exclusivamente de adquirir más aceleradores generalistas. Pero la compañía mantiene al mismo tiempo una estrategia de múltiples proveedores, por lo que Jalapeño no supone la sustitución inmediata de NVIDIA ni del resto de hardware utilizado en sus centros de datos.
La cuestión comercial queda, por tanto, en segundo plano. OpenAI tiene un acelerador que, según sus pruebas, puede ejecutar modelos propios y ajenos con buenos resultados, pero su primera tarea será atender la demanda de la propia compañía. Si en el futuro existe suficiente capacidad de producción y la arquitectura mantiene sus ventajas frente a otras alternativas, el mismo diseño podría acabar utilizándose fuera de OpenAI. Por ahora, esa posibilidad permanece abierta y no constituye un producto anunciado para clientes externos.
Preguntas frecuentes
¿Qué es Jalapeño de OpenAI?
Jalapeño es el primer acelerador de inferencia diseñado por OpenAI. Está orientado a ejecutar grandes modelos de lenguaje con un foco especial en eficiencia y baja latencia.
¿Jalapeño se venderá a otras empresas?
OpenAI no ha anunciado un lanzamiento comercial para terceros. Richard Ho ha señalado que el chip podría utilizarse fuera de la compañía, pero la prioridad actual es cubrir las necesidades internas de cómputo.
¿Qué modelos puede ejecutar Jalapeño?
OpenAI ha publicado resultados con GPT-OSS 120B, DeepSeek R1 y Kimi K2.5 1T, además de sus propias cargas de trabajo.
¿Cuándo empezará a utilizar OpenAI Jalapeño?
OpenAI prevé comenzar el despliegue del chip dentro de su infraestructura de cómputo a finales de 2026. La compañía ya trabaja en una segunda generación.