Microsoft ampliará la presencia de AMD en Azure con el despliegue de Helios, una plataforma completa para centros de datos que integra aceleradores Instinct MI455X, procesadores EPYC de sexta generación, redes Pensando y el software ROCm. Los primeros sistemas comenzarán a llegar durante la segunda mitad de 2026 y se utilizarán principalmente para ejecutar modelos avanzados de inteligencia artificial.
Las claves del acuerdo entre Microsoft y AMD en 20 segundos
- Azure desplegará racks Helios con 72 aceleradores AMD Instinct MI455X.
- Microsoft los destinará principalmente a inferencia de modelos avanzados.
- También llegarán nuevas máquinas virtuales con procesadores EPYC Venice.
- AMD Pensando reforzará las redes internas y varios servicios de Azure.
- El acuerdo amplía las alternativas de Microsoft frente al dominio de NVIDIA.
La colaboración va más allá de incorporar una nueva generación de unidades de procesamiento gráfico (GPU) al catálogo de Azure. Microsoft y AMD están coordinando procesadores, aceleradores, redes, sistemas y software para ofrecer una infraestructura diseñada como un conjunto, una aproximación cada vez más habitual ante el tamaño y el consumo de las nuevas plataformas de IA.
Microsoft ha confirmado tres futuras familias de servicios: máquinas virtuales ND MI455X v7 para inferencia, HDv2 para inteligencia artificial agéntica y procesamiento de datos, y HXv2 para automatización del diseño electrónico. Las dos últimas utilizarán procesadores AMD EPYC Venice, basados en la arquitectura Zen 6.
Helios convierte el rack completo en una plataforma de IA
Helios es el intento de AMD de competir en el mercado de los sistemas completos para inteligencia artificial. En lugar de vender únicamente aceleradores, la compañía proporciona un diseño de rack en el que la computación, la memoria, la red y el software han sido preparados para trabajar juntos.
Cada rack integrará 72 aceleradores Instinct MI455X, procesadores EPYC Venice y adaptadores de red Pensando Vulcano. La comunicación interna utilizará UALink, una tecnología abierta desarrollada para conectar aceleradores y permitir que compartan información con una latencia reducida.
AMD atribuye a cada rack hasta 2,9 exaflops de rendimiento en cálculos FP4, un formato de baja precisión utilizado en determinadas cargas de IA. Esta cifra no sirve para comparar directamente Helios con cualquier superordenador o sistema convencional, ya que depende del tipo de operación y de las condiciones de uso, pero muestra la densidad de cálculo que la empresa pretende concentrar en una sola instalación.
La arquitectura está orientada tanto al entrenamiento como a la inferencia, aunque Microsoft ha destacado especialmente su uso para ejecutar modelos avanzados, servicios de Azure AI y aplicaciones de clientes.
La inferencia es la fase en la que un modelo ya entrenado responde consultas, genera imágenes, resume documentos o ejecuta tareas. Su peso dentro de los centros de datos está creciendo a medida que las empresas llevan la inteligencia artificial desde las pruebas iniciales hasta aplicaciones utilizadas de forma continua.
Este tipo de carga no siempre necesita exactamente la misma infraestructura que el entrenamiento. El tiempo de respuesta, el coste por consulta, la capacidad de atender muchos usuarios y el consumo energético pueden resultar más importantes que alcanzar el máximo rendimiento durante unas pocas semanas.
Microsoft no ha comunicado cuántos racks comprará, qué regiones de Azure los recibirán primero ni cuándo podrán contratarlos los clientes. AMD se limita por ahora a indicar que comenzará a enviar Helios durante la segunda mitad de 2026.
AMD gana espacio en una Azure que combina varios tipos de silicio
El acuerdo refuerza la posición de AMD como proveedor de infraestructura para Microsoft, pero no convierte a Helios en la única plataforma de IA de Azure.
Microsoft también utiliza aceleradores de NVIDIA y desarrolla chips propios, como la familia Maia. Su estrategia consiste en combinar varias arquitecturas para atender cargas diferentes y reducir la dependencia de un único fabricante.
Para AMD, entrar en Azure con un rack completo es más relevante que vender un lote adicional de GPU. Los grandes proveedores cloud ya no eligen únicamente el acelerador. También evalúan la red interna, el consumo eléctrico, la refrigeración, la disponibilidad de memoria, la capacidad de mantenimiento y la madurez del software.
NVIDIA ha construido una posición dominante precisamente mediante esa integración. Sus sistemas combinan GPU, interconexiones NVLink, adaptadores de red, servidores de referencia y el entorno de programación CUDA. AMD necesita demostrar que ROCm y sus plataformas abiertas pueden ofrecer una alternativa viable en instalaciones de gran tamaño.
El despliegue de Microsoft puede ayudar en ese objetivo porque obliga a probar Helios en condiciones reales, con modelos de gran tamaño y servicios destinados a clientes. También aporta una referencia comercial que AMD podrá utilizar ante otras empresas y proveedores de nube.
Azure Foundry Managed Compute ofrecerá acceso a parte de esta infraestructura para que las organizaciones puedan desplegar y ampliar cargas de IA sin administrar directamente todos los componentes físicos. La disponibilidad concreta, los precios y las configuraciones todavía no se han publicado.
EPYC Venice y Pensando amplían el acuerdo más allá de las GPU
La colaboración incluye dos nuevas series de máquinas virtuales basadas en AMD EPYC Venice. HDv2 estará orientada a canalizaciones de datos, preparación de información e inteligencia artificial agéntica, mientras que HXv2 se dirigirá al diseño de semiconductores y otras cargas de ingeniería.
La automatización del diseño electrónico, conocida como EDA por sus siglas en inglés, exige grandes cantidades de memoria, capacidad de cálculo y conexiones rápidas entre servidores. Es un mercado especializado en el que los proveedores cloud compiten por atraer a fabricantes de chips y empresas que necesitan ejecutar simulaciones sin construir sus propios centros de cálculo.
La incorporación de Venice también muestra que el crecimiento de la IA no depende solo de los aceleradores. Las CPU preparan los datos, coordinan las GPU, gestionan almacenamiento y red, ejecutan bases de datos y atienden partes de las aplicaciones que no resultan adecuadas para un acelerador.
Microsoft y AMD ampliarán además el uso de las unidades de procesamiento de datos Pensando. Estos dispositivos, conocidos como DPU, descargan de la CPU tareas como el tratamiento de paquetes, la seguridad, el almacenamiento y la gestión de conexiones.
Azure ya utiliza Pensando en parte de su infraestructura. La nueva fase integrará estas tecnologías con Azure Boost, el sistema de Microsoft para trasladar operaciones de red y almacenamiento desde las máquinas virtuales hacia hardware especializado.
El objetivo es liberar recursos de CPU para las aplicaciones y mantener un rendimiento más estable cuando miles de servidores intercambian datos al mismo tiempo. En un clúster de IA, una red insuficiente puede dejar aceleradores costosos esperando información en lugar de realizar cálculos.
Una alternativa más para la infraestructura de inteligencia artificial
El anuncio no incluye previsiones de ingresos ni el valor económico del contrato. Tampoco garantiza que AMD vaya a reducir rápidamente la ventaja de NVIDIA, cuya plataforma conserva una amplia implantación y un entorno de software desarrollado durante años.
Helios sí confirma que la competencia se está desplazando desde el chip individual hacia el rack completo. Diseñar una GPU rápida ya no basta. El proveedor debe resolver cómo conectarla con decenas de aceleradores, mover los datos, refrigerar el sistema y ofrecer herramientas capaces de ejecutar modelos sin cambios complejos.
Microsoft obtiene otra opción para ampliar Azure y negociar suministros en un mercado donde la demanda de aceleradores continúa siendo elevada. AMD, por su parte, consigue un cliente de gran escala para validar conjuntamente sus GPU, CPU, redes y software.
La prueba decisiva llegará cuando Azure publique las configuraciones comerciales y los primeros datos de rendimiento, disponibilidad y coste. Hasta entonces, buena parte de las capacidades anunciadas siguen siendo objetivos del fabricante y no resultados comprobados en servicios abiertos al público.
Preguntas frecuentes
¿Qué es AMD Helios?
AMD Helios es una plataforma de inteligencia artificial a escala de rack. Combina 72 aceleradores Instinct MI455X, procesadores EPYC Venice, redes Pensando y el entorno de software ROCm.
¿Cuándo estará disponible AMD Helios en Microsoft Azure?
AMD comenzará a enviar los primeros sistemas durante la segunda mitad de 2026. Microsoft todavía no ha comunicado la fecha de disponibilidad comercial ni las primeras regiones de Azure que los ofrecerán.
¿Para qué utilizará Microsoft los aceleradores MI455X?
Azure los destinará principalmente a inferencia de modelos avanzados, servicios de inteligencia artificial de Microsoft y aplicaciones de clientes. La plataforma también está diseñada para cargas de entrenamiento.
¿Sustituirá AMD Helios a las GPU de NVIDIA en Azure?
No se ha anunciado ninguna sustitución. Microsoft está ampliando su catálogo con hardware de AMD mientras mantiene otras plataformas, incluidos aceleradores de NVIDIA y chips propios.