El rack Helios de AMD consigue a Meta, OpenAI, Oracle y Microsoft como clientes

La CEO de AMD, Lisa Su, utilizó una keynote el jueves en la conferencia Advancing AI 2026 de la compañía en San Francisco para detallar los detalles de producción en volumen del acelerador Instinct MI455X, el sistema a escala de rack Helios construido a su alrededor y EPYC "Venice", que AMD afirma es el primer procesador de servidor x86 de la industria fabricado con el proceso de 2 nanómetros de TSMC. El evento también sirvió como una reunión de clientes: Meta, Microsoft, Oracle, OpenAI y Anthropic han confirmado despliegues, varios a escala de gigavatios.
Los anuncios son importantes porque AMD ha pasado los últimos dos años intentando convertir el dominio de Nvidia en infraestructura de IA en una carrera de dos caballos, y la lista de clientes del jueves es la evidencia más clara de que los hiperescaladores están dispuestos a construir capacidad significativa sobre silicio de AMD en lugar de tratarlo como un proveedor de respaldo. Meta dijo que utilizará hasta 6 gigavatios de GPUs de AMD con el tiempo, comenzando con 1 gigavatio en racks Helios a finales de este año. OpenAI ha realizado un compromiso equivalente de 6 gigavatios. Oracle está construyendo un superclúster Helios de 50.000 GPUs. Microsoft está desplegando racks Helios dentro de los centros de datos de Azure para alimentar la inferencia de modelos frontier, y Anthropic, socio de AMD desde un acuerdo revelado a principios de este año, desplegará hasta 2 gigavatios de GPUs de la serie Instinct MI450, con el primer gigavatio en funcionamiento en la primera mitad de 2027.
Sobre el hardware en sí: cada GPU MI455X lleva 432 GB de memoria HBM4 en 16 stacks, ofreciendo aproximadamente 19,6 TB/s de ancho de banda de memoria por chip. Un rack Helios completo incluye 72 aceleradores MI455X junto con CPUs EPYC Venice y el silicio de red Pensando Vulcano de AMD, agrupando 31 terabytes de memoria HBM4 y aproximadamente 1,4 petabytes por segundo de ancho de banda de memoria agregado. AMD califica un rack completo en 2,9 exaflops de cómputo de inferencia FP4 y 1,4 exaflops en precisión FP8 — cifras que la empresa presenta directamente contra los sistemas de rack NVL72 de Nvidia. Se ha informado que el precio de un rack Helios completamente configurado es de aproximadamente 5,25 millones de dólares. Los envíos a clientes, incluido Microsoft, comienzan en la segunda mitad de 2026.
EPYC Venice, la parte de CPU de la plataforma, es notable por sí mismo: es el primer chip de servidor x86 fabricado en el nodo de 2nm de TSMC, y llega mientras AMD afirma que ahora tiene el 46% de participación en los ingresos del mercado de CPU para servidores — una cifra que habría sido impensable para AMD hace una década, cuando Intel controlaba la abrumadora mayoría de los ingresos de CPU para centros de datos.
Su también utilizó la keynote para dimensionar la oportunidad que persigue AMD: proyectó el mercado total direccionable (TAM) de aceleradores de IA en 1,4 billones de dólares para 2030, el mercado de CPU para servidores en 220 mil millones de dólares en la misma fecha, y el TAM combinado de silicio — aceleradores, CPUs, redes e infraestructura relacionada — en aproximadamente 2 billones de dólares, con un crecimiento anual compuesto del 40%. Esas cifras son proyecciones propias de AMD y deben leerse tanto como una empresa argumentando a favor del precio de sus acciones como un pronóstico neutral del mercado, pero los compromisos de clientes anunciados junto a ellas son concretos, con nombre y fecha.
Para los compradores empresariales y los clientes de la nube, la conclusión práctica es que una alternativa creíble de AMD a los sistemas de rack de Nvidia ya se está enviando con el respaldo real de hiperescaladores, en lugar de existir solo como una diapositiva de hoja de ruta. Si esto afecta significativamente el poder de fijación de precios de Nvidia dependerá menos de la keynote del jueves que de si la pila de software ROCm de AMD — históricamente el eslabón más débil frente al ecosistema CUDA de Nvidia — puede mantener el ritmo del hardware que AMD ahora está enviando a escala.
Originally reported by AMD Newsroom. Read the original article for additional details.
View original source