La memoria, no el cómputo, es ahora el verdadero límite de la velocidad de los chips de IA

Durante los últimos años, la conversación sobre hardware de IA ha girado en torno al cómputo de las GPU. Ese enfoque ya está desactualizado. La restricción real sobre la velocidad de construcción de la próxima generación de aceleradores de IA es la Memoria de Alto Ancho de Banda (HBM) — y todos los principales fabricantes de memoria dicen a sus clientes que la escasez no es un problema de 2026, sino de varios años.
El muro de memoria, en términos concretos
Los aceleradores de IA modernos pueden procesar datos mucho más rápido de lo que la memoria convencional puede suministrarlos. Esta brecha — el «muro de memoria» — significa que el rendimiento de cómputo bruto deja de importar en cuanto un chip se queda sin datos. HBM resuelve esto con una arquitectura fundamentalmente diferente: en lugar de un chip de memoria junto al procesador, HBM apila los dados de memoria verticalmente y los conecta al procesador mediante miles de vías a través del silicio (TSV).
Ese apilamiento 3D es exactamente por qué HBM es difícil de fabricar. Las estimaciones de la industria sugieren que cada chip de memoria de grado IA producido consume capacidad de fábrica que podría fabricar aproximadamente tres chips de memoria de PC ordinarios.
Dónde está realmente la producción de HBM4
Samsung, SK Hynix y Micron han comenzado a enviar muestras de HBM4 a Nvidia, y las tres apuntan a producción en masa desde finales de 2026. SK Hynix posee actualmente alrededor del 56.4% de la cuota de ingresos de HBM a partir del primer trimestre de 2026.
La parte preocupante no es el cronograma de escalado en sí — SK Hynix ha advertido públicamente que la escasez más amplia de memoria podría persistir más allá de 2030.
Por qué esto cambia la hoja de ruta del hardware de IA
Cuando la lógica de GPU era el cuello de botella, el camino era sencillo: mejores nodos de proceso, más transistores, relojes más rápidos. El ancho de banda de memoria no escala de la misma manera. Hay un efecto secundario que vale la pena vigilar: cada oblea de capacidad de fábrica dedicada a HBM es una oblea que no fabrica DRAM estándar para laptops, teléfonos y PC.
Qué observar a continuación
La señal a seguir no es la fecha de anuncio de producción en masa, sino las tasas de rendimiento en las pilas de HBM4 a medida que escalan más allá de las configuraciones de 12 capas.