Publicar

#HBMShortageBoostsAIChipPrices


Escasez de HBM y aumento del coste de los chips de IA: por qué el verdadero cuello de botella es la memoria

Cuando la gente habla del coste de la IA, la conversación suele empezar con la GPU. Ese es el lugar equivocado para empezar. En 2026, el componente más caro y menos flexible dentro de un acelerador de IA no es el die lógico situado en el centro del encapsulado, sino la memoria apilada encima. La memoria de alto ancho de banda, o HBM, ha pasado de ser una nota técnica a convertirse en la mayor limitación de toda la cadena de suministro de hardware de IA, y las cifras detrás de ese cambio son realmente extraordinarias.

La HBM está formada por dies de DRAM apilados verticalmente y conectados mediante vías de silicio, por lo que puede mover datos a velocidades que la memoria convencional no puede alcanzar. La plataforma Rubin de próxima generación de Nvidia incorpora hasta 288GB de HBM4, con un ancho de banda superior a 22 terabytes por segundo, y la MI450 de AMD llega aún más lejos, hasta 432GB. Nada más en el mundo de la memoria se acerca a esa combinación de capacidad y ancho de banda, y nada más puede sustituirla. Si un acelerador no tiene HBM, no se comercializa.

El problema es que la HBM no se puede simplemente pedir cuando aumenta la demanda. Producirla consume aproximadamente tres veces el área de oblea de la DRAM convencional para la misma cantidad de datos almacenados, y los costes de las obleas de HBM4 rondan entre 7000 y 8000 dólares, entre tres y cuatro veces los de la DRAM estándar. Cada generación también tiene una prima de precio sobre la anterior que TrendForce estima en más del 30%, porque las etapas de apilamiento y encapsulado avanzado son un verdadero cuello de botella de fabricación. Solo importan tres empresas en este mercado y, juntas, controlan aproximadamente el 64% de los ingresos mundiales de DRAM. Una de ellas ya había vendido toda su capacidad de 2026 antes incluso de que comenzara el año.

Ahí es donde se vuelve clara la mecánica de la escasez. Según TrendForce, la HBM representaba el 23% de la producción total de obleas de DRAM en abril de 2026, frente al 19% de 2025. Cada oblea que se destina a HBM es una oblea que deja de producir DDR5 para portátiles, teléfonos y servidores. Por tanto, la escasez de memoria convencional no es un accidente de la demanda; es una reasignación deliberada de capacidad escasa hacia el producto más rentable que haya fabricado la industria. Cuando rediriges las mejores líneas, los mejores ingenieros y los equipos más nuevos hacia un producto, todo lo demás se vuelve más escaso por definición.

Los datos de precios son lo que hace que esto deje de ser algo abstracto. En el primer trimestre de 2026, TrendForce revisó los precios contractuales de la DRAM convencional, que ya registraban un agresivo aumento intertrimestral del 55% al 60%, hasta un 90% a 95%, y algunas previsiones para la DRAM de PC llegaron hasta un 105% a 110% en un solo trimestre, lo que significa efectivamente que los precios se duplicaron en tres meses. Se preveía que la DRAM para servidores y móviles subiera entre un 88% y un 93%, la memoria flash NAND entre un 55% y un 60%, y las unidades SSD empresariales entre un 53% y un 58%. El segundo trimestre trajo otro aumento intertrimestral del 58% al 63% en los precios contractuales de la DRAM convencional, y actualmente se proyecta que el tercer trimestre registre otro incremento del 13% al 18%. Algunos analistas esperan otro 30% a 40% en el cuarto trimestre, lo que situaría el aumento anual total cerca del 90% al 100% o incluso por encima. Gartner ha proyectado un aumento del 47% en los precios de la DRAM para todo 2026 y un incremento de aproximadamente el 130% en los costes totales de memoria y almacenamiento para finales de año, sin un alivio real antes de finales de 2027.

La propia HBM es aún más extrema. Los precios de suministro de HBM3E aumentaron cerca de un 20% antes incluso de que comenzara 2026. Los precios al contado se han separado ahora de los precios contractuales de una forma casi inaudita en esta industria: un módulo HBM3E de 36GB que normalmente se negocia mediante contratos a largo plazo en el rango de 300 a 400 dólares ha llegado a cotizar cerca de 2100 dólares en el mercado al contado, una prima de cuatro a cinco veces. Se espera que las negociaciones de los contratos de HBM4 para 2027, que comenzaron en el segundo trimestre de 2026, produzcan aumentos medidos en múltiplos en lugar de porcentajes, y DigiTimes ha informado de que los precios de la HBM podrían más que duplicarse desde los niveles actuales para 2027.

El equilibrio entre la oferta y la demanda confirma hasta qué punto es realmente grave la situación. Las brechas proyectadas entre oferta y demanda para 2026 se sitúan en el 4,9% para la DRAM, el 4,2% para la NAND y el 5,1% para la HBM, el nivel más amplio desde 2011. Incluso bajo el supuesto de que el 70% de la nueva capacidad se redirija hacia la HBM, el déficit de HBM aún podría situarse entre el 50% y el 60%. Los inventarios cuentan la misma historia desde otro ángulo. Samsung y SK hynix, que juntas controlan aproximadamente el 64% de los ingresos mundiales de DRAM, vieron caer el inventario de memoria terminada por debajo de 10 días de suministro a principios de septiembre de 2026. Diez días. En un ciclo normal, un colchón medido en semanas de dos dígitos se considera saludable.

Ese coste ya está llegando al precio de los sistemas, no solo al de los componentes. Nvidia aumentó los precios de los servidores de IA en más del 15%, citando explícitamente la escasez de memoria, e Intel también elevó los precios de las CPU en más del 15%. Los plazos de entrega de la HBM4 y la DRAM avanzada se ampliaron de entre ocho y diez semanas a entre veinte y treinta semanas, y los pedidos sujetos únicamente a asignación se convirtieron en algo normal. Los precios del alquiler en la nube reflejan la misma presión, con una Nvidia B300 alquilándose por aproximadamente 9 dólares y 16 centavos por hora bajo demanda, que es la cifra que realmente importa para las startups y los investigadores que nunca compran hardware directamente.

Los consumidores también están pagando por ello, y esta es la parte que la mayoría nota primero. Un kit de memoria DDR5-6000 de 32GB que se vendía por entre 110 y 140 dólares hace un año se negociaba alrededor de 392 dólares en agosto de 2026, y los rastreadores informan de que los precios de la memoria para juegos han subido aproximadamente un 89%, con aumentos mucho más pronunciados en componentes concretos. El precio de lista del módulo DDR5 de 32GB de Samsung subió de 149 dólares a 239 dólares, un aumento del 60%. IDC proyecta que los precios de los PC, las tabletas y los smartphones subirán entre un 10% y un 20% para finales de 2026, TrendForce estima que los costes de fabricación de los portátiles convencionales aumentarán casi un 40%, las previsiones de producción de smartphones se han recortado hasta una caída del 7%, y los envíos de portátiles podrían caer un 10,1% interanual. Los fabricantes de dispositivos están respondiendo congelando las especificaciones, con teléfonos insignia limitados a 12GB de memoria simplemente para mantener los precios.

Mi propia lectura es que la escasez es estructural y no cíclica, y esa distinción importa enormemente. Los ciclos normales de la memoria se corrigen en un plazo de entre cuatro y ocho trimestres porque la capacidad inactiva vuelve a ponerse en funcionamiento y los precios bajan. Este caso es diferente por tres motivos. Las nuevas fábricas tardan entre dos y tres años en construirse y homologarse, por lo que la oferta no puede responder dentro del periodo en que la demanda se acelera. La transición de HBM3E a HBM4 consume aún más capacidad por bit, porque un mayor número de capas y un encapsulado más complejo reducen la producción efectiva. Y la estructura de incentivos mantiene activamente limitada la DRAM para consumidores, ya que los márgenes de la HBM son muy superiores a los de la DDR5 básica. Una escasez creada por una decisión de asignación no se resuelve de la misma manera que una escasez creada por una sorpresa de demanda.

Lo segundo que conviene entender es que el cuello de botella se ha desplazado. El rendimiento de la IA depende cada vez más de la memoria, lo que significa que una GPU con abundante capacidad de cálculo y ancho de banda insuficiente simplemente permanece inactiva esperando datos. Como la HBM es el factor limitante, lo que realmente determina cuántos aceleradores se fabrican en un año determinado es el suministro de memoria, no el de transistores. Por eso los precios de los chips de IA son, en gran medida, precios de memoria disfrazados. También explica por qué las empresas con una capacidad de fijación de precios reconocidamente sólida están trasladando los costes a los clientes: no pueden crear capacidad que no existe.

Sigue el dinero y el patrón resulta fácil de leer. Los fabricantes de memoria están registrando márgenes récord, los proveedores de aceleradores trasladan los costes hacia abajo, los hiperescaladores absorben parte del aumento y trasladan el resto a los clientes de la nube, y los consumidores afrontan lo que queda a través de portátiles, teléfonos y tarjetas gráficas, ya que la GDDR7 compite por las mismas líneas de encapsulado avanzado. Las empresas que salen ganando al otro lado son las que reducen la intensidad de memoria en sí misma mediante una mejor cuantización, la dispersión, silicio de inferencia más barato y una mayor eficiencia del software. Cada punto porcentual de ancho de banda ahorrado vale ahora más que hace dos años.

Para quienes siguen esto como una historia de mercado y no como una historia tecnológica, conviene vigilar algunos indicadores, y ninguno de ellos constituye asesoramiento de inversión. El progreso del rendimiento de la HBM4 es lo que más importa, ya que, según los informes, los rendimientos se acercan al 80% antes del aumento de producción de Rubin de Nvidia. El nivel de liquidación de los contratos de HBM para 2027 marcará el tono de toda la cadena. Saber si el aumento proyectado del 13% al 18% en la DRAM del tercer trimestre resulta ser el punto máximo o si el cuarto trimestre vuelve a acelerarse indicará si esto está tocando techo. Los días de inventario de Samsung y SK hynix, actualmente por debajo de diez, son la señal de alerta temprana más clara. La diferencia entre los precios al contado y los contractuales es la medida más honesta del estrés, porque una reducción de esa diferencia sería la primera señal auténtica de alivio. Y los anuncios de gasto de capital en fábricas importan, porque la capacidad comprometida en 2026 y 2027 es la que reajusta los precios en 2028.

Existe un contraargumento serio que merece espacio, porque el caso alcista de la escasez también contiene la semilla de su propia reversión. La memoria es la parte más cíclica de la cadena de semiconductores, y cada dólar de margen actual financia capacidad que llegará mañana. Si el crecimiento del gasto de capital en IA se desacelera aunque sea moderadamente, una gran cantidad de nuevas obleas comenzará a fabricarse al mismo tiempo en un mercado planificado durante una situación de pánico. La opinión de Gartner de que no habrá un alivio real hasta finales de 2027, y la advertencia de SK hynix de que la tensión podría prolongarse después de 2030, se sitúan en un extremo del espectro; el patrón histórico de los auges de la memoria, en los que la corrección es rápida y violenta, se sitúa en el otro. Mantener ambas posibilidades presentes es la única posición intelectualmente honesta.

Así que esta es la frase que vale la pena recordar, reducida a lo esencial: el suministro de HBM es limitado, la demanda de chips de IA sigue aumentando y esa combinación está elevando tanto los costes de producción como los precios de mercado en toda la cadena de hardware de IA. La conclusión más profunda es que la expansión de la IA está limitada ahora menos por las ideas, y aún menos por el diseño de chips, que por un componente del que la mayoría de la gente nunca había oído hablar hace tres años. Mientras la demanda de capacidad de cálculo para IA crezca más rápido de lo que se pueden añadir físicamente obleas de memoria, esa escasez seguirá apareciendo en el precio de todo lo que hay aguas abajo, desde los aceleradores de centros de datos hasta los portátiles colocados en las estanterías de las tiendas. El muro de la memoria ya no es una metáfora. Es una partida contable.
Ver original
Esta página puede contener contenido de terceros, que se proporciona únicamente con fines informativos (sin garantías ni declaraciones) y no debe considerarse como un respaldo por parte de Gate a las opiniones expresadas ni como asesoramiento financiero o profesional. Consulte el Descargo de responsabilidad para obtener más detalles.

  • 1

Añadir un comentario
Añadir un comentario

Comentar
Repanzul
hace 14 horas
Ese movimiento es una locura 🔥
0Ver original
Repanzul
hace 14 horas
¡Vamos! 🔥
0Ver original
Jiaa_Insights
hace un día
Primera revisión
¡Vamos con todo! 🔥
0Ver original