La crisis de la RAM tiene su origen en las aceleradoras, y específicamente las de entrenamiento de modelos de IA usan memoria de alto ancho de banda (HBM). Son chips que se encapsulan con la GPU, apilados en decenas de gigas, y ahora mismo una GPU se puede encapsular con más de 300 GB de HBM. Mucha memoria para una sola GPU. Así que, según los últimos estudios, NVIDIA ya tiene reservada el 37.3 % de la producción de HBM del próximo año.

Curiosamente, Alphabet (Google) acaparará el 36 % de la producción de HBM, mientras que AMD se quedará en el 12.1 %. Para esta última será un fuerte aumento, porque realmente no pintaba mucho hace dos años en el sector de las aceleradoras. Pero ahora mismo se está comprando todo lo que se produce, y AMD ha conseguido aumentar sustancialmente la producción de sus GPU para entrenamiento y por tanto necesita mucha más HBM.

Quien no pinta nada es Intel, porque está englobada en el apartado de «Otros» del informe de Inference., el cual supone el restante 14.6 % de la producción de HBM. Esta HBM está en máximos de márgenes de beneficio para Micron, SK Hynix y Samsung, en torno al 75 %, y subiendo. El problema en la práctica es que se ha movido mucha producción de DRAM y GDDR a la HBM, lo cual explica cosas como que no se prevea la renovación de tarjetas gráficas GeForce y Radeon, o el disparatado precio que están alcanzando los módulos de RAM. El valor de lo reservado por NVIDIA es de 267 000 M$, por lo que la producción de HBM va a mover el próximo año unos 725 000 M$. La IA no es una burbuja, y si no lo fuera y pinchara, la economía occidental se desmoronaría. En esas estamos, y solo llevamos cuatro años de inteligencia artificial generativa.

Vía: TechPowerUp.