NVIDIA es una de las responsables de la actual crisis de memoria que está viviendo el planeta, propiciado por la absurda inversión en inteligencia artificial que se está haciendo y que no termino de entender de dónde sale el dinero. Bueno, como piensan algunos, si se necesita más que se imprima más, y es lo que están haciendo porque si todos pidieran la devolución de todo lo invertido el mundo colapsaría en nanosegundos. Ahora mismo la inversión en IA es dinero del Monopoly que no tiene valor real. Así que NVIDIA, que ha disparado a la estratosfera sus ingresos del Monopoly, está valorando capear la crisis de memoria que ha creado con versiones recortadas de la próximos Rubin Ultra.
Según NVIDIA, está valorando optimizaciones de las aceleradoras para distintos sectores, modificando su potencia de cómputo, conexiones de red o memoria, así que el rumor iniciado por The Information no es un rumor sino una realidad. Así que NVIDIA prepara versiones de 192 GB y 256 GB de VRAM para capear la escasez de chips de memoria, ya que TSMC aumenta su capacidad de producción de GPU para las aceleradoras de NVIDIA a mucha mayor velocidad de lo que los fabricantes de chips de memoria aumenta la suya.
Lo cual me lleva a que, como ya he dicho anteriormente, los responsables últimos de esta crisis son los fabricantes de memoria, ya que cancelaron hace un par de años sus planes de expansión para aumentar sus beneficios tras salir del último hundimiento. En sus cabezas sonaba estupendo pero no supieron valorar la demanda que iba a haber. O, seguramente, sí y les importó una mierda. El desastre que han provocado debería ser condenable con la guillotina, como lo debería ser que un político mintiera en su cargo, robara o malgestionara los recursos públicos. Mucha guillotina tendríamos que aplicar en España en todo el espectro político. Pero las élites, que no entienden de ideologías políticas, se mueven con otras normas, y los que pagamos el pato somos los de abajo.
Sea como sea, la idea de Rubin Ultra es que tenga 1 TB de memoria HBM4E, con cuatro chíplets de cómputo, y está pensado para que llegue el próximo año a las empresas de IA. Eso será un salto enorme para el entrenamiento y ejecución de modelos de IA, siguiendo el crecimiento exponencial que están experimentando. Así que, bueno, NVIDIA tiene margen para ofrecer versiones recortadas con menos VRAM simplemente para inferencia, donde la exigencia de VRAM es inferior. El caso es que NVIDIA empieza a tene mucha capacidad de producción de GPU, pero los fabicantes de DRAM no le siguen el ritmo.
Vía: Tom's Hardware.