
La carrera de la inteligencia artificial ya no se juega solo en quién diseña el chip más potente. NVIDIA, el gigante que domina el mercado de aceleradores de IA, se ha topado con un problema mucho más terrenal: fabricar e integrar esos chips a la escala que promete.
Según un análisis de SemiAnalysis, la arquitectura Kyber NVL144 de NVIDIA sufre un retraso importante que la empuja hasta 2028. El diseño alternativo NVL72x2, además, se ha cancelado. NVIDIA no ha confirmado oficialmente ninguno de los dos datos, pero ambos apuntan a problemas de fondo en la cadena de suministro y en la propia arquitectura.
Kyber se presentó como la arquitectura que duplicaría el dominio NVLink por rack, permitiendo que hasta 144 GPU trabajen como un solo sistema de IA de nueva generación. El problema está en conseguir que todas esas GPU se comporten realmente como un sistema único, con la latencia baja y el ancho de banda necesarios, algo que se complica cuanto más se intenta escalar.
El análisis señala como principal obstáculo la fabricación fiable del PCB midplane, la pieza clave que interconecta todo el sistema. Manejar señales de alta velocidad en distancias tan cortas está resultando más difícil de lo previsto.
NVIDIA también ha revisado Rubin Ultra, reduciendo de cuatro a dos los compute dies por problemas de producción, un ajuste que podría notarse en el rendimiento aunque no necesariamente en su posición de mercado.
Estos tropiezos abren una ventana para la competencia. AMD prepara soluciones a escala rack con las Instinct MI500X y las CPU Verano para 2027, mientras Google avanza ya con la octava generación de sus TPU.
En paralelo, gana peso el debate sobre las interconexiones ópticas: las CPO son más eficientes pero complicadas de fabricar y empaquetar, mientras que las NPO, una solución intermedia, podrían ganar terreno si las CPO no llegan a tiempo a gran escala.
La pregunta de fondo es si NVIDIA podrá mantener su ventaja mientras resuelve cuestiones menos vistosas pero decisivas, como la fiabilidad, la eficiencia y la capacidad de producción de sus sistemas. Tener el mejor chip ya no basta: hay que ser capaz de convertirlo en un sistema que funcione a la escala que exige la IA.
Una arquitectura pensada para duplicar el dominio NVLink por rack y conectar hasta 144 GPU como un solo sistema de IA.
Según SemiAnalysis, el lanzamiento se retrasa hasta 2028, aunque NVIDIA no lo ha confirmado oficialmente.
Sobre todo por dificultades en fabricar de forma fiable el PCB midplane que interconecta el sistema a alta velocidad.
NVIDIA ha reducido de cuatro a dos los compute dies por problemas de producción.
AMD, con sus Instinct MI500X y CPU Verano previstas para 2027, y Google, que ya despliega su octava generación de TPU.
Otras noticias recientes sobre innovación y tecnología: la alianza entre wecity y PwC en financiación inmobiliaria y la alianza de baterías entre Kärcher y Stihl.
Más información y referencias en Revista Cloud.
