
En este artículo (4)
Retraso de Kyber NVL144 2028: análisis del cuello de botella de PCB
Puntos Clave
- Presta atención a la fabricabilidad de los racks, no solo a las especificaciones de las GPU, al planificar la capacidad de IA.
- Trata los retrasos informados por analistas como señales de riesgo hasta que Nvidia proporcione orientación oficial.
- Pregunta a los proveedores sobre el rendimiento de fabricación del midplane, el calendario de volumen de racks y la facilidad de servicio antes de cerrar los planes del clúster.
El deslizamiento de rack reportado centra la atención no en las especificaciones de la GPU, sino en la física persistente de construir un midplane Vera Rubin Ultra a escala.
El deslizamiento de rack informado desvía la atención de las especificaciones de las GPU hacia la física obstinada de construir un midplane Vera Rubin Ultra a gran escala.
En algún punto entre el render del escenario y el muelle de carga hay una placa de circuito con la personalidad de una bóveda bancaria. CNBC informa que SemiAnalysis dice que el sistema de rack de IA Kyber NVL144 de Nvidia se ha retrasado hasta 2028 debido a problemas de fabricación. Eso no es solo un problema de calendario, es un problema de capa física con una insignia de hoja de ruta. Hablemos de lo que no recibió el foco de la presentación principal: el rack ahora forma parte de la computadora. Cuando la estructura de interconexión pasa de ser un conjunto de compromisos tolerables a convertirse en un midplane especializado, cada vía, capa, conector y tolerancia de ensamblaje tiene voto. La GPU puede ser el ladrón de joyas de la película, pero la PCB es el túnel de escape, y si el túnel se derrumba, nadie cobra.
Inspección externa: el retraso trata realmente del rack CNBC atribuyó el
retraso reportado de Kyber NVL144 a SemiAnalysis, que dijo que el sistema se ha deslizado hasta 2028 por problemas de fabricación. Bloomberg también informó que las acciones tecnológicas asiáticas cayeron después de que un informe dijera que el sistema de rack de servidores de IA de Nvidia se había retrasado más de un año debido a dificultades de fabricación. La reacción del mercado no es la historia de ingeniería, pero es una señal útil: proveedores y compradores entienden que un retraso en un rack puede propagarse por los planes de capacidad antes de que cambie un solo benchmark. El matiz importante es que esto sigue siendo información reportada por analistas. Let’s Data Science señala que Nvidia no respondió a la solicitud de comentarios de CNBC, así que los equipos de infraestructura deberían tratar los detalles como señales de planificación, no como guía oficial del proveedor. Esa distinción importa, porque un plan de compras construido sobre rumores es una casa cableada con cable de altavoz. Útil en un apuro, aterradora bajo carga.
Diseño interno: el midplane es el jefe oculto AI Weekly describe
el cuello de botella como un midplane de PCB multicapa especializado vinculado al rack Kyber NVL144. Let’s Data Science también dice que el midplane de PCB especializado sigue siendo difícil de fabricar, y plantea el problema práctico como una cuestión de calendario de capacidad para equipos ligados a las hojas de ruta de Rubin Ultra. Esa es la especificación enterrada que lo cambia todo: el componente limitante no es necesariamente el chip de GPU, puede ser la placa que permite que el rack se comporte como una sola máquina. Un midplane a esta escala no es solo una losa pasiva de fibra de vidrio pasando un día tranquilo. Es control de tráfico, columna estructural, autopista de señales y apretón de manos mecánico, todo laminado junto como una lasaña diseñada por personas que tienen analizadores vectoriales de redes. Añade más capas y un enrutamiento más denso, y el problema de fábrica pasa a tratarse menos de dibujar el circuito ideal y más de construirlo una y otra vez con un rendimiento aceptable. Eso es fabricabilidad, y es donde la arquitectura hermosa va a negociar con cobre, resina, perforación, metalizado, deformación y tiempo de prueba.
Pistas de fallo: otras ideas
de rack sienten la misma gravedad Let’s Data Science informa que SemiAnalysis dijo que la arquitectura de rack espalda con espalda NVL72x2 de Nvidia fue cancelada. El mismo informe de Let’s Data Science dice que NVL576 podría retrasarse o limitarse a volúmenes pequeños. Son nombres distintos en la hoja de ruta, pero riman eléctricamente: a medida que los sistemas de IA escalan hacia afuera, la parte difícil deja de ser que un chip sea impresionante y pasa a ser que muchas cosas caras se comuniquen de forma fiable dentro de un rack que pueda mantenerse y enviarse. Bloomberg informó que SemiAnalysis señaló contratiempos en la construcción de placas de circuito impreso para Kyber NVL144. Esa frase debería hacer que todo planificador de centros de datos se siente un poco más recto. Las placas de circuito impreso suenan aburridas hasta que se convierten en la restricción entre una orden de compra y cómputo utilizable; en ese momento, se convierten en el portero fuera del club nocturno del aprendizaje automático. La lección no es que la arquitectura de Nvidia esté condenada, sino que la IA a escala de rack ahora está limitada por las mismas viejas leyes con las que los ingenieros eléctricos han vivido siempre: integridad de señal, rutas térmicas, tolerancias mecánicas y rendimiento de fabricación.
Desmontaje para compradores: qué planificar antes de que lleguen las placas
Let’s Data Science expone claramente el impacto para los compradores: el problema operativo es el calendario de capacidad, porque los racks ligados a las hojas de ruta de Rubin Ultra pueden llegar más tarde o en volúmenes menores de lo que algunos planes de compra asumían. Para quienes construyen clústeres, eso significa que la pregunta más inteligente no es solo qué generación de GPU gana en una gráfica. Pregunta qué arquitectura de rack es realmente fabricable, qué dependencias se encuentran en el midplane, qué supuestos de instalación cambian si los volúmenes están limitados y cuánto margen de calendario pueden absorber tus planes de refrigeración, energía y redes. El informe de CNBC hace que Kyber NVL144 parezca una historia de hoja de ruta de racks, pero la mirada de desmontaje la convierte en una historia de fabricación. La próxima ficha técnica útil quizá no sea la que tenga el número de cómputo más alto, sino la que demuestre discretamente que el apilado de placas puede fabricarse, probarse, enviarse y recibir mantenimiento sin convertir la cadena de suministro en la escena de un crimen. Estate atento a la guía oficial de Nvidia, a las señales de capacidad de los proveedores y a cualquier divulgación que aclare el camino de diseño del midplane. El futuro de la infraestructura de IA seguirá estando moldeado por las GPU, pero el rack, la placa y la planta de fabricación son ahora coautores.