NVIDIA ha dado un paso significativo hacia el futuro de la inteligencia artificial al presentar la última expansión de su tecnología NVLink Fusion con la incorporación de NVHBM, una memoria de alto ancho de banda de nueva generación. Esta innovación tiene como objetivo ayudar a los hiperescaladores y a los pioneros de la inteligencia artificial a construir la próxima generación de infraestructura semi-personalizada para IA.
En un contexto donde los agentes de IA y las cargas de trabajo de billones de parámetros son cada vez más comunes, la demanda de infraestructura se intensifica. La infraestructura de IA debe funcionar como un sistema unificado que integra cómputo, memoria, almacenamiento, redes y software. NVHBM se presenta como una solución que promete hasta un 30% más de ancho de banda de memoria, un 15% menos de consumo de energía y un 25% más de área disponible en el dado de cómputo de XPU en comparación con las arquitecturas tradicionales de HBM4E.
El enfoque de NVIDIA elimina la necesidad de situar el controlador de memoria en el dado de XPU y lo integra directamente en la base de HBM. La NVHBM no solo mejorará el rendimiento de la memoria, sino que también facilitará el proceso de ingeniería al establecer un estándar disponible desde múltiples proveedores de memoria. Esto permitirá a los clientes de NVLink Fusion traer chips de inteligencia artificial personalizados al mercado de manera más rápida.
Una colaboración destacada en este esfuerzo es la de Amazon, a través de su laboratorio Annapurna Labs, que será el primero en trabajar con la tecnología NVHBM como parte de su asociación ampliada con NVIDIA. Annapurna Labs integrará NVLink Fusion con sus futuros chips Trainium, comenzando con Trainium4, lo que permitirá que los chips de Amazon y las GPU de NVIDIA funcionen conjuntamente en una arquitectura común a escala de rack.
La arquitectura NVLink Fusion de NVIDIA se describe como «verticalmente integrada y horizontalmente abierta». Esto significa que permite a los socios conectar XPU y CPU personalizadas a la plataforma a escala de rack de NVIDIA, accediendo a un ecosistema amplio de socios de CPU, diseñadores de ASIC, fabricantes de sistemas y proveedores de tecnología.
La propuesta de NVLink Fusion busca ofrecer a las empresas nativas de IA y a los hiperescaladores un camino más rápido y con menos riesgos para desplegar una infraestructura de IA semi-personalizada, enfocando los recursos de ingeniería en la innovación de XPU mientras se utiliza una pila tecnológica probada para redes de escalado, sistemas en rack y software.
Con este avance, NVIDIA reafirma su posición como líder en el desarrollo de tecnologías fundamentales para la nueva ola de inteligencia artificial, proporcionando las herramientas necesarias para potenciar la próxima generación de aplicaciones de IA a gran escala.
Fuente: Zona de blogs y prensa de Nvidia











