Esta semana, durante el AI Infra Summit celebrado en el Centro de Convenciones de Santa Clara, se presentaron innovaciones significativas en el ámbito de la infraestructura para la inteligencia artificial. El evento, que ha visto un incremento considerable en su asistencia este año, pasando de 3,500 a más de 8,000 participantes, se ha consolidado como un referente en tecnología de infraestructura a gran escala.
Ian Buck, vicepresidente de computación de alto rendimiento y a gran escala de NVIDIA, presentó los avances en la eficiencia de las «fábricas de IA». Durante su intervención, Buck abordó nuevas colaboraciones con líderes del sector, como Amazon’s Annapurna Labs y d-Matrix, enfocándose en mejorar las capacidades de la memoria de alta velocidad NVHBM y la integración de sistemas con NVLink Fusion para ofrecer inferencias ultra rápidas a gran escala.
Además, los asistentes presenciaron la presentación de resultados innovadores de varias cooperaciones. Emerald AI, en conjunto con NVIDIA, reveló un programa de carga flexible para fábricas de IA que opera con Silicon Valley Power, mientras que Lambda mostró una mejora del 23% en el rendimiento por vatio gracias a la tecnología NVIDIA DSX MaxLPS.
Pinterest también destacó al implementar la plataforma NVIDIA Blackwell y el software de inferencia NVIDIA Dynamo para enriquecer su plataforma de descubrimiento visual mediante IA conversacional. Estas innovaciones responden a las necesidades crecientes de una nueva clase de cargas de trabajo impulsadas por IA agentic, que demandan más rendimiento, eficiencia y escalabilidad.
NVIDIA, por su parte, presenta una plataforma de fábrica de IA completa —desde sistemas Vera Rubin hasta software de inferencia Dynamo— asegurando una infraestructura escalable, segura y eficiente. Según Buck, la infraestructura desarrollada no solo es confiable, sino que está diseñada para perdurar, siendo un activo valioso para resolver problemas computacionales a nivel mundial.
La métrica del rendimiento se está desplazando de simplemente alcanzar picos de performance a generar la mayor cantidad de tokens validados por megavatio. La plataforma NVIDIA DSX MaxLPS promete entregar hasta 1.4 veces más tokens por megavatio gracias a la optimización energética de toda la fábrica, y NVLink facilita la unión de computación acelerada a gran escala en un sistema de alto rendimiento.
En este marco, el sistema NVIDIA Vera Rubin NVL72 ha establecido un nuevo estándar en el benchmark MLPerf Inference v6.1, superando significativamente a su predecesor, el GB300 NVL72, en eficiencia y escalabilidad. Dichos resultados subrayan la importancia de la innovación en software y su impacto en la economía de la inferencia de IA.
Con iniciativas como el programa de carga flexible de Emerald AI y los modelos de implementación optimizados para escalabilidad de NVIDIA, la infraestructura de IA está preparada para maximizar la producción de tokens y aumentar el valor que las empresas pueden obtener de cada megavatio de energía invertido. Los participantes del AI Infra Summit salieron del evento con una comprensión más profunda de cómo las tecnologías vanguardistas de NVIDIA están moldeando el futuro del procesamiento de IA a gran escala.
Fuente: Zona de blogs y prensa de Nvidia












