Nvidia presenta el GB200, con la arquitectura Blackwell

Jensen Huang, consejero delegado de Nvidia, presentó en marzo de 2024 la arquitectura de GPU Blackwell y el superchip GB200, la nueva generación de hardware que sustituye a Hopper (H100) como buque insignia de la compañía. La GPU Blackwell B200 integra 208.000 millones de transistores, casi el doble que su predecesora.

Qué cambia frente a Hopper

Nvidia asegura que Blackwell ofrece hasta 30 veces más rendimiento de inferencia que H100 en modelos de lenguaje grandes, con hasta 25 veces menos consumo energético. Para ponerlo en contexto, Huang citó el entrenamiento de un modelo del tamaño de GPT-4 (que sitúó en 1,8 billones de parámetros): con Hopper harían falta unos 8.000 chips y 15 megavatios durante 90 días, mientras que con 2.000 chips Blackwell el mismo entrenamiento se completaría en el mismo plazo con 4 megavatios.

La arquitectura incluye seis piezas nuevas: un motor transformador de segunda generación, NVLink de quinta generación para conectar hasta 576 GPU entre sí, un motor de fiabilidad y disponibilidad (RAS), funciones de seguridad para IA, un motor de descompresión y el propio chip B200. Combinadas, permiten entrenar e inferir en tiempo real modelos de hasta 10 billones de parámetros, muy por encima de lo que soportaba Hopper.

Quién va a usar Blackwell

Nvidia citó entre sus primeros clientes a Amazon Web Services, Dell Technologies, Google, Meta, Microsoft, OpenAI, Oracle, Tesla y xAI. Los productos basados en Blackwell llegan a través de socios de nube como AWS, Google Cloud, Microsoft Azure y Oracle Cloud Infrastructure, además de fabricantes de servidores. La compañía también integra Blackwell con NVIDIA AI Enterprise, su capa de software con microservicios NIM, frameworks y herramientas para desplegar IA en producción.

“La IA generativa es la tecnología que define nuestra época”, dijo Huang durante la presentación. “Blackwell es el motor que la impulsa”.

Disponibilidad

Nvidia anunció el despliegue de los primeros productos Blackwell para el resto de 2024, a través de los socios de nube ya mencionados. Un año después, la compañía ya trabajaba en la siguiente generación: GB300 Blackwell Ultra, que empresas como Anthropic y Microsoft ya usan en producción, mientras Nvidia sigue ampliando su visión de el centro de datos como fábrica de inteligencia.

Preguntas frecuentes

¿Cuántos transistores tiene la GPU Blackwell B200?

208.000 millones de transistores, casi el doble que la generación Hopper (H100).

¿En cuánto mejora Blackwell a Hopper?

Nvidia asegura hasta 30 veces más rendimiento de inferencia en modelos de lenguaje grandes, con hasta 25 veces menos consumo energético.

¿Qué empresas usarán Blackwell?

Nvidia citó a AWS, Dell, Google, Meta, Microsoft, OpenAI, Oracle, Tesla y xAI entre sus primeros clientes.

¿Qué es el GB200?

El GB200 Grace Blackwell Superchip combina dos GPU Blackwell B200 con una CPU Grace de Nvidia en un mismo módulo, pensado para entrenamiento e inferencia de modelos de gran escala.

¿Qué vino después de Blackwell?

Nvidia lanzó posteriormente Blackwell Ultra (GB300), ya en uso por compañías como Anthropic sobre infraestructura de Microsoft Azure.

Scroll al inicio