Cómo Las GPUs De NVIDIA Aceleran GPT-6 Astra De OpenAI A Gran Velocidad

How NVIDIA GPUs Help Accelerate OpenAI’s GPT-6 Astra Ultrafast

OpenAI ha anunciado el lanzamiento de GPT-6 Astra Ultrafast, un avance significativo en su línea de modelos de inteligencia artificial, ahora potenciados por las GPU de la arquitectura NVIDIA Blackwell. Este nuevo modelo ya está disponible para los usuarios de la API de OpenAI, incluyendo aquellos con acceso a ChatGPT Work y Codex, prometiendo una velocidad de generación de tokens hasta ocho veces más rápida que su predecesor, el Astra Standard.

La aceleración de este modelo se debe a las optimizaciones de inferencia desarrolladas por OpenAI, que explotan al máximo las capacidades de las GPU Blackwell de NVIDIA. Esto no solo acorta los ciclos de edición, prueba y depuración de los agentes de codificación, sino que también reduce el tiempo de generación de respuestas entre llamadas de herramientas, haciendo que las aplicaciones interactivas sean más ágiles y receptivas. Este aumento en la velocidad es crucial en flujos de trabajo donde se requiere repetidamente la generación de respuestas rápidas, como al escribir código, utilizar herramientas, verificar resultados y tomar decisiones sobre los pasos a seguir.

Philippe Tillet, líder de inferencia en OpenAI, destacó el papel clave que ha jugado la inversión de NVIDIA en herramientas y documentación. Gracias a ello, OpenAI ha logrado que sus modelos sean excepcionalmente eficaces al programar sobre las GPU Blackwell y Rubin. «Astra puede convertir ese conocimiento en núcleos de alto rendimiento que hacen que el hardware de NVIDIA sea atractivo en todo el espectro de latencia, rendimiento y costo», aseguró Tillet. «Con Astra Ultrafast, eso significa respuestas de modelo más rápidas a medida que los agentes escriben código, usan herramientas y trabajan en tareas complejas».

Pero la mejora del rendimiento no se detiene ahí. OpenAI está utilizando sus propios modelos para afinar el software de inferencia que corre sobre las GPU de NVIDIA, aprovechando la capacidad de programación de la plataforma para probar e implementar mejoras continuamente. Esta colaboración parece estar transformando la infraestructura desplegada, haciéndola más productiva con el tiempo.

Uday Ruddarraju, director de tecnología de cómputo en OpenAI, afirmó: «Nuestro trabajo con NVIDIA nos está ayudando a hacer que la IA sea más rápida y útil. Utilizamos nuestros modelos internos para optimizar la inferencia en las GPUs de NVIDIA, y la capacidad de programación de NVIDIA nos permitió ofrecer la aceleración detrás de Astra Ultrafast».

A través de la plataforma programable de NVIDIA, los desarrolladores y los investigadores tienen la posibilidad de reutilizar la infraestructura para entrenamiento, inferencia y aprendizaje por refuerzo a medida que los modelos evolucionan. Esta flexibilidad es valiosa para adaptar los recursos de cómputo conforme cambia la demanda, mejorando la utilización y evitando la sobreprovisión para cada carga de trabajo.

A partir de hoy, los desarrolladores pueden acceder a GPT-6 Astra Ultrafast a través de la API, con detalles de acceso, precios e implementación disponibles en la guía de Ultrafast de OpenAI. Este lanzamiento marca un paso importante hacia un futuro de IA cada vez más rápida y adaptable.
Fuente: Zona de blogs y prensa de Nvidia

Scroll al inicio