Hugging Face y Google Cloud se alían por la IA abierta

Hugging Face y Google Cloud han sellado una alianza estratégica para acercar la inteligencia artificial de código abierto a más empresas. El acuerdo, anunciado el 2 de febrero de 2024, permite entrenar y desplegar modelos de Hugging Face directamente sobre la infraestructura de Google, desde Kubernetes Engine (GKE) hasta Vertex AI, la plataforma de machine learning gestionado de Google Cloud.

Dos gigantes del código abierto, un mismo objetivo

Google lleva años publicando investigación de IA en abierto, desde el Transformer original hasta el Vision Transformer, dos papers que sentaron las bases de buena parte de los modelos de lenguaje actuales. Hugging Face, por su parte, aloja más de un millón de modelos, conjuntos de datos y aplicaciones construidos sobre esa arquitectura. Juntar ambas piezas, según explican las dos compañías, debería acortar el camino entre un paper de investigación y una aplicación en producción.

TensorFlow y JAX como puente

Google ha construido buena parte de su reputación en código abierto con TensorFlow y JAX, dos frameworks que investigadores y científicos de datos usan a diario para entrenar sus propios modelos. La colaboración con Hugging Face acelerará que las novedades en IA lleguen a las bibliotecas de código abierto de la plataforma, sea cual sea el framework que use cada equipo.

Qué gana un cliente de Google Cloud

Cientos de miles de usuarios de Hugging Face ya usan Google Cloud cada mes para descargar modelos con los que construir aplicaciones de IA generativa. Con este acuerdo, el entrenamiento y el despliegue de esos modelos dentro de GKE y Vertex AI gana en fricción cero: menos pasos manuales, más integración nativa. A nivel de hardware, los clientes tendrán acceso a instancias TPU, a las VMs A3 con GPU NVIDIA H100 Tensor Core y a las VMs C3, montadas sobre CPU Intel Sapphire Rapids.

Y qué gana un usuario de Hugging Face Hub

Millones de investigadores, desarrolladores y aficionados a la IA usan Hugging Face Hub cada mes para experimentar con los modelos más recientes. A lo largo de 2024, esa comunidad podrá desplegar sus modelos en Google Cloud a través de Inference Endpoints y acelerar sus aplicaciones con TPU dentro de Hugging Face Spaces, sin salir del propio Hub.

Thomas Kurian, CEO de Google Cloud, y Clement Delangue, CEO de Hugging Face, coincidieron al presentar el acuerdo en que el objetivo compartido es que la IA generativa sea más fácil de usar para cualquier desarrollador, no solo para los equipos con presupuesto para infraestructura propia. Es una alianza que combina investigación abierta con la capacidad de cómputo de un proveedor cloud de primer nivel, algo que hasta ahora solo estaba al alcance de unos pocos.

El movimiento se enmarca en una tendencia que ya no trata la IA abierta como una opción barata, sino como una estrategia de negocio en toda regla. Otros fabricantes de hardware han seguido un camino parecido: es el caso de Qualcomm, que también se ha aliado con Hugging Face para llevar modelos abiertos del móvil al centro de datos. Google, mientras tanto, sigue ampliando su catálogo de modelos propios, como demuestran los últimos lanzamientos de Gemini en Google Cloud.

Preguntas frecuentes

¿Qué es Hugging Face Hub?

Es la plataforma donde Hugging Face aloja más de un millón de modelos, datasets y aplicaciones de IA, la mayoría basados en la arquitectura Transformer, y que investigadores y desarrolladores usan para entrenar o probar modelos sin montar su propia infraestructura desde cero.

¿Qué diferencia hay entre GKE y Vertex AI?

GKE (Google Kubernetes Engine) es el servicio de orquestación de contenedores de Google Cloud, pensado para desplegar cualquier carga de trabajo, incluida IA. Vertex AI es la plataforma específica de machine learning de Google, con herramientas para entrenar, ajustar y servir modelos sin gestionar la infraestructura subyacente.

¿Qué son las VMs A3 y C3 de Google Cloud?

Las VMs A3 incorporan GPU NVIDIA H100 Tensor Core, pensadas para entrenamiento e inferencia de modelos grandes. Las VMs C3 usan CPU Intel Sapphire Rapids y están orientadas a cargas de trabajo que no necesitan GPU pero sí mucho rendimiento por núcleo.

¿Necesito ser cliente de Google Cloud para usar Hugging Face?

No. Hugging Face Hub sigue siendo accesible de forma independiente. Lo que aporta esta alianza es una integración más directa para quien ya trabaja con Google Cloud y quiere entrenar o desplegar modelos de Hugging Face sin salir de esa infraestructura.

Imagen y noticia via: Hugging Face.

Scroll al inicio