Amazon apuesta por la IA generativa como su próxima gran transformación

Andy Jassy, consejero delegado de Amazon, ha dedicado buena parte de su carta anual a accionistas de 2023 a un solo tema, la inteligencia artificial generativa. Jassy la compara directamente con la llegada de internet y de la computación en la nube, y deja clara la apuesta de fondo, casi todo lo que Amazon construya de aquí en adelante para sus clientes empresariales pasará por AWS.

Los números del año acompañan el discurso. Amazon cerró 2023 con 575.000 millones de dólares de ingresos totales (un 12% más que en 2022), de los que AWS aportó 91.000 millones, un 13% más interanual. El beneficio operativo se disparó un 201%, hasta 36.900 millones, tras un año marcado por la optimización de costes en la nube.

Tres capas, una sola estrategia

Jassy organiza la apuesta de AWS en tres niveles. Abajo del todo está el cómputo para entrenar e inferir con modelos fundacionales, donde Amazon ha desarrollado sus propios chips Trainium2 e Inferentia2 para no depender solo de Nvidia, cuya oferta sigue siendo escasa y cara. Anthropic ya anunció que entrenará sus futuros modelos con estos chips, y a la lista de clientes se suman Airbnb, Hugging Face, Qualtrics, Ricoh y Snap. Amazon SageMaker completa esta capa como servicio gestionado para entrenar y desplegar modelos, con clientes como Perplexity AI (entrenamiento un 40% más rápido) o Workday (80% menos de latencia en inferencia).

La capa intermedia es Amazon Bedrock, el servicio que deja a una empresa coger un modelo ya entrenado, personalizarlo con sus propios datos y ponerlo en producción sin gestionar infraestructura. Bedrock ya suma decenas de miles de clientes activos apenas unos meses después de su lanzamiento, entre ellos Pfizer, Delta Air Lines, GoDaddy, Intuit o LexisNexis. Ofrece modelos propios (la familia Titan) y de terceros, entre ellos Claude 3, Llama 2 de Meta, Mistral, Stability AI y Cohere. La razón de tener tantos modelos a la vez es sencilla, según Jassy los clientes rara vez se conforman con uno solo, quieren poder cambiar de modelo o de tamaño según la aplicación sin reescribir toda su infraestructura.

Arriba queda la capa de aplicaciones, donde Amazon ya tiene productos propios en marcha, Rufus como asistente de compras dentro de la propia tienda, una Alexa reforzada con nuevos modelos y Amazon Q, un asistente para desarrolladores que escribe, depura y migra código (por ejemplo entre versiones antiguas y nuevas de Java) además de consultar fuentes internas como Slack, Salesforce o wikis corporativas.

Empresas primero, no aplicaciones de consumo

Jassy es explícito en un punto, Amazon no pretende competir modelo contra modelo con OpenAI o Google en aplicaciones de consumo masivo. Prefiere que la mayoría de las aplicaciones de IA generativa que corran sobre AWS las construyan otras empresas, y que Amazon gane vendiendo el cómputo, los chips y el servicio gestionado de por medio. Es una estrategia parecida a la que convirtió a AWS en el negocio más rentable de Amazon hace una década, vender la infraestructura en la que otros construyen, en lugar de competir directamente en cada categoría de producto.

Bedrock sigue evolucionando más rápido de lo que Jassy dejaba entrever en esta carta. AWS ha seguido añadiendo proveedores de inferencia externos a Bedrock, como la incorporación de Cerebras para acelerar la inferencia, en la misma línea de dar a los clientes más opciones de chip sin cambiar de API.

Preguntas frecuentes

¿Qué es Amazon Bedrock?

Es el servicio gestionado de AWS para construir aplicaciones de IA generativa a partir de modelos fundacionales ya entrenados, propios o de terceros, sin tener que gestionar la infraestructura de cómputo.

¿Qué modelos de terceros ofrece Bedrock?

Incluye Claude de Anthropic, Llama de Meta, Mistral, Stability AI y Cohere, además de la familia propia de Amazon, Titan.

¿Qué son los chips Trainium e Inferentia?

Son los chips propios de AWS para entrenar (Trainium) e inferir (Inferentia) con modelos de IA, pensados para reducir la dependencia de Nvidia y bajar el coste por tarea frente a alternativas equivalentes.

¿Amazon compite con OpenAI o Google en aplicaciones de consumo?

No es su prioridad. Amazon se centra en ofrecer la infraestructura y las herramientas para que otras empresas construyan sus propias aplicaciones de IA generativa sobre AWS.

¿Qué es Amazon Q?

Es el asistente de IA de AWS para desarrolladores, capaz de escribir, depurar y migrar código, y de consultar fuentes de datos internas de la empresa para responder preguntas y resumir información.

Scroll al inicio