Anthropic presenta Claude 3, su respuesta a GPT-4 y Gemini

Anthropic presentó la familia Claude 3, formada por tres modelos pensados para clientes empresariales con distinto equilibrio entre inteligencia, velocidad y coste. El modelo tope de gama, Opus, fue presentado por la propia compañía como superior a cualquier otro sistema de IA disponible públicamente en ese momento, por delante de los modelos de referencia de OpenAI y Google.

Según los datos publicados por Anthropic, Opus lideraba benchmarks académicos como GSM-8k, centrado en razonamiento matemático, y MMLU, que mide conocimiento a nivel experto en múltiples materias, igualando o superando a las alternativas más fuertes del mercado en esas pruebas.

Tres modelos para tres necesidades distintas

Junto a Opus llegó Sonnet, pensado como opción de rango medio para análisis de datos y trabajo de conocimiento habitual sin pagar el precio del modelo insignia, y Haiku, la variante más rápida y barata, orientada a chatbots de cara al consumidor donde la latencia y el coste pesan más que la potencia bruta. Es la misma lógica de tres niveles (modelo grande, medio y ligero) que Anthropic ha mantenido en generaciones posteriores.

La serie Claude 3 también incorporó entrada de imágenes, con capacidades de visión por computadora que permitían extraer texto y datos de documentos, gráficos y diagramas, algo especialmente demandado por empresas que necesitaban digitalizar procesos con papeleo.

El debate sobre sesgo, en plena efervescencia

El lanzamiento llegó justo después de la polémica por Gemini de Google, que tuvo que desactivar temporalmente la generación de imágenes de personas tras las críticas por cómo el modelo gestionaba la diversidad racial en sus resultados. Anthropic aprovechó el contexto para explicar su propia estrategia frente al sesgo, el enfoque de IA Constitucional, que alinea el comportamiento del modelo con una serie de principios escritos de antemano en lugar de dejarlo a criterio de cada revisor humano.

La propia compañía describió dirigir el comportamiento de un modelo de IA como «una ciencia inexacta» y reconoció que lograr un sistema completamente libre de sesgo no era algo alcanzable con las técnicas de entonces, aunque se comprometió a seguir evaluando y mitigando esos riesgos.

Con el tiempo, Anthropic ha ido mucho más allá de aquella primera familia Claude 3, hasta el punto de que hoy Claude ya no funciona solo como un chat, sino como una plataforma que separa pensar, delegar tareas a agentes y construir aplicaciones completas. Aquel lanzamiento de marzo de 2024 marcó el punto de partida de una carrera de versiones que no ha dejado de acelerarse desde entonces.

Preguntas frecuentes

¿Qué modelos formaban la familia Claude 3?

Tres: Opus (el más potente), Sonnet (equilibrio entre coste y capacidad) y Haiku (el más rápido y barato, pensado para chatbots de consumo).

¿En qué benchmarks destacaba Claude 3 Opus?

En GSM-8k (razonamiento matemático) y MMLU (conocimiento experto multidisciplinar), donde Anthropic afirmaba igualar o superar a los modelos líderes de OpenAI y Google en el momento del lanzamiento.

¿Qué es la IA Constitucional de Anthropic?

Un enfoque que alinea el comportamiento del modelo con un conjunto de principios escritos de antemano, en lugar de depender únicamente del criterio de revisores humanos caso por caso.

¿Qué novedad de visión incorporó Claude 3?

Entrada de imágenes con capacidades de visión por computadora, para extraer texto y datos de documentos, gráficos y diagramas.

Scroll al inicio