Claude Opus 5 se acerca a Fable 5 por la mitad de precio y reta a GPT-5.6

Anthropic ha presentado Claude Opus 5, un nuevo modelo orientado al trabajo profesional diario, la programación y los agentes capaces de completar tareas largas con menos supervisión. La compañía asegura que alcanza un rendimiento cercano al de su avanzado Claude Fable 5, pero con un coste notablemente inferior, y lo sitúa como su opción más potente para los usuarios de Claude Pro y el nuevo modelo predeterminado de Claude Max.

Las claves de Claude Opus 5 en 30 segundos

  • Anthropic sitúa Opus 5 cerca del rendimiento de Fable 5, pero con un coste aproximado por tarea un 50 % menor en algunas pruebas.
  • El modelo mejora en programación, automatización, uso del ordenador, análisis financiero y ciencias de la vida.
  • Su API cuesta 5 dólares por millón de tokens de entrada y 25 dólares por millón de salida.
  • Frente a GPT-5.6 Sol, resulta algo más barato en generación, aunque las comparaciones cambian según la prueba.
  • Mythos 5 continúa por delante en investigación biológica avanzada y ciberseguridad ofensiva.

La propuesta de Anthropic no consiste en reemplazar a Fable 5 como modelo de máxima capacidad. Opus 5 ocupa una posición intermedia: pretende acercar parte de esa inteligencia a tareas frecuentes sin asumir el precio y el consumo de recursos de un sistema pensado para proyectos de varios días.

Este enfoque resulta especialmente relevante para empresas que empiezan a desplegar agentes en producción. Un modelo puede obtener una puntuación elevada en una prueba aislada y, aun así, resultar demasiado caro o inestable cuando debe revisar cientos de documentos, modificar un repositorio completo o ejecutar herramientas durante horas. Anthropic sostiene que Opus 5 mejora precisamente en esa relación entre capacidad, coste y constancia.

Más autonomía para programar y completar tareas de principio a fin

Anthropic describe Opus 5 como un modelo más cuidadoso a la hora de comprobar su propio trabajo. En lugar de producir una primera respuesta y detenerse, puede examinar el resultado, detectar errores y repetir parte del proceso hasta alcanzar una solución válida.

En una evaluación de Frontier-Bench, el modelo recibió el dibujo de una pieza mecánica y tuvo que reconstruirla en FreeCAD sin acceso visual directo a la imagen. Según Anthropic, Opus 5 creó su propio sistema de visión por ordenador para extraer la geometría de los píxeles y generar después el modelo tridimensional. La compañía afirma que repitió el proceso con éxito, mientras que otros modelos no completaron la tarea en cinco intentos.

También se probaron tareas más cercanas al desarrollo cotidiano. En un paquete de software de código abierto, Opus 5 identificó la causa de un fallo y corrigió un caso límite que había quedado fuera de una solución anterior. En otro ensayo creó una fuente de datos para un mercado financiero y construyó un entorno de pruebas propio al no disponer de una conexión activa con la que validar el resultado.

Son ejemplos seleccionados por Anthropic y no equivalen a una auditoría independiente, pero muestran el tipo de uso que la empresa quiere asociar al modelo: depuración, cambios amplios en código, automatización y tareas que exigen mantener un objetivo durante muchos pasos.

comparativa opus 5 otros

La compañía asegura que Opus 5 supera a su predecesor en Frontier-Bench y que, en CursorBench 3.2 con el nivel máximo de esfuerzo, queda a solo un 0,5 % del mejor resultado de Fable 5, con aproximadamente la mitad del coste por tarea. También afirma que triplica al siguiente modelo en ARC-AGI 3 y que obtiene mejores resultados por coste en OSWorld 2.0, una prueba centrada en el uso de ordenadores. Estas cifras proceden de evaluaciones publicadas por la propia Anthropic y deben interpretarse dentro de la configuración empleada por la compañía.

Claude Opus 5 frente a GPT-5.6, Fable 5 y Mythos 5

La comparación más útil no consiste en buscar un ganador absoluto, porque los modelos se han diseñado para prioridades diferentes. GPT-5.6 Sol es el modelo principal de OpenAI para razonamiento, programación, ciencia, ciberseguridad, diseño y trabajo con herramientas. Claude Fable 5 está orientado a proyectos largos y agentes que pueden trabajar durante días. Mythos 5 se reserva para tareas científicas y de ciberseguridad de mayor sensibilidad, mientras que Opus 5 busca trasladar parte de esas capacidades a un uso más habitual.

ModeloEnfoque principalPrecio API por 1 millón de tokensPunto fuerte declarado
Claude Opus 5Programación, análisis y agentes cotidianos5 $ entrada / 25 $ salidaEquilibrio entre capacidad y coste
Claude Fable 5Proyectos complejos de larga duraciónSuperior a Opus 5Agentes que trabajan durante días
Claude Mythos 5Ciencia avanzada y ciberseguridadAcceso limitadoInvestigación y capacidades ofensivas
GPT-5.6 SolModelo general de máxima capacidad5 $ entrada / 30 $ salidaRazonamiento, ciencia, código y ciberseguridad
GPT-5.6 TerraAlternativa más económica2,50 $ entrada / 15 $ salidaRelación entre coste y rendimiento
GPT-5.6 LunaVelocidad y volumen1 $ entrada / 6 $ salidaAplicaciones sensibles al precio

Opus 5 y GPT-5.6 Sol comparten el mismo precio de entrada, 5 dólares por millón de tokens, pero Anthropic cobra 25 dólares por la salida frente a los 30 dólares de OpenAI. Esa diferencia puede resultar relevante en agentes que generan mucho código, documentos extensos o múltiples llamadas encadenadas. GPT-5.6 también ofrece Terra y Luna, dos variantes más baratas que cambian la comparación cuando la prioridad es reducir el coste por consulta.

En las pruebas publicadas por OpenAI, GPT-5.6 Sol obtiene un 52,7 % en Agents’ Last Exam, frente al 40,5 % de Fable 5 y el 45,2 % de Opus 4.8. En GDPval-AA v2, Fable 5 aparece ligeramente por delante de GPT-5.6 Sol, con 1.759,6 puntos Elo frente a 1.747,8. Opus 5 no figura en esa tabla porque fue presentado después, por lo que no existe todavía una comparación homogénea publicada por ambas empresas en ese conjunto de pruebas.

En programación tampoco hay una respuesta única. OpenAI sitúa a GPT-5.6 Sol en un 64,6 % en SWE-Bench Pro, mientras que Fable 5 alcanza el 80 %. Anthropic, por su parte, asegura que Opus 5 lidera Frontier-Bench y queda muy cerca de Fable 5 en CursorBench. El problema es que cada fabricante destaca pruebas, configuraciones y niveles de esfuerzo distintos, así que las cifras no deberían mezclarse como si procedieran de una única clasificación independiente.

Mejoras en ciencia, finanzas y creación visual

Opus 5 no se limita a la programación. Anthropic informa de mejoras en todas sus evaluaciones internas de ciencias de la vida frente a Opus 4.8. Entre ellas aparecen la biología estructural, la química orgánica y la bioinformática.

En una prueba sobre interpretación de espectros para deducir estructuras moleculares, la mejora alcanza 10,2 puntos porcentuales. En otra centrada en predecir cómo afectan las variaciones genéticas al funcionamiento de una proteína, la diferencia es de 7,7 puntos. Al tratarse de benchmarks internos, sirven para observar la evolución respecto al modelo anterior, pero no permiten concluir por sí solos que Opus 5 sea el mejor sistema científico del mercado.

Clientes que participaron en el acceso anticipado también informaron de avances en modelización financiera, revisión jurídica, análisis de datos, creación de presentaciones y desarrollo de interfaces. Box señala una mejora del 8 % sobre Opus 4.8 en su evaluación interna, con aumentos del 11 % en análisis de datos y del 17 % en trabajos de diligencia debida.

Anthropic también destaca una mejora en resultados visuales. Opus 5 puede revisar páginas en distintos tamaños de pantalla, detectar componentes ocultos o mal colocados y corregirlos antes de entregar el trabajo. Esta capacidad apunta a una tendencia cada vez más clara: los modelos ya no se valoran únicamente por escribir código, sino por comprobar cómo funciona el producto final.

Seguridad con menos bloqueos que Fable 5

Anthropic presenta Opus 5 como su modelo de uso general mejor alineado hasta la fecha. En su auditoría automatizada obtuvo una puntuación de 2,3 en comportamientos desalineados, inferior a la registrada por Opus 4.8, Sonnet 5 y Fable 5.

La compañía aclara, sin embargo, que Opus 5 no supera a Mythos 5 en biología avanzada ni en ciberseguridad ofensiva. Ambos pueden acercarse al identificar vulnerabilidades, pero Mythos 5 mantiene una ventaja importante cuando la tarea consiste en convertir esos fallos en exploits funcionales.

Opus 5 permite revisar código y localizar vulnerabilidades, pero bloquea determinadas actividades, entre ellas el análisis de binarios, las pruebas de penetración y la generación de exploits fuera de programas verificados. Anthropic estima que sus clasificadores intervendrán alrededor de un 85 % menos que los de Fable 5, lo que debería reducir los rechazos en trabajos defensivos legítimos.

Precio, disponibilidad y posición dentro de Claude

Claude Opus 5 ya está disponible en Claude.ai, Claude Code, Claude Cowork y la API. Se ha convertido en el modelo predeterminado de Claude Max y en la opción más potente incluida en Claude Pro.

Su precio se mantiene en 5 dólares por millón de tokens de entrada y 25 dólares por millón de salida, el mismo que Opus 4.8. La empresa también ofrece un modo rápido que funciona, según sus datos, alrededor de 2,5 veces más deprisa, aunque duplica el precio base.

La llegada de Opus 5 deja una familia de modelos más segmentada. Fable 5 conserva la posición superior para proyectos largos y complejos; Mythos 5 se dirige a usos científicos y de seguridad restringidos; Sonnet 5 cubre tareas de volumen, y Opus 5 intenta ocupar el espacio más competido: el de las empresas y profesionales que necesitan un modelo avanzado todos los días sin pagar continuamente por la capacidad más extrema.

Preguntas frecuentes

¿Claude Opus 5 es mejor que GPT-5.6?

No existe una respuesta general. Anthropic destaca el rendimiento de Opus 5 en programación agéntica, automatización y coste por tarea, mientras que OpenAI publica mejores resultados para GPT-5.6 en otras pruebas de razonamiento, ciencia y ciberseguridad.

¿Cuánto cuesta Claude Opus 5?

La API cuesta 5 dólares por millón de tokens de entrada y 25 dólares por millón de tokens de salida. El modo rápido duplica el precio.

¿Qué diferencia hay entre Opus 5 y Fable 5?

Fable 5 está pensado para proyectos de máxima complejidad y agentes que trabajan durante periodos prolongados. Opus 5 busca aproximarse a ese rendimiento con menor coste y mayor eficiencia para el uso cotidiano.

¿Claude Opus 5 está disponible en Claude Pro?

Sí. Anthropic lo presenta como el modelo más potente de Claude Pro y como la opción predeterminada para los suscriptores de Claude Max.

vía: anthropic

Scroll al inicio