Claude Opus 5 quiere ser el modelo de IA que las empresas usen cada día

Anthropic ha presentado Claude Opus 5, un modelo pensado para ocupar el espacio entre los asistentes generalistas y los sistemas de máxima capacidad reservados para los trabajos más complejos. La compañía asegura que puede acercarse al rendimiento de Claude Fable 5 en programación, automatización y análisis profesional, pero con un coste por tarea mucho menor. El nuevo modelo ya está disponible y pasa a ser la opción más avanzada de Claude Pro y la predeterminada de Claude Max.

Las claves de Claude Opus 5 en 20 segundos

  • Opus 5 mejora en programación, automatización, análisis científico y uso autónomo del ordenador.
  • Anthropic afirma que se acerca a Fable 5 con aproximadamente la mitad del coste por tarea en algunas pruebas.
  • La API mantiene el precio de Opus 4.8: 5 dólares por millón de tokens de entrada y 25 dólares por millón de salida.
  • Frente a GPT-5.6 Sol, resulta más barato al generar respuestas, aunque cada modelo destaca en evaluaciones diferentes.

La estrategia de Anthropic resulta fácil de entender. Fable 5 conserva la posición de modelo más avanzado para proyectos que pueden prolongarse durante días, mientras que Opus 5 se dirige a desarrolladores, analistas y equipos que necesitan ejecutar trabajos complejos de forma habitual. No pretende ganar únicamente una tabla de benchmarks, sino ofrecer suficiente capacidad para utilizar agentes de IA en producción sin que cada tarea consuma el presupuesto reservado a los modelos de frontera.

Un modelo que comprueba su trabajo antes de darlo por terminado

La principal promesa de Claude Opus 5 no consiste simplemente en responder mejor. Anthropic asegura que el modelo muestra más iniciativa para revisar sus resultados, detectar errores y repetir pasos cuando la primera solución no funciona.

La compañía aporta varios ejemplos procedentes de sus pruebas y del acceso anticipado. En una tarea de Frontier-Bench, Opus 5 recibió el dibujo de una pieza mecánica que debía reconstruir mediante FreeCAD. Como no podía consultar directamente la imagen, creó un pequeño sistema de visión por ordenador para extraer su geometría desde los píxeles y generar después el modelo tridimensional.

En otra prueba analizó un fallo real de un gestor de paquetes de código abierto. Según Anthropic, no se limitó a corregir el síntoma visible, sino que localizó la causa y resolvió también un caso límite que había pasado inadvertido en una solución anterior. Un ingeniero de una firma financiera lo utilizó además para construir una fuente de datos de mercado y el modelo creó su propio entorno de pruebas al no encontrar una conexión activa con la que validar el código.

Estos casos han sido seleccionados por Anthropic y no sustituyen una evaluación externa, pero explican bien el cambio que está intentando vender la compañía. Opus 5 se plantea como un sistema capaz de mantener el objetivo durante una tarea prolongada, manejar herramientas y verificar el resultado, no como un chatbot que entrega código sin comprobar si funciona.

La mejora aparece especialmente en programación. Anthropic afirma que Opus 5 supera al resto de modelos evaluados en Frontier-Bench v0.1 y más que duplica el rendimiento de Opus 4.8 con un coste inferior por tarea. En CursorBench 3.2, con el nivel máximo de esfuerzo, queda a un 0,5 % del resultado máximo de Fable 5, pero consume aproximadamente la mitad del presupuesto.

comparativa opus 5 otros

El usuario puede ajustar ese nivel de esfuerzo para elegir entre más razonamiento o una respuesta más rápida y económica. Esa posibilidad tiene interés en entornos empresariales, donde no todas las tareas justifican utilizar la configuración más exigente.

Claude Opus 5 frente a GPT-5.6: dos maneras de ordenar la gama

Anthropic y OpenAI han llegado a una conclusión parecida: un único modelo ya no puede cubrir de manera eficiente todos los trabajos. Ambas compañías han dividido sus catálogos en varios niveles de capacidad, velocidad y precio.

Opus 5 se presenta como el modelo avanzado para uso diario de Anthropic, por debajo de Fable 5 en los proyectos de mayor exigencia y de Mythos 5 en determinadas capacidades científicas y de ciberseguridad. OpenAI sigue una estructura distinta con la familia GPT-5.6: Sol ocupa la gama superior, Terra busca un equilibrio entre capacidad y precio, y Luna prioriza velocidad y costes bajos.

ModeloPosición en su catálogoPrecio por 1 millón de tokensEnfoque declarado
Claude Opus 5Modelo avanzado de uso cotidiano5 $ entrada / 25 $ salidaCódigo, análisis y agentes profesionales
Claude Fable 5Frontera de AnthropicNo detallado en el anuncioProyectos largos y máxima capacidad
Claude Mythos 5Modelo especializadoAcceso restringidoCiencia avanzada y ciberseguridad
GPT-5.6 SolModelo insignia de OpenAI5 $ entrada / 30 $ salidaTrabajo agéntico de alta exigencia
GPT-5.6 TerraOpción equilibrada2,50 $ entrada / 15 $ salidaUso profesional con menor coste
GPT-5.6 LunaOpción rápida y económica1 $ entrada / 6 $ salidaAlto volumen y baja latencia

Los precios estándar publicados por OpenAI sitúan GPT-5.6 Sol en 5 dólares por millón de tokens de entrada y 30 dólares por millón de salida. Opus 5 iguala el coste de entrada, pero reduce el de salida a 25 dólares. Terra y Luna son considerablemente más baratos, aunque también ocupan niveles diferentes dentro de la gama GPT-5.6.

Esta diferencia puede parecer pequeña por consulta, pero aumenta cuando un agente genera grandes cantidades de código, revisa documentos extensos o encadena decenas de llamadas. Aun así, el coste real no depende únicamente de la tarifa por token. También influyen la cantidad de intentos necesarios, el uso de herramientas, la longitud del razonamiento y la frecuencia con la que el modelo debe corregirse.

Ahí reside precisamente la tesis comercial de Anthropic: un modelo algo más caro por token puede resultar más económico por trabajo terminado si necesita menos pasos, comete menos errores y alcanza el objetivo con menor supervisión.

No existe por ahora una comparación independiente y homogénea que permita afirmar que Opus 5 supera en general a GPT-5.6. Anthropic destaca Frontier-Bench, CursorBench, ARC-AGI 3, AutomationBench y OSWorld 2.0, mientras que OpenAI publica sus propios conjuntos de evaluación para GPT-5.6. Las diferencias de configuración, herramientas y niveles de razonamiento impiden mezclar las puntuaciones como si procedieran de una única prueba.

Automatización, ciencia y trabajo profesional más allá del código

Anthropic también ha orientado Opus 5 hacia tareas empresariales que requieren combinar razonamiento con herramientas. En Zapier AutomationBench, una prueba que mide la capacidad para completar procesos de negocio de principio a fin, la compañía asegura que su tasa de éxito es aproximadamente 1,5 veces superior a la del siguiente modelo por el mismo coste.

Uno de los casos compartidos por Zapier consistió en analizar una hoja de cálculo sobre la salud de varias cuentas, localizar clientes con riesgo de abandono, alertar al responsable correspondiente y generar un resumen para el equipo de retención. Según la empresa, Opus 5 completó todo el flujo, mientras que versiones anteriores no lograron terminarlo.

También aparecen mejoras en análisis financiero, documentación jurídica y revisión de grandes repositorios. Box afirma que Opus 5 superó a Opus 4.8 en un 8 % dentro de sus evaluaciones internas, con aumentos del 11 % en análisis de datos y del 17 % en diligencia debida. Otros participantes en el acceso anticipado destacan menos turnos, menos llamadas a herramientas y una mayor estabilidad entre ejecuciones.

En ciencias de la vida, Anthropic comunica avances frente a Opus 4.8 en biología estructural, química orgánica y bioinformática. El modelo obtuvo 10,2 puntos porcentuales más en una prueba interna sobre interpretación de espectros químicos y 7,7 puntos más al predecir cómo afectan determinados cambios en la secuencia de una proteína a su funcionamiento.

Son resultados prometedores, aunque deben leerse como comparaciones internas entre generaciones de Claude. Anthropic no sostiene que Opus 5 sustituya a sus sistemas más especializados. De hecho, reconoce que Mythos 5 continúa por delante en investigación biológica de alta complejidad y ciberseguridad ofensiva.

Más capacidad con límites específicos en ciberseguridad

Opus 5 puede revisar código y encontrar vulnerabilidades, pero Anthropic ha mantenido restricciones sobre análisis de binarios, pruebas de penetración y creación de exploits. La empresa explica que el modelo se acerca a Mythos 5 al identificar fallos, aunque queda claramente por detrás cuando debe convertirlos en ataques funcionales.

La diferencia forma parte del diseño del producto. Anthropic quiere que Opus 5 resulte útil para equipos de desarrollo y seguridad defensiva sin darle acceso general a las capacidades más sensibles.

La compañía calcula que sus clasificadores de seguridad intervendrán alrededor de un 85 % menos que los utilizados con Fable 5. Esto debería reducir los bloqueos en tareas legítimas, mientras que los trabajos especializados podrán canalizarse mediante su programa de verificación para profesionales de ciberseguridad.

En su auditoría previa al lanzamiento, Anthropic atribuye a Opus 5 una puntuación de 2,3 en comportamientos desalineados, la más baja entre sus modelos recientes. También asegura que presenta menos conductas engañosas y una menor tendencia a realizar acciones difíciles de revertir sin comprobar antes sus consecuencias.

El precio por tarea gana importancia frente al benchmark aislado

Claude Opus 5 ya está disponible en las plataformas de Anthropic y a través de la API con el identificador claude-opus-5. Mantiene la tarifa de Opus 4.8 y añade un modo rápido que funciona, según la compañía, unas 2,5 veces más deprisa, aunque duplica el precio base.

El lanzamiento muestra hacia dónde se dirige el mercado. La competición entre OpenAI, Anthropic y el resto de laboratorios ya no depende únicamente de quién alcanza la mayor puntuación en una prueba. Las empresas necesitan saber cuánto cuesta completar un trabajo, cuántos errores exige corregir y si el agente puede mantener una tarea durante horas sin perder el objetivo.

Opus 5 intenta responder a esa necesidad. No es el modelo más avanzado de Anthropic ni el más barato del mercado. Su posición se basa en otra idea: ofrecer suficiente inteligencia para resolver trabajos difíciles todos los días, sin recurrir continuamente al modelo más caro disponible.

Preguntas frecuentes

¿Qué es Claude Opus 5?

Es un modelo de Anthropic orientado a programación, análisis profesional, automatización y agentes capaces de completar tareas de varios pasos.

¿Claude Opus 5 es más barato que GPT-5.6 Sol?

Ambos cuestan 5 dólares por millón de tokens de entrada. Opus 5 cobra 25 dólares por millón de salida, frente a los 30 dólares de GPT-5.6 Sol en la tarifa estándar publicada.

¿Opus 5 sustituye a Claude Fable 5?

No. Fable 5 continúa como la opción de máxima capacidad para proyectos largos. Opus 5 busca acercarse a su rendimiento con menor coste para tareas habituales.

¿Dónde está disponible Claude Opus 5?

Está disponible en Claude.ai, Claude Code, Claude Cowork y la API. Es el modelo más potente de Claude Pro y la opción predeterminada de Claude Max.

encuentra artículos

newsletter

Recibe toda la actualidad del sector tech y cloud en tu email de la mano de RevistaCloud.com.

Suscripción boletín

LO ÚLTIMO