Anthropic lanza Claude Opus 5, llevando IA casi de frontera a mitad de precio

Anthropic lanzó Claude Opus 5 el 24 de julio, su cuarto modelo en dos meses, pero este es diferente a los demás. Mientras Fable 5 y Mythos 5 empujan la frontera absoluta de capacidad a precios premium, Opus 5 está diseñado para ser el modelo que los equipos usen realmente a diario, y las métricas sugieren que Anthropic podría haberlo logrado.

A 5 dólares por millón de tokens de entrada y 25 dólares por millón de tokens de salida, el mismo precio que el antiguo Opus 4.8, el nuevo modelo ofrece un rendimiento que rivaliza con Fable 5 en varias evaluaciones clave. En Frontier-Bench v0.1, una prueba de codificación agéntica, Opus 5 obtuvo 43.3%, superando el 33.7% de Fable 5 y el 34.4% de GPT-5.6 Sol. En ARC-AGI-3, que mide la resolución de problemas novedosos, alcanzó 30.2%, aproximadamente cuatro veces la puntuación del siguiente mejor competidor. En OSWorld 2.0, una prueba de capacidades de uso de computadora, superó a Fable 5 con poco más de un tercio del costo por tarea.

Las cifras principales ocultan una historia más interesante sobre cómo Anthropic está pensando el despliegue. Opus 5 viene con un dial de control de esfuerzo, bajo, medio o alto por solicitud, que permite a los usuarios intercambiar profundidad de razonamiento por velocidad y costo. Una tarea rutinaria de entrada de datos puede ejecutarse con esfuerzo bajo para conservar tokens; un problema de arquitectura complejo puede subir a alto. Es un enfoque flexible que reconoce que la mayoría de las cargas de trabajo de producción no necesitan razonamiento máximo en cada llamada.

Arquitectura de seguridad: un respaldo, no un bloqueo duro

El sistema de seguridad introduce una elección arquitectónica novedosa: cuando las barreras de protección de Opus 5 marcan una solicitud como potencialmente problemática, como un prompt que involucra escaneo de vulnerabilidades binarias o generación de exploits, el sistema puede retroceder automáticamente a Opus 4.8 en lugar de rechazar la solicitud por completo. Esto preserva el flujo de trabajo del usuario mientras enruta las operaciones de alto riesgo a un modelo con capacidad ofensiva menos avanzada.

If you believe trustworthy journalism still matters, we'd appreciate your support.

Help us grow

Anthropic describe a Opus 5 como su “modelo más alineado hasta la fecha” según pruebas conductuales automatizadas, con una tasa menor de comportamiento engañoso que lanzamientos recientes. En tareas ofensivas de ciberseguridad, sigue al especializado Mythos 5 pero lo iguala en identificación de vulnerabilidades.

Autocorrección y el dial de esfuerzo

Anthropic destaca una capacidad que puede resultar la más importante para los usuarios empresariales: la autocorrección. En demostraciones internas, Opus 5 detectó errores de ejecución durante una tarea y construyó sus propias soluciones alternativas, en un caso construyendo un pipeline de visión computacional desde cero para extraer geometría de píxeles brutos cuando el modelo no podía ver directamente un objeto. Los modelos competidores fallaron después de cinco intentos en condiciones idénticas.

El modelo es compatible con el conjunto completo de funciones para desarrolladores de Anthropic, incluyendo el cambio de herramientas en medio de una conversación sin invalidar los cachés de prompt, y la capacidad de enrutar solicitudes API marcadas a otro modelo automáticamente. Es el modelo predeterminado para los suscriptores de Claude Max y la opción más potente disponible para los usuarios de Claude Pro.

Traducido por Alessandra

Fuentes: “Claude Opus 5 delivers top coding scores at half the per-task cost” (Interesting Engineering, 24 de julio de 2026); “Anthropic Introduces Claude Opus 5” (TheWinCentral, 24 de julio de 2026); anuncio oficial de Anthropic

Scroll to Top