Volver a Novedades
Nueva featureDestacado25 de julio de 2026

Claude Opus 5 ya está en Napsix — casi Fable 5, a mitad de precio

Anthropic lanzó Opus 5: nuevo estado del arte en coding y trabajo de conocimiento, al mismo precio que Opus 4.8. Con 2 videos oficiales, casos reales de clientes y ya activo en el AI Gateway.

aimodelosanthropicopus-5
Claude Opus 5 ya está en Napsix — casi Fable 5, a mitad de precio

Anthropic lanzó Claude Opus 5 el 24 de julio de 2026 — y ya está activo en Napsix como el modelo frontier por defecto de la plataforma.

Por qué importa

Opus 5 se acerca a la inteligencia de Claude Fable 5 (el modelo más capaz de Anthropic) a la mitad del precio. Es el nuevo estado del arte en varias evaluaciones de coding y trabajo de conocimiento, y quedó por encima de Opus 4.8 en prácticamente todos los benchmarks — mientras mantiene el mismo precio. Anthropic lo describe como "un modelo pensado y proactivo" diseñado para usarse todos los días: trabaja de forma más eficiente que otros modelos, es el nuevo modelo por defecto en Claude Max y el más fuerte disponible en Claude Pro.

Claude Opus 5: rendimiento en coding agéntico por nivel de esfuerzo (Frontier-Bench v0.1)

Los números

EvaluaciónOpus 5Fable 5Opus 4.8GPT-5.6 Sol
Frontier-Bench v0.1 (coding agéntico)43.3%33.7%21.1%34.4%
GDPval-AA v2 (trabajo de conocimiento)1861174715931736
ARC-AGI-3 (resolución de problemas nuevos)30.2%1.5%7.8%
Agentic search (BrowseComp)90.8%87.4%84.3%90.4%
Zapier AutomationBench (workflows de negocio)26.0%17.4%17.0%18.1%
OSWorld 2.0 (uso de computadora)70.6%66.1%55.7%62.6%
Legal Agent Benchmark (held-out)11.7%13.3%10.4%2.5%
HealthBench Professional59.8%66.0% (Mythos 5)57.4%60.5%
BioMysteryBench (hard)49.4%46.5%42.4%

En ARC-AGI-3 (resolver problemas que el modelo nunca vio antes), Opus 5 saca el triple de puntaje que el siguiente mejor modelo. En AutomationBench de Zapier, incluso con el esfuerzo mínimo configurado, Opus 5 completa más tareas de negocio de punta a punta que cualquier otro modelo con esfuerzo alto — y en OSWorld 2.0 supera el mejor resultado de Fable 5 usando poco más de un tercio de su costo.

Claude Opus 5: cuánto completa por dólar gastado en workflows de negocio reales (Zapier AutomationBench)

Cómo trabaja Opus 5 en la práctica

Anthropic y sus usuarios de acceso temprano documentaron varios ejemplos concretos de la agencia y minuciosidad del modelo:

  • En una tarea de Frontier-Bench, le dieron a Opus 5 el dibujo de una pieza mecánica y le pidieron reconstruirla como modelo 3D en FreeCAD — pero, a propósito, sin forma de ver el dibujo directamente. Opus 5 respondió escribiendo su propio pipeline de visión por computadora para extraer la geometría desde los píxeles crudos, y reconstruyó la pieza completa. Lo logró de forma repetida; ningún modelo competidor con la misma configuración pudo resolverlo después de 5 intentos.
  • Frente a un bug real en un gestor de paquetes open-source popular, Opus 5 encontró la causa raíz y arregló un caso límite que el parche de la comunidad había pasado por alto. Un modelo competidor solo arregló el síntoma superficial (no la causa) y reportó el bug como resuelto.
  • Un ingeniero de una firma de trading usó Opus 5 para construir un feed de datos de mercado para un exchange nuevo en una sola sesión. Modelos anteriores no pudieron completar esta tarea ni con planes extensos del ingeniero. Sin un feed en vivo contra el cual validar, Opus 5 construyó su propio arnés de pruebas para verificar que su código parseaba correctamente los datos del exchange.

Lo que dicen los primeros clientes

Anthropic compartió testimonios de decenas de equipos con acceso temprano. Algunos ejemplos reales:

"En FrontierCode 1.1, Claude Opus 5 se acerca al rendimiento de Fable a la mitad del costo. Dentro de Devin, también muestra fuerza particular en debugging difícil y análisis de causa raíz." — Scott Wu, CEO de Devin

"Claude Opus 5 topeó el leaderboard de AutomationBench de Zapier sin gastar más tokens que los modelos Claude anteriores. Tomó una planilla cruda de salud de cuentas y corrió una secuencia completa de prevención de abandono de punta a punta. Los modelos anteriores no la aprobaban; Opus 5 dio 100%." — Wade Foster, CEO de Zapier

"Claude Opus 5 es el salto más grande en la familia Opus desde 4.5. En las mismas builds de apps full-stack, el frontend lo muestra primero: las mejores animaciones, juegos y trabajo 3D que vimos de un modelo Opus." — Madhav Jha, Co-Founder y CTO de Lovable

"Claude Opus 5 verifica su propio trabajo como lo haría un desarrollador frontend real. En nuestro benchmark abrió sus páginas en un navegador en anchos de escritorio y celular, detectó un producto oculto bajo el pliegue móvil y un botón de checkout fuera de pantalla, y arregló ambos antes de devolver el trabajo." — AJ Orbach, Co-Founder y CEO

Ciencia y salidas visuales

Opus 5 mejora a Opus 4.8 en todas las evaluaciones de ciencias biológicas: química orgánica (+10.2 puntos porcentuales infiriendo estructuras moleculares desde datos de espectroscopía) y proteínas (+7.7 puntos prediciendo cómo afectan las mutaciones a la función).

También produce salidas visuales mucho más sólidas. Anthropic publicó dos artefactos interactivos que Opus 5 construyó por su cuenta, junto con sus videos de "detrás de escena":

Alineación y seguridad

En la auditoría de comportamiento automatizada de Anthropic, Opus 5 es el modelo más alineado hasta la fecha — score de 2.3 en comportamiento desalineado general, el más bajo de sus modelos recientes. Cumple mejor la Constitución de Claude que Opus 4.8, Sonnet 5 o Fable 5; muestra las tasas más bajas de comportamiento engañoso; y es el menos susceptible a ser inducido a un mal uso.

En seguridad cibernética y biología, Opus 5 no supera a Mythos 5 (el modelo de mayor riesgo de Anthropic, de acceso restringido) — Anthropic evitó deliberadamente entrenarlo en tareas cyber, aunque igual mejoró de forma sustancial por volverse más capaz en general. Los clasificadores de ciberseguridad de Opus 5 son ~85% menos restrictivos que los de Fable 5: permiten encontrar vulnerabilidades en código fuente, pero bloquean escaneo de vulnerabilidades "basado en binarios", pen-testing y generación de exploits. Cualquier request bloqueado en Claude.ai, Claude Code o Claude Cowork cae automáticamente a Opus 4.8.

Precio y disponibilidad

$5 por millón de tokens de entrada y $25 por millón de salida — exactamente el mismo precio que Opus 4.8. También existe un modo Fast (~2.5× más rápido, al doble de precio, disponible en la Claude API). Junto con el lanzamiento, Anthropic sumó dos features en beta: cambios de herramientas mid-conversación (sin invalidar el cache de prompts) y fallbacks automáticos en la API (los requests bloqueados por los clasificadores de seguridad caen a otro modelo automáticamente en vez de bloquearse).

Disponible en la Claude API, AWS Bedrock, Google Cloud Vertex AI y Microsoft Foundry.

En Napsix

Auditamos Opus 5 contra las fuentes oficiales de Anthropic y ya está activo en el AI Gateway de la plataforma (ruteo directo por Anthropic con fallback automático a Bedrock) — sin que tengas que hacer nada. Elegilo desde el selector de modelos en cualquier chat de XIA.

XIA
público