Casi tan inteligente como el modelo premium de Anthropic, a la mitad del precio, y te dice "no puedo ayudarte con eso" muchísimo menos. Explicado sin tecnicismos.
Ver la guíaHasta ahora había un problema incómodo. El Claude más inteligente era también el más caro y el que más veces se frenaba a mitad de camino.
Opus 5 rompe ese trato. Es casi igual de inteligente que el modelo premium de Anthropic, y cuesta la mitad.
Si pagas Claude Pro, es lo más potente a lo que tienes acceso. Si pagas Max, es el que te responde por defecto, sin que tengas que configurar nada.
Y para ubicarlo, porque los nombres de Claude confunden a todo el mundo:
Todas salen de las pruebas que Anthropic publicó en su anuncio oficial. Traducidas a lenguaje normal.
En las pruebas de programación de Anthropic quedó a menos de medio punto del mejor resultado del modelo premium. La mitad del precio, casi el mismo resultado.
En la prueba más exigente que publicó Anthropic, Opus 5 quedó de primero. Por delante del modelo premium y de todos los demás del mercado.
Abrir programas, mover el cursor, llenar formularios, navegar. Aquí también superó al modelo premium, y gastando la tercera parte.
Anthropic revisa cada modelo para ver si miente, se desvía o se deja engañar. Opus 5 salió el mejor calificado de todos, incluyendo al premium.
Es la diferencia que más vas a sentir en el día a día. Los filtros de seguridad se activan cerca de un 85% menos que en el modelo premium.
Hay una prueba hecha justo para detectar si un modelo razona de verdad o solo repite lo que memorizó. Opus 5 sacó el triple de puntaje que el segundo mejor modelo del mercado.
Cada una con un prompt listo para copiar y pegar. Están escritos para que funcionen aunque no sepas nada de programación.
Le muestras tu proyecto y te dice por dónde alguien podría entrar, antes de que lo publiques. Si construiste algo con una herramienta de IA y no sabes qué quedó expuesto, este es el uso que más te va a servir.
Y es bueno justo en la mitad correcta. Encuentra las fallas casi tan bien como el modelo más avanzado de Anthropic, pero es bastante peor convirtiéndolas en un ataque real. Eso es a propósito.
Actúa como un revisor de seguridad. Te voy a compartir mi proyecto y quiero que lo revises antes de que lo publique. Haz esto: 1. Dime por dónde alguien podría entrar, robar información o romper algo. 2. Ordena cada hallazgo por gravedad: crítico, medio o bajo. 3. En cada hallazgo explícame en una frase qué pasaría si alguien lo aprovecha, y dame el arreglo exacto. Reglas importantes: - No soy programador. Si usas un término técnico, explícamelo ahí mismo. - No me des una lista genérica de buenas prácticas. Solo lo que aplica a mi proyecto de verdad. - Si algo te parece grave, dímelo directo, sin suavizarlo. Al final dime una sola cosa: qué debo arreglar primero antes de publicar.
La diferencia está en el tamaño del encargo. No "escríbeme este correo", sino "revisa esta lista de clientes, detecta a los que se están yendo, avisa al responsable de cada uno y déjame un resumen". Eso ya lo hace de principio a fin.
En la prueba que mide justo esto, Opus 5 completó cerca de una vez y media más tareas que el siguiente mejor modelo, al mismo costo. En un caso real tomó una planilla de clientes en riesgo y ejecutó toda la secuencia de retención sin ayuda.
Te voy a encargar una tarea de trabajo completa, no un pedacito. Quiero que la ejecutes de principio a fin. La tarea: [describe aquí el resultado que quieres, no los pasos] La información con la que trabajas: [pega o adjunta aquí] Cómo quiero que trabajes: 1. Antes de empezar, muéstrame tu plan en pasos y espera mi aprobación. 2. Si te falta un dato para completar un paso, pregúntame. No lo inventes ni lo asumas. 3. Cuando termines, entrégame tres cosas: el resultado final, un resumen de lo que hiciste, y una lista de las decisiones que tomaste tú y que yo debería revisar. Escríbeme todo en lenguaje sencillo. No soy una persona técnica.
La mayoría de las herramientas tapan el síntoma y te dicen que ya quedó listo. Dos días después el problema vuelve.
Opus 5 busca la causa. En una prueba real encontró el origen de un error en un proyecto público que la comunidad de programadores había parchado a medias, y corrigió justo el caso que se les había escapado.
Algo en mi proyecto no funciona y necesito saber la causa real, no un parche rápido. Lo que está pasando: [describe] Lo que debería pasar: [describe] Lo que ya intenté: [describe, o escribe "nada todavía"] Cómo quiero que lo hagas: 1. No me des la primera solución que se te ocurra. 2. Primero investiga y dime cuál crees que es la causa de fondo, y por qué. 3. Si hay varias causas posibles, ordénalas de más probable a menos, y dime cómo descartar cada una. 4. Solo cuando confirmemos la causa, arréglalo. Explícame todo en lenguaje sencillo. Y al final dime qué puedo hacer para que no vuelva a pasar.
Esta es la pesadilla de quien construye con IA. En la computadora se ve perfecto, lo abres en el celular y está todo corrido.
Opus 5 abre su propio trabajo en pantalla de computadora y de teléfono para revisarlo, como haría un diseñador antes de entregar. En una prueba descubrió que un botón de pago quedaba fuera de la pantalla en móvil, y lo arregló antes de entregar el trabajo.
Quiero que revises esta página como lo haría un diseñador antes de entregarla a un cliente que paga. Revísala en dos tamaños: pantalla de computadora y pantalla de teléfono. En cada tamaño dime: - Qué se sale de la pantalla, se desborda o queda escondido - Si algún botón importante queda difícil de encontrar o de presionar - Si el texto se lee cómodo o queda demasiado pequeño - Si algo se ve desordenado o mal alineado Después arregla lo que encontraste y dime exactamente qué cambiaste. Una regla: no cambies el diseño, los colores ni el contenido. Solo arregla lo que está roto.
Revisa lo que hace y lo repite hasta que funciona, sin que estés encima cada cinco minutos. Esa es la mejora más grande de esta versión.
En una prueba le dieron un plano de una pieza mecánica y le pidieron reconstruirla, pero sin darle forma de ver la imagen. En lugar de rendirse, se construyó su propia herramienta para leer el plano desde los píxeles, y lo logró. Ningún otro modelo pudo, ni en cinco intentos.
Te voy a encargar un proyecto largo. Quiero que trabajes con autonomía, pero con reglas claras. El proyecto: [describe el resultado final que quieres, con el mayor detalle posible] Lo que ya tengo: [describe o adjunta] Lo que no quiero: [describe los límites, si los tienes] Cómo quiero que trabajes: 1. Empieza con un plan por etapas y muéstramelo antes de trabajar. 2. Al terminar cada etapa, revisa tu propio trabajo antes de pasar a la siguiente. Si algo no funciona, corrígelo tú y sigue. 3. No me consultes por cosas pequeñas. Consúltame solo cuando sea una decisión que cambie el resultado final. 4. Si te trancas en algo dos veces, para y explícame el problema en lenguaje sencillo en vez de seguir intentando. Al terminar dame un reporte de tres puntos: qué hiciste, qué corregiste en el camino, y qué quedó pendiente o dudoso.
Todo lo que dice esta guía viene del anuncio oficial de Anthropic del 24 de julio de 2026: Introducing Claude Opus 5. Nada aquí es una estimación ni una opinión.
Para quien quiera verificar los números, estos son los nombres reales de las pruebas mencionadas:
Agenda una sesión conmigo y lo aterrizamos a lo que estás construyendo, paso a paso y sin tecnicismos.
Agendar una sesión