Salió el 24 de julio · piensa por default · el esfuerzo ya no arranca arriba
Opus 5 ya piensa solo: lo que tienes que dejar de pedirle
Opus 5 salió el 24 de julio de 2026 y no se usa como el anterior: piensa por su cuenta, se verifica solo y decide cuánto razonar en cada turno. Tus prompts de Opus 4.8 ahora le estorban. Aquí va qué cambió, qué instrucciones hay que borrarle, dónde poner el esfuerzo y en qué tipo de trabajo se nota la diferencia.
En corto: Opus 5 hace solo lo que antes le pedías (pensar, verificarse, narrar), así que la jugada ya no es exigirle más — es quitarle instrucciones viejas y elegir bien el nivel de esfuerzo.
Anthropic lo describe como un modelo reflexivo y proactivo que se acerca a la inteligencia de frontera de Claude Fable 5 a la mitad del precio. Trae un millón de tokens de contexto —que aquí es el default y el máximo a la vez, no hay variante chica— y es el modelo de Claude que sabe cosas más recientes: su conocimiento llega hasta mayo de 2026, mientras Fable 5 y Sonnet 5 se quedaron en enero. Lo que más se siente en el día a día es el comportamiento: el pensamiento viene encendido de fábrica, se revisa a sí mismo sin que se lo pidas, narra más lo que va haciendo y escribe respuestas y documentos más largos que Opus 4.8. Y hay un cambio de recomendación que casi nadie leyó: en Opus 4.7 y 4.8 el consejo oficial era arrancar en extra-alto para código; en Opus 5 el consejo es arrancar en alto —el default— y subir solo cuando la tarea lo justifique. Esta página traduce todo eso a prompts que puedes copiar hoy.
guía comunidad · julio 2026un millón de contexto de fábricasabe hasta mayo de 2026pensamiento encendido por defaultesfuerzo por default: altosin código · para usarlo mejor
01 · QUÉ ES
Opus 5 en una ficha: qué es y dónde ya lo tienes
Claude Opus 5 salió el 24 de julio de 2026 y es la generación que sigue a Opus 4.8. Anthropic lo presenta como «un modelo reflexivo y proactivo que se acerca a la inteligencia de frontera de Claude Fable 5 a la mitad del precio». Esa frase suena a comunicado, así que vale la pena traducirla a como tú lo vives: te da casi lo que te daría el modelo de hasta arriba, sin comerse tu plan al doble de velocidad. Ese es todo el argumento del modelo — no es el más inteligente del catálogo, es el que mejor rinde por lo que consume.
Dónde ya lo tienes: en Max es el modelo por default, así que si nunca tocaste el selector ya le estás escribiendo a Opus 5. En Pro es el modelo más fuerte al que tienes acceso: lo eliges desde el selector de modelo. Y vive en los cuatro lugares donde usas Claude: claude.ai, Claude Code, Claude Cowork y las apps de Claude.
La ficha, sin adornos
Dato
Qué trae
Por qué importa
Cuándo salió
24 de julio de 2026
Reemplaza a Opus 4.8 como la línea Opus vigente. Si vienes de ahí, tus costumbres de prompt son de hace una generación.
Memoria de trabajo
1 millón de tokens
Aquí está el detalle que cambia todo: es el default Y el máximo a la vez. No hay variante chica que activar ni ventana extendida que pedir — desde el primer mensaje ya traes el millón completo.
Cuánto escribe de un jalón
128 mil tokens de salida
El tope de una sola respuesta. Alcanza de sobra para un reporte largo, un documento completo o un archivo entero sin partirlo en entregas.
Hasta cuándo sabe
mayo de 2026
El dato de oro que casi nadie tiene: Fable 5 y Sonnet 5 se quedaron en enero de 2026. Opus 5 es el modelo de Claude que sabe cosas más recientes de toda la familia. Si tu pregunta depende de algo de los últimos meses, este es el que menos hueco tiene.
Cómo piensa
adaptativo, encendido por default
El modelo decide solo cuándo pensar y cuánto en cada turno. En Opus 4.8 venía apagado si no lo pedías; aquí ya no hay nada que pedir.
Esfuerzo
escalera completa: bajo, medio, alto, extra-alto y máximo
Arranca en alto. Poner «alto» a mano es exactamente lo mismo que no poner nada — y ese default es justo lo que cambió respecto a Opus 4.8.
Dónde vive
claude.ai · Claude Code · Claude Cowork · apps
Es el modelo por default en Max y el más fuerte disponible en Pro. El mismo modelo en los cuatro lados: lo que cambia es dónde está la perilla.
En claude.ai y en las apps se elige desde el selector de modelo, junto a la barra de chat: abres la lista y tocas Opus 5. Si estás en Max y no has movido nada, ya está seleccionado. En Claude Code el mismo cambio se hace por comando: te muestra cuál traes puesto y te deja moverte entre los modelos disponibles en tu plan.
En Claude Code: abrir el selector y elegir Opus 5
/model
Y hay un segundo comando que casi nadie usa: el modo rápido. Se prende con /fast dentro de Claude Code y está disponible para Opus 5.
En Claude Code: prender el modo rápido
/fast
Aquí va la aclaración que evita el malentendido más común: /fast NO te baja a un modelo más chico. Es el mismo Opus 5, con la salida más veloz. No cambias de cerebro, cambias de velocidad de entrega. Eso sí, está marcado como research preview, o sea que puede cambiar o irse sin aviso: úsalo cuando te urja la respuesta, no lo dejes puesto como costumbre.
Nada de esta guía necesita que programes. Todo lo que sigue son cosas que le escribes a Claude en español, y los prompts vienen listos para copiar con corchetes [ASÍ] donde va lo tuyo. Los comandos aparecen solo cuando la perilla de verdad está en Claude Code.
02 · LO QUE NOTAS
Lo que cambió sin que muevas nada
Si lo único que haces es chatear, ésta es la sección que más te va a servir de toda la guía. Los siete cambios de abajo aparecen sin que toques una sola configuración: son cómo se comporta Opus 5 de fábrica comparado con Opus 4.8. Si sentiste que «se puso raro», que «ahora habla de más» o que «hace cosas que no le pedí», no lo imaginaste.
Tampoco es un bug. Cada uno de los siete es una decisión de diseño, y cada uno tiene perilla. Abajo va el síntoma tal como lo ves en tu pantalla, la razón técnica en una línea, y qué hacer al respecto.
01
Sus respuestas salen más largas
Qué ves
Le preguntas lo mismo de siempre y la respuesta sale visiblemente más larga que con Opus 4.8: más contexto, más matices, más párrafos antes de llegar al punto.
Por qué pasa
Opus 5 es más verboso por default; el largo de la respuesta visible subió respecto a la generación anterior.
Qué hacer
Pídele concisión de forma explícita. Ojo con el atajo obvio: bajar el esfuerzo NO acorta la respuesta de forma confiable, porque el esfuerzo controla cuánto piensa, no cuánto escribe. El prompt de concisión está en la sección 05.
02
Narra más cuando trabaja solo
Qué ves
Cuando lo pones a trabajar en varios pasos —Claude Code, Cowork, cualquier flujo con herramientas— va anunciando lo que va a hacer, y cada mensaje suyo es más largo que antes.
Por qué pasa
Tiende a declarar su plan antes de actuar, y su salida por mensaje creció respecto a modelos anteriores.
Qué hacer
No se lo prohíbas: descríbele la cadencia que quieres. Una frase antes de arrancar, avisos breves solo cuando encuentre algo importante o cambie de rumbo, y el resultado hasta arriba al cerrar. Los ejemplos positivos de cómo quieres que te hable funcionan mejor que la lista de lo que no debe hacer (sección 05).
03
Los documentos que escribe salen más largos
Qué ves
Los archivos que te deja —reportes, markdown, resúmenes, minutas— salen más largos que los de Opus 4.8, con secciones que no le pediste.
Por qué pasa
El mismo sesgo de verbosidad aplica a lo que guarda en disco, no solo a lo que te contesta en pantalla.
Qué hacer
Dile que ajuste el largo del documento a lo que la tarea necesita: que cubra la sustancia y no rellene con secciones de paja, resúmenes redundantes ni texto de molde. Es una línea en el prompt y cambia el entregable completo (sección 05).
04
Delega a subagentes con más facilidad
Qué ves
En trabajo agéntico lanza subagentes mucho más seguido: donde antes hacía el trabajo él mismo, ahora reparte.
Por qué pasa
Coordina equipos de subagentes bien —con patrones escritor-verificador efectivos y pocos casos de agentes pisándose entre ellos— y por eso se inclina a delegar más que modelos anteriores.
Qué hacer
Si te importa el gasto, ponle tope. La regla que funciona: delegar solo tareas grandes que sean genuinamente independientes y paralelizables, nunca trabajo que él termina en un puñado de pasos, y si con un subagente basta, uno (sección 05).
05
Se verifica solo, sin que se lo pidas
Qué ves
Revisa su propio trabajo por iniciativa propia: relee, comprueba, vuelve sobre lo que ya hizo antes de entregártelo.
Por qué pasa
La auto-verificación viene de fábrica en Opus 5. Ya no hace falta pedirla porque ya está prendida.
Qué hacer
Éste es el que más tokens te está costando en silencio. Si tus prompts viejos traen «verifica tu trabajo», «revisa dos veces» o «usa un subagente para verificar», bórralos: con Opus 5 esas líneas causan sobre-verificación, y quitarlas reduce tokens desperdiciados sin pérdida de calidad (sección 06).
06
Narra sus propias correcciones
Qué ves
Se corrige a media respuesta y te lo cuenta: «antes dije X, en realidad es Y». Pasa más seguido que con modelos anteriores, incluso cuando el desliz no cambiaba nada.
Por qué pasa
Anuncia sus auto-correcciones más que la generación anterior, sin filtrar por si el error tenía consecuencias o no.
Qué hacer
Pon el filtro tú: que corrija en voz alta solo cuando el error cambiaría el código, las conclusiones o una decisión tuya, y que lo diga simple, en una frase, sin detener la tarea. Para deslices que no cambian nada, que arregle y siga sin anunciarlo (sección 05).
07
Puede expandir el alcance de la tarea
Qué ves
Pediste A y te entrega A más B y C: pasos que nunca pediste, o su propia versión de lo que la tarea «debería» ser.
Por qué pasa
Es proactivo por diseño y aplica criterio propio sobre el alcance cuando tu pedido admite más de una lectura.
Qué hacer
Delimita el alcance en el prompt: que entregue lo que se pidió, al alcance que se pidió, que tome solo las decisiones de rutina y que pregunte nada más cuando dos lecturas del pedido lleven a trabajos materialmente distintos. Y si cree que hay mejor camino, que lo diga en una frase y siga con lo pedido (sección 05).
Ninguno de los siete es una falla ni un modelo descompuesto: todos son decisiones de diseño y todos se dirigen. Seis se arreglan describiéndole la forma que quieres (sección 05) y el de la auto-verificación se arregla al revés, borrando líneas que en Opus 4.8 sí ayudaban (sección 06).
El resumen en una frase, y es la idea que sostiene toda la guía: Opus 5 hace por su cuenta muchas cosas que antes había que pedirle. Por eso con este modelo la jugada no es exigirle más — es quitarle instrucciones viejas y decirle qué forma quieres que tenga la respuesta.
03 · CÓMO PIENSA
Ahora piensa siempre: tú decides cuánto
En Opus 4.8 el pensamiento era algo que tenías que pedir. Si no prendías el razonamiento o no se lo escribías en el prompt, el modelo contestaba de corrido y ya. Opus 5 le da la vuelta: el pensamiento viene encendido de fábrica y además es adaptativo, o sea que el modelo decide solo —turno por turno— si esta pregunta amerita razonar y cuánto. Tú ya no lo enciendes. Ya está encendido.
Ese detalle cambia la pregunta que te haces al empezar. Antes era «¿le prendo el pensamiento?». En Opus 5 esa pregunta desapareció y solo queda una: «¿cuánto lo hago pensar?». Y esa se contesta con el nivel de esfuerzo. Por eso el esfuerzo dejó de ser un ajuste escondido para gente rara y pasó a ser la perilla que mueves a diario, casi la única decisión de configuración que de verdad te va a cambiar el resultado.
Dos cosas distintas que todo el mundo confunde
En el mismo menú de la app vas a ver dos controles que suenan parecido y no lo son. Confundirlos es la razón número uno por la que alguien cree que «apagó el pensamiento» y en realidad solo dejó de verlo.
El esfuerzo
Cuánto piensa
Es el nivel que eliges —bajo, medio, alto, extra-alto o máximo— y define qué tanto razona y qué tanto trabaja el modelo antes y durante la respuesta. Es una decisión sobre el trabajo interno: más esfuerzo, más exploración, más pasos, más consumo de tu plan.
El pensamiento extendido
Si tú lo ves
Es el interruptor que aparece junto al selector de modelo en la app. No decide si Claude piensa —eso ya viene encendido y es adaptativo—, decide si ese razonamiento se muestra en pantalla para que lo leas. Es una decisión sobre lo que tú ves, no sobre lo que él hace.
El esfuerzo no solo mueve el pensamiento: mueve todo
Aquí está lo que casi nadie tiene claro. El esfuerzo afecta todos los tokens del turno, incluidas las llamadas a herramientas. No es una perilla de «piensa más antes de escribir», es una perilla de cómo se comporta el modelo completo mientras trabaja.
En esfuerzo bajo
Hace menos llamadas a herramientas y las combina en menos pasos. Va directo a la acción: menos plan explicado por adelantado, resúmenes más secos, más ejecución. Se siente más rápido porque literalmente hace menos movimientos.
En esfuerzo alto
Hace más llamadas a herramientas, te explica el plan antes de actuar y cierra con resúmenes más detallados de lo que hizo. Te da más visibilidad del proceso, y también se come tu plan más rápido por los pasos extra.
Es una señal, no un candado
La documentación lo dice con todas sus letras: el esfuerzo es una señal de comportamiento, no un presupuesto estricto de tokens. En niveles bajos Claude igual va a pensar si el problema es lo bastante difícil, nada más piensa menos de lo que pensaría arriba. Así que ponerlo en bajo no es amordazarlo: es inclinarlo hacia la respuesta corta y directa, dejándole margen para frenar y razonar cuando de verdad hace falta.
La recomendación oficial sobre apagarlo
Si tu instinto es apagar el pensamiento para gastar menos, la recomendación oficial va al revés: deja el pensamiento encendido y controla el gasto bajando el nivel de esfuerzo. Para la mayoría de las tareas, pensamiento encendido en esfuerzo bajo rinde mejor que pensamiento apagado a un costo parecido. Es el mismo dinero de tu plan comprado mejor.
Y hay una razón para tomarte en serio el nivel que eliges. Anthropic dice que Opus 5 convierte esfuerzo adicional en mejores resultados de forma más confiable que cualquier Opus anterior. En modelos pasados subirle podía no cambiar gran cosa —pagabas los pasos extra y recibías lo mismo—; aquí el escalón sí se nota. Lo que también significa que bajarlo se nota: la perilla pesa más que antes en los dos sentidos, y por eso la siguiente sección es la más importante de esta guía.
04 · EL ESFUERZO
El cambio que casi nadie vio: ahora arrancas en alto
Si usaste Opus 4.7 o Opus 4.8 en serio, aprendiste una regla: para código y trabajo agéntico, arranca en extra-alto. Estaba en la documentación oficial, la repitieron todos y funcionaba. En Opus 5 esa recomendación cambió, y el cambio es al revés de lo que cualquiera hubiera apostado para un modelo más capaz.
"Empieza con alto, el default, y ajusta según tus evaluaciones: sube a extra-alto para trabajo de código y agéntico exigente, o a máximo cuando la tarea justifique gasto de tokens sin restricción, y usa bajo y medio liberalmente como tu control principal de costo de tokens y tiempo de respuesta donde la calidad aguante."
Recomendación oficial de Anthropic para Opus 5
Léelo otra vez, porque hay dos instrucciones ahí y la segunda es la que duele: arranca en alto —que es el default, o sea que poner alto es idéntico a no poner nada— y usa bajo y medio liberalmente. No «de vez en cuando». Liberalmente, como tu control principal de gasto y de velocidad. Extra-alto y máximo dejaron de ser el punto de partida y pasaron a ser escalones a los que subes cuando ya comprobaste que alto se queda corto.
Por qué es contraintuitivo: uno asume que un modelo mejor merece más esfuerzo. Pasa lo contrario. Opus 5 aprovecha tan bien el esfuerzo que ya no necesitas empujarlo desde arriba para que rinda, y en cambio sí necesitas frenarlo para que no se te acabe el plan a media semana. Si traes la costumbre de 4.8 y dejaste todo fijo en extra-alto, ahora mismo estás pagando pasos extra que en la mayoría de tus tareas no compran nada.
Los cinco niveles, aplicados a Opus 5
Esto no es el explicador de los niveles —ese vive en su propia guía y va enlazado abajo—. Esto es qué hace cada escalón en este modelo, y sobre todo cuándo no usarlo:
Nivel
Para qué sirve en Opus 5
Cuándo NO usarlo
Bajo
low
Preguntas rápidas, ediciones puntuales, tareas repetitivas y volumen. En Opus 5 pasa algo que antes no: la exactitud en revisión de código aguanta bien incluso aquí, así que sirve para una pasada rápida de bugs al momento y dejar la revisión a fondo para después.
Cuando el trabajo toca varios archivos, tiene varios pasos encadenados o no puede fallar a la primera. Ahí sigue pensando, pero piensa menos de lo que la tarea pedía.
Medio
medium
Tu control de gasto real, junto con bajo. Es el escalón que la recomendación oficial te pide usar sin culpa: redacción larga, análisis normales, trabajo agéntico de alcance chico, todo lo que ya sabes que sale bien sin exprimir al modelo.
Cuando ya viste que en alto te lo resuelve y en medio se queda a medias. Ahí no estás ahorrando: estás pagando dos intentos para hacer un trabajo.
Alto
high · default
El punto de partida oficial y el default en Claude Code: elegir alto es exactamente lo mismo que no elegir nada. Aguanta código de varios archivos, refactors, análisis de varios pasos y trabajo agéntico normal sin que tengas que tocar nada.
No hay un caso de «no lo uses». El error con alto es el opuesto: quedarte aquí por inercia en tareas chicas donde medio o bajo te daban lo mismo más rápido.
Extra-alto
xhigh
El escalón al que subes, no del que partes. Trabajo de código y agéntico exigente: features de punta a punta, refactors grandes, cadenas largas de razonamiento donde ya comprobaste con tus propias pruebas que alto no alcanza.
Como configuración fija de todos los días. Si lo traes prendido desde tus tiempos de Opus 4.8, esa sola costumbre es la que te está quemando el plan sin darte nada a cambio.
Máximo
max
Cuando la tarea de verdad justifica gastar sin restricción: el bug que llevas tres días sin encontrar, el análisis del que cuelga una decisión cara. Ahí explora más, planea más y llama más herramientas antes de darte una respuesta.
En tareas simples. La doc es explícita: puede dar rendimientos decrecientes por el uso extra de tokens y es propenso a sobrepensar lo fácil. El máximo no es «el mejor modo», es un modo con su propio costo.
El malentendido que te va a ahorrar una tarde
El esfuerzo controla cuánto piensa, no qué tan larga sale la respuesta que lees. Suena obvio escrito así, pero mucha gente baja el esfuerzo porque Opus 5 le contesta largo y se queda esperando respuestas cortas que nunca llegan. Bajarlo no acorta la salida de forma confiable: son dos perillas separadas. Si lo que quieres es que se acorte, hay que pedir concisión explícitamente en el prompt.
El consejo oficial es directo: si traes niveles de esfuerzo heredados de otro modelo, no los reuses — corre un barrido nuevo sobre tus propias pruebas. Suena a trabajo de laboratorio y es media hora. Agarra tres tareas que hagas seguido, córrelas en bajo, medio y alto, y quédate con el escalón más bajo que te dé un resultado que aceptarías. Ese es tu default nuevo, y casi siempre está más abajo de donde lo tenías.
Barrido de esfuerzo en 30 minutos
Pégalo en un chat nuevo para que Claude te arme el experimento antes de que muevas nada.
Voy a calibrar mi nivel de esfuerzo en Claude Opus 5 y quiero hacerlo con datos míos, no con recomendaciones genéricas.
Mis tareas más frecuentes son:
1. [TAREA QUE HAGO CASI DIARIO]
2. [TAREA MÁS PESADA, DE VARIOS PASOS]
3. [TAREA CORTA Y REPETITIVA]
Ayúdame a armar un barrido de esfuerzo:
- Para cada tarea, escribe un prompt de prueba corto y siempre igual, para que la única variable sea el nivel.
- Dime en qué orden probarlas (empezando por el nivel más bajo) y qué debo observar en cada corrida.
- Define para cada tarea un criterio de "aceptable" concreto y verificable, no "que quede bien".
- Al final, dame una tabla en blanco para anotar: tarea, nivel, aceptable sí/no, y qué falló.
Reglas: no me digas qué nivel usar antes de que yo tenga resultados. La meta es quedarme con el nivel MÁS BAJO que pase el criterio, no con el que dé la mejor respuesta posible.
En Claude Code: mover el esfuerzo sin salirte de la terminal
/effort
Se abre el menú de niveles y el cambio aplica desde el siguiente turno. Como alto es el default, si el menú te lo muestra ya seleccionado no tienes nada que hacer: ese es el punto de partida que recomienda Anthropic. Úsalo a media sesión, no solo al empezar — es normal bajar a medio para la parte aburrida de una tarea y subir a extra-alto solo para el pedazo difícil.
Aquí conté qué cambia en Opus 5. Si quieres los cinco niveles explicados desde cero, dónde se cambian en el chat, en Cowork y en Claude Code, y cómo se comportan en los otros modelos de la familia, esa es la guía madre.
Resumen para llevarte: arranca en alto, baja sin culpa, sube con evidencia. Si de toda esta guía solo cambias una cosa hoy, que sea quitarle el extra-alto fijo a tu configuración y ver cuántos días te dura el plan.
05 · CÓMO HABLARLE
Los seis ajustes que lo vuelven otro modelo
Opus 5 no te falla por falta de capacidad: te falla por exceso. Escribe de más, narra de más, deja documentos de más, se pasa del alcance que le diste, delega de más y te anuncia correcciones que a ti te dan igual. Los seis comportamientos tienen la misma cura, y no es subirle ni bajarle el esfuerzo: es una instrucción corta, escrita una sola vez, que le describe la forma que quieres. Anthropic publicó un patrón oficial para cada uno; aquí están traducidos a prompts que pegas tal cual.
Léelos como menú, no como receta: pega solo el que corresponda al comportamiento que te está estorbando. Y fíjate en cómo están escritos, porque ahí está la mitad del truco: cada uno describe la forma de trabajar que quieres, no una lista de prohibiciones. En Opus 5 los ejemplos positivos de cómo quieres que se comunique funcionan mejor que decirle lo que no debe hacer.
01
Concisión
Qué corrige: Respuestas más largas de lo que necesitas. Opus 5 escribe visiblemente más que Opus 4.8, incluso cuando la pregunta era chica.
Por qué pasa: Aquí cae casi todo el mundo: bajarle el esfuerzo NO acorta la respuesta. El esfuerzo controla cuánto piensa antes de contestar, no qué tan larga sale la contestación. Si la quieres corta, hay que pedirla corta — no existe una perilla que lo haga por ti.
1 · Que se acorte
Opus 5 escribe visiblemente más que Opus 4.8 por default, y bajarle el esfuerzo no lo acorta. Esto sí.
Para todo lo que escribas en esta conversación, mantén las respuestas enfocadas, breves y concisas.
- Ve directo a lo que te pedí: la mayor parte de la respuesta tiene que ser la respuesta, no el preámbulo ni el contexto.
- Deja cortas las advertencias, los descargos y las notas al margen. Con una línea basta.
- Cuando te pida que expliques algo, dame primero un resumen de alto nivel; entra a fondo solo si te lo pido.
- Si con tres líneas alcanza, dámelo en tres líneas. No completes espacio.
Recuerda: breve y al grano.
02
Narración
Qué corrige: En trabajo agéntico anuncia lo que va a hacer y comenta el camino; su salida por mensaje es más larga que en modelos anteriores.
Por qué pasa: No quieres apagarle la narración, quieres calibrarla: enterarte cuando encuentre algo o cambie de rumbo, y no antes. Aquí aplica el truco oficial de lleno — describirle con ejemplos positivos la cadencia que buscas rinde más que prohibirle hablar. Dile cómo se ve una buena actualización en vez de pedirle que no narre.
2 · Que te avise lo justo mientras trabaja
Calibra la narración en sesiones largas: una frase al arrancar, avisos solo cuando algo importa, y el resultado primero al terminar.
Cuando trabajes en algo que toma varios pasos, comunícate conmigo así:
- Antes de tu primera acción, dime en una frase qué vas a hacer.
- Mientras trabajas, dame una actualización breve solo cuando encuentres algo importante o cuando cambies de dirección. Los pasos de rutina no necesitan aviso.
- Al terminar, arranca con el resultado: la primera frase responde «qué pasó» o «qué encontré». El detalle va después de esa frase.
- Si algo te bloquea, dímelo apenas pase, junto con la salida que propones.
Esa es la cadencia que quiero: pocas actualizaciones, y cada una con información nueva.
03
Largo de documentos
Qué corrige: Los archivos que escribe a disco —reportes, resúmenes, markdown, notas— salen más largos de lo que hacía falta.
Por qué pasa: Es un comportamiento distinto del de la respuesta en pantalla, y por eso necesita su propia instrucción: puedes tener respuestas cortas y aun así documentos inflados, porque el largo del archivo lo decide aparte. Si le pediste concisión y los reportes siguen saliendo kilométricos, este es el que te faltaba.
3 · Documentos del largo que la tarea necesita
Para lo que escribe a disco —reportes, resúmenes, markdown, notas—: que cubra la sustancia sin secciones de relleno.
Cuando escribas un archivo o un documento —un reporte, un resumen, notas, un markdown—, ajusta el largo a lo que la tarea necesita.
- Cubre la sustancia completa: nada importante se queda fuera.
- No rellenes. Nada de secciones de paja, resúmenes que repiten lo que acabas de escribir, introducciones que anuncian lo que viene ni texto de molde.
- Si una sección no aporta información nueva, no la escribas.
- Un documento corto que cubre todo es mejor que uno largo que lo diluye.
04
Alcance
Qué corrige: Expande la tarea: agrega pasos que no pediste o aplica su propio criterio sobre qué debería ser el trabajo.
Por qué pasa: Es el lado incómodo de un modelo proactivo. La corrección no es amarrarlo —también te conviene que resuelva solo las decisiones de rutina—, es marcarle la frontera: opinar en una frase, sí; cambiar el trabajo por su cuenta, no. El mismo ajuste le pide cerrar lo que empezó, sin dejar partes a medias.
4 · Lo que pediste, ni más ni menos
El freno para un modelo proactivo: que opine en una frase y siga con la tarea como se la pediste, en vez de transformarla.
Entrégame lo que te pedí, al alcance que te lo pedí.
- Toma tú las decisiones de rutina, sin consultarme. Pregúntame solo cuando dos lecturas distintas de mi pedido lleven a trabajos materialmente distintos.
- Si crees que mi pedido está equivocado o que hay un camino mejor, dímelo en una frase y sigue con la tarea como te la pedí. No la angostes, no la amplíes ni la conviertas en otra cosa por tu cuenta.
- Termina la tarea completa, sin dejar partes a medias ni pendientes marcados para después.
- Y no te pases de lo que te pedí: si se te ocurre algo extra, proponlo al final en una línea en vez de hacerlo.
05
Subagentes
Qué corrige: Delega a subagentes con más facilidad que los modelos anteriores, incluso cuando la tarea la terminaba él en tres pasos.
Por qué pasa: Lo hace porque le sale bien: Anthropic reporta que coordina equipos de subagentes con patrones escritor-verificador efectivos y pocos casos de agentes que se pisan entre ellos. Pero cada subagente es trabajo nuevo que se come tu plan más rápido, así que si el costo te importa, ponle tope tú.
5 · Tope a la delegación
Opus 5 manda trabajo a subagentes con más facilidad que los modelos anteriores. Esto define cuándo vale la pena.
Sobre delegar trabajo a subagentes:
- Delega solo tareas grandes que sean genuinamente independientes y paralelizables, como investigar a lo ancho de muchos archivos a la vez.
- No delegues trabajo que puedas terminar tú en un puñado de pasos.
- No uses subagentes para verificar ni revisar tu propio trabajo.
- Si con un subagente alcanza, usa uno solo. Mantén el número bajo.
- Antes de lanzar más de uno, dime en una línea por qué esta tarea sí se parte en pedazos independientes.
06
Auto-corrección narrada
Qué corrige: Narra sus propias correcciones más que modelos anteriores: te cuenta que se equivocó en algo que a ti ni te movía la aguja.
Por qué pasa: Que se corrija solo es de lo mejor que trae; que te lo cuente todo, no. El filtro correcto no es prohibirle corregirse, es darle el criterio de qué amerita anuncio: si el error cambia tu código, tus conclusiones o una decisión tuya, quieres saberlo; si no, quieres el arreglo silencioso y que siga.
6 · Que se corrija sin narrarte cada tropiezo
Solo las correcciones que te cambian el código, las conclusiones o una decisión. El resto: arreglo silencioso y a seguir.
Cuando te des cuenta de que algo que dijiste antes estaba mal:
- Anúnciame la corrección solo si el error cambiaría el código, mis conclusiones o una decisión que voy a tomar.
- Cuando toque anunciarla, dilo simple y breve —qué era y qué queda en su lugar— y sigue con la tarea. Sin reconstruir cómo te equivocaste y sin disculparte.
- Si es un desliz que no cambia nada de eso, arréglalo y sigue sin decírmelo.
Dos detalles que valen por sí solos
Uno: los ejemplos positivos rinden más que las prohibiciones. Describe la forma que quieres en vez de listar lo que no debe hacer. Dos: en instrucciones largas conviene repetir un recordatorio corto cerca del final —«recuerda: respuestas breves y al grano»—; así lo recomienda la doc oficial.
Dónde se pegan
Estos ajustes no son para reescribirlos en cada chat. Se pegan una vez, en el lugar que corresponda al alcance que quieres:
Instrucciones personalizadas de tu cuenta
En claude.ai. Aplican a todo lo que hagas con Claude, sin importar el proyecto. Aquí va lo que quieres siempre: concisión y alcance son los dos candidatos obvios.
Instrucciones de un proyecto
En un proyecto de claude.ai o de Cowork. Aplican solo dentro de ese proyecto. Aquí va lo que depende del trabajo: el largo de los documentos si es un proyecto de reportes, la narración si es uno agéntico.
El archivo CLAUDE.md de tu carpeta
Si usas Claude Code. Aplica a ese repositorio y lo lee en cada sesión. Aquí van narración, subagentes y auto-corrección: son los tres que se notan cuando lo dejas correr solo.
Regla práctica: si te descubres pegando el mismo párrafo por tercera vez en un chat, ese párrafo pertenece a uno de esos tres lugares. Y no los pegues los seis por si acaso: cada instrucción que agregas compite por atención con las demás.
06 · BORRA ESTO
Lo que heredaste y ahora te estorba
Si llevas tiempo usando Claude, tus instrucciones personalizadas, tu CLAUDE.md y tus skills están llenos de líneas que escribiste para un modelo que ya no existe. En Opus 4.8 y antes tenían todo el sentido: había que empujarlo a verificar, a revisar dos veces, a no dispersarse. Opus 5 ya hace eso solo, así que esas mismas líneas hoy trabajan en tu contra: te cuestan tokens y, en un caso concreto, te cuestan calidad directa.
Esta es la lista. Abre tu prompt más usado mientras la lees y ve tachando.
«Verifica tu trabajo»
«Incluye un paso final de verificación para cualquier tarea no trivial»
«Usa un subagente para verificar»
Opus 5 se verifica solo, sin que se lo pidas. Dejar esas líneas provoca sobre-verificación: repasa lo que ya repasó y quema tu plan en pasadas que no cambian el resultado. La documentación oficial es literal aquí — quitarlas reduce tokens desperdiciados sin pérdida de calidad. No es un intercambio: es ahorro puro.
«Revisa dos veces antes de responder»
«Re-verifica antes de contestar»
«Confirma que tu respuesta es correcta antes de dármela»
Misma familia, mismo problema. Suenan a rigor y hoy son ruido: le pides una segunda pasada a un modelo que ya la hizo. La señal de que las traes de más es fácil de reconocer: respuestas que empiezan repasando lo que acaba de hacer antes de decirte el resultado.
«Reporta solo los problemas de severidad alta»
«Sé conservador en lo que reportes»
«Menciónalo solo si estás seguro»
Este es el que casi nadie sabe, y el único de la lista que te cuesta calidad y no nada más tokens. En prompts de revisión de código, Opus 5 sigue esa instrucción al pie de la letra y te reporta menos de lo que encontró. Y ya ni falta hace filtrarlo: Anthropic reporta alta precisión y alto recall a la vez — encuentra bugs reales a buena tasa por pasada y sus hallazgos extra son en su mayoría problemas reales, no falsos positivos. El filtro que pusiste para no ahogarte en ruido hoy te esconde bugs.
En su lugar: Pídele que reporte todo, sin filtrar por severidad, y clasifica en un segundo paso aparte. El prompt de abajo ya está escrito así.
«No pienses, responde directo»
«No razones»
«Contesta sin analizar»
Apagar el pensamiento no compra lo que crees. La recomendación oficial va justo al revés: mantén el pensamiento encendido y controla el gasto con el nivel de esfuerzo, porque en la mayoría de las tareas el pensamiento encendido en esfuerzo bajo rinde mejor que el pensamiento apagado a un costo parecido. Y en Opus 5 el pensamiento además es adaptativo: el modelo ya decide solo cuándo no vale la pena razonar de más.
En su lugar: Baja el esfuerzo a bajo o medio en vez de apagar el pensamiento. Y si lo que buscabas era una respuesta más corta, eso se pide con concisión, no con esfuerzo.
Trucos de prompt de visión afinados para modelos anteriores
«Describe la imagen paso a paso antes de analizarla»
Los rodeos que inventaste para que un modelo viejo leyera bien una gráfica o un diagrama puede que ya no hagan falta. Re-valídalos: corre la tarea sin el truco y compara. Y guárdate el dato que sí mueve la aguja en lo visual — darle herramientas para analizar, recortar y verificar su propio trabajo rinde más que hacerlo pensar más. El uso de herramientas es una palanca más rentable que el pensamiento por sí solo.
Andamiaje viejo que agrega pasos de verificación aparte
Cadenas de «hazlo → revísalo → confírmalo» dentro de tus flujos
Esto no vive solo en tus prompts: también está en cómo armaste tus flujos, tus skills y tus comandos. Si tienes un paso de revisión que existe únicamente porque el modelo anterior no se revisaba solo, ese paso hoy duplica trabajo. Quítalo, corre el flujo sin él y compara el resultado antes de decidir.
«Si tu prompt contiene instrucciones explícitas de verificación, quítalas: instrucciones así causan sobre-verificación en Claude Opus 5, y quitarlas reduce tokens desperdiciados sin pérdida de calidad.»
Documentación oficial de Anthropic sobre Claude Opus 5
En vez de hacer la limpieza a mano, pásasela a él. El primer prompt audita las instrucciones que ya tienes; el segundo reemplaza el prompt de revisión de código que traías.
Que audite tus instrucciones viejas por ti
Pégale tus instrucciones personalizadas, tu CLAUDE.md o el prompt que más usas y que él te diga qué líneas ya sobran con Opus 5.
Quiero que audites mis instrucciones actuales pensando en Claude Opus 5, que ya razona por su cuenta y ya se verifica solo sin que se lo pidan.
Estas son mis instrucciones:
[PEGA AQUÍ TUS INSTRUCCIONES PERSONALIZADAS, EL CLAUDE.md DE TU PROYECTO O EL PROMPT QUE MÁS USAS]
Revísalas línea por línea y devuélveme tres listas, cada punto citando textualmente la línea de la que hablas:
1. BORRAR — lo que hoy sobra o es contraproducente: instrucciones de verificar el trabajo, de revisar dos veces o de re-verificar antes de responder; pasos de verificación delegados a un subagente; instrucciones de no pensar o no razonar; filtros del tipo «reporta solo lo grave» o «sé conservador»; y andamiaje que agrega pasos de revisión aparte. Para cada una, una línea de por qué sobra.
2. REESCRIBIR — lo que sí quiero conservar pero está mal formulado: prohibiciones del tipo «no hagas X» que rendirían más como ejemplos positivos de la forma que quiero. Dame la versión reescrita.
3. AGREGAR — lo mínimo que falta, si falta: concisión, largo de los documentos que escribes, alcance de la tarea y tope de delegación.
No reescribas el documento entero ni me des consejos generales. Al final, y solo al final, dame la versión limpia completa en un bloque para copiar.
El prompt de revisión de código, corregido
Reemplaza el que decía «solo severidad alta». Reporta todo primero, filtra después: así no te esconde hallazgos reales.
Revisa este [CÓDIGO / PULL REQUEST / ARCHIVO]:
[PEGA EL CÓDIGO O INDICA LOS ARCHIVOS]
Reporta todo lo que encuentres, sin filtrar por severidad y sin ser conservador: bugs, casos borde, condiciones de carrera, fugas de recursos, validaciones que faltan, manejo de errores incompleto, nombres confusos y deuda técnica. Si dudas de algo, inclúyelo y marca la duda; yo decido.
Para cada hallazgo dame: archivo y línea, qué está mal en una frase, y qué pasa si se queda así.
Cuando termines la lista completa, en un segundo paso aparte clasifícala en alta, media y baja, y dime cuáles arreglarías primero y por qué.
Falta una herencia que no está en tus prompts sino en tu configuración: el nivel de esfuerzo. Si traes niveles heredados de Opus 4.7 o 4.8 —donde la recomendación oficial era arrancar en extra-alto—, la doc pide correr un barrido de esfuerzo nuevo sobre tus propias pruebas en vez de reusar los de antes.
En Opus 5 casi siempre ganas quitando instrucciones, no agregándolas.
Cada línea que borras es atención que le devuelves a la que sí importa. Si algo no sale como quieres, tu primer instinto ya no debería ser agregar un párrafo: es preguntarte cuál de los que ya tienes está peleando con el modelo.
07 · EL MILLÓN
Un millón de contexto y memoria hasta mayo
El millón de tokens de Opus 5 trae un detalle que casi nadie subraya: es el default y el máximo a la vez. No hay una versión chica que se te llene a media tarde ni un modo largo que tengas que activar aparte — abres una conversación y ya lo traes puesto. Traducido a algo que se pueda ver: el contrato entero con todos sus anexos, el expediente completo, el hilo de soporte de los últimos dos años, adentro y de una.
Y aquí va el dato que de verdad cambia cómo trabajas, el que rara vez se menciona: en Opus 5 el seguimiento de instrucciones, las llamadas a herramientas y el razonamiento se mantienen consistentes a lo largo de toda la ventana. En cristiano: la regla que le pusiste en el primer mensaje sigue en pie cuando va en la página doscientos del documento. Con modelos anteriores la costumbre era repetir las instrucciones cada cierto tramo porque se iban diluyendo; aquí ese recordatorio de más ya no hace falta y solo ocupa espacio. Ordena tus mensajes largos así: primero las reglas y el formato de salida, luego el material, y hasta el final la pregunta.
Del otro lado del tubo puede escribir hasta 128 mil tokens de un jalón. No es un dato de adorno: significa que le puedes pedir el entregable completo —el manual, el reporte, el documento entero— sin partirlo en episodios ni escribirle «continúa» tres veces.
El dato de oro: sabe hasta mayo de 2026
El conocimiento de Opus 5 llega hasta mayo de 2026. Fable 5 y Sonnet 5 se quedaron en enero de 2026, cuatro meses antes. Eso convierte a Opus 5 en el modelo de Claude que sabe cosas más recientes, aunque no sea el más capaz de la familia — y son dos cosas distintas que conviene no confundir. Si tu pregunta toca algo que se movió entre febrero y mayo de 2026, Opus 5 es el único que lo trae de primera mano; a los otros dos les vas a tener que pegar el contexto.
Tres formas concretas de usar ese espacio, con la instrucción que hace la diferencia en cada una:
El documento completo, no los fragmentos
Recortar el contrato a «las partes importantes» mata justo lo que buscas: la cláusula 14 que modifica la 3, el anexo que contradice el cuerpo, el plazo que no cuadra con el de la página anterior. Las referencias cruzadas solo se ven con el texto entero adentro.
Cómo pedirlo: Pega el archivo completo y dile por escrito: «no lo resumas, léelo entero y cita la cláusula exacta de cada hallazgo».
La conversación entera, no tu resumen de ella
El resumen que le pegas ya viene con tu lectura del problema puesta. El hilo crudo de soporte, la cadena de correos completa o los ochenta mensajes con el cliente traen lo que de verdad se dijo y en qué orden.
Cómo pedirlo: Pega la conversación sin editar y pídele la línea de tiempo citando el mensaje donde pasó cada cosa.
El manual entero antes de preguntar
Es la diferencia entre que te conteste de memoria y que te conteste leyendo. Con la documentación completa dentro de la conversación, deja de rellenar huecos con lo que sabe de otras fuentes.
Cómo pedirlo: Pega la documentación completa primero y agrega la regla: «si la respuesta no está en este material, dilo y para».
El documento completo, de una
Para contratos, políticas y expedientes largos. Pega el archivo entero, sin recortar.
Te voy a pegar el [DOCUMENTO: CONTRATO / POLÍTICA / EXPEDIENTE] completo, sin recortes. No lo resumas: léelo entero antes de opinar.
Reglas para toda la conversación:
1. Todo lo que afirmes tiene que estar en el texto. Si no está, dilo así: "no está en el documento".
2. Cada hallazgo va con su ubicación exacta: cláusula, sección o página.
3. Me interesan las contradicciones internas: cláusulas que se modifican entre sí, anexos que chocan con el cuerpo, plazos que no cuadran.
Entrégame, en este orden: los tres riesgos más caros para [MI LADO: EL COMPRADOR / EL PROVEEDOR / LA EMPRESA] con su cláusula, las obligaciones con fecha (quién debe qué y cuándo) y lo que falta y debería estar ahí.
Arranca con la conclusión en una frase. El detalle va después.
[PEGA AQUÍ EL DOCUMENTO COMPLETO]
La conversación entera de soporte
Para hilos largos con un cliente: qué pasó de verdad y dónde se atoró.
Te voy a pegar la conversación completa con [CLIENTE / USUARIO], de principio a fin y sin editar. Léela toda antes de sacar conclusiones.
Necesito cuatro cosas:
1. La línea de tiempo real del problema: qué pasó, en qué mensaje se dijo y en cuál se atoró.
2. Qué pidió el cliente, separado de lo que nosotros entendimos. Cita el mensaje donde se ve la diferencia.
3. Los momentos en que se pudo cerrar antes y no se cerró.
4. Cómo quedó: qué está prometido, qué está pendiente y quién tiene la pelota.
Si algo no se puede saber con lo que está en el hilo, dilo en vez de suponerlo. Respuesta breve; extiéndete solo donde cambie una decisión.
[PEGA AQUÍ LA CONVERSACIÓN COMPLETA]
El manual entero antes de preguntar
Convierte la documentación de una herramienta o normativa en tu fuente única por esa conversación.
Te voy a pegar la documentación completa de [HERRAMIENTA / SISTEMA / NORMATIVA]. Léela entera antes de responder nada.
Regla para toda la conversación que siga: responde solo con lo que esté en ese material. Si la respuesta no está ahí, di "no viene en la documentación" y para. No completes con lo que sepas por otras fuentes.
Cuando termines de leerla, dame un mapa de una página: qué cubre, cómo está organizada y las tres cosas que más se van a preguntar. De ahí en adelante te haré preguntas sueltas: en cada una, la respuesta primero y la sección de donde salió después.
[PEGA AQUÍ LA DOCUMENTACIÓN COMPLETA]
La nota honesta: llenar el contexto no sale gratis. Una conversación con el millón puesto se come tu plan mucho más rápido que una normal, y lo vas a notar en los límites antes que en ningún otro lado. El millón no es para presumirlo todos los días: es para cuando el trabajo de verdad lo pide —el expediente completo, el hilo entero, la documentación completa—. Para todo lo demás, una conversación limpia y corta te rinde más.
08 · DÓNDE BRILLA
Los siete carriles donde te va a sorprender
Anthropic publicó dónde rinde mejor Opus 5, pero la lista sirve de poco si te quedas en «es bueno para código». Lo útil es saber cómo pedírselo en cada carril, porque en varios de ellos la forma de pedir cambió respecto de los modelos anteriores. Estos son los siete, con la instrucción concreta que hace la diferencia:
01
Código agéntico difícil
Features de varios archivos, refactors grandes, trabajo de punta a punta. Lo que más se nota es que termina la tarea completa en vez de dejarte stubs, placeholders y un «aquí implementarías esto». En tareas fáciles de un solo turno también va bien, pero ahí la diferencia con modelos anteriores es chica.
Cómo pedirlo: Dale la especificación completa por adelantado y déjalo correr. Rinde peor si se la sueltas en cachitos y lo interrumpes cada dos pasos: cada corte lo obliga a re-planear con información incompleta.
02
Revisión de código y caza de bugs
Alta precisión y alto recall al mismo tiempo: encuentra bugs reales a buena tasa por pasada, y sus hallazgos extra son en su mayoría problemas reales, no falsos positivos. El detalle aprovechable: la exactitud aguanta en niveles de esfuerzo bajos.
Cómo pedirlo: Usa las dos velocidades: una pasada rápida y barata en esfuerzo bajo mientras revisas, y una a fondo después. Y no le pidas «solo lo grave»: si tu prompt dice «reporta solo severidad alta» o «sé conservador», te va a hacer caso literal y va a reportar de menos. Pídele todo y filtra tú en un paso aparte.
03
Visión
Gráficas, documentos y diagramas; también replicar interfaces y visuales de frontend a partir de una imagen.
Cómo pedirlo: Dale herramientas para recortar, medir y verificar lo que ve en vez de subirle el esfuerzo: en visión, el uso de herramientas es una palanca más rentable que pensar más. Y re-valida los trucos de prompt que afinaste para modelos anteriores, porque puede que ya no hagan falta.
04
Oficina y documentos
Genera y trabaja hojas de cálculo de varias pestañas con fórmulas no triviales, y produce presentaciones bien estructuradas. No es solo texto bonito: es el archivo armado.
Cómo pedirlo: Dale el estilo o la plantilla que tiene que seguir. Sin eso se inventa su propio formato, y en documentos de oficina el formato es la mitad del trabajo.
05
Coordinación multi-agente
Coordina equipos de subagentes bien: los patrones escritor-verificador funcionan y casi no se pisan el trabajo entre ellos.
Cómo pedirlo: Ponle tope explícito a la delegación cuando te importe el gasto. Delega con más facilidad que los modelos anteriores, y cada subagente que lanza es contexto nuevo que se come tu plan.
06
Razonamiento profundo sostenido
Sostiene análisis de varios pasos a lo largo de cadenas largas de problema, sin perder el hilo a media faena.
Cómo pedirlo: Dale el problema entero de una y pídele que no te entregue conclusiones parciales hasta cerrar la cadena. Es de los pocos lugares donde subir a extra-alto (xhigh) o máximo se justifica de verdad.
07
Ciencias de la vida
Mejor que Opus 4.8 en todas las evaluaciones de ciencias de la vida que reportó Anthropic. Dos cifras concretas: +10.2 puntos porcentuales en química orgánica y +7.7 en predicción del efecto de variantes de proteínas.
Cómo pedirlo: Si venías usando Opus 4.8 para trabajo técnico de este tipo, vuelve a correr tus casos difíciles en Opus 5 antes de dar por buena la configuración que traías.
La especificación completa por adelantado
El formato que más le rinde en trabajo agéntico: todo de una y sin interrupciones.
Te doy la tarea completa de una vez. Léela entera antes de tocar nada y trabájala de punta a punta sin pedirme confirmación paso a paso.
Qué quiero: [DESCRIBE LA FUNCIONALIDAD O EL CAMBIO, COMPLETO]
Dónde vive: [ARCHIVOS / CARPETAS / SISTEMA]
Cómo sé que quedó bien: [CRITERIO DE ACEPTACIÓN: QUÉ TIENE QUE PASAR PARA DARLO POR HECHO]
Restricciones: [LO QUE NO SE TOCA / EL ESTILO QUE HAY QUE RESPETAR]
Reglas de trabajo:
- Termina la tarea completa. Nada de stubs, placeholders ni "aquí iría".
- Entrega lo que pedí, al alcance que pedí: las decisiones de rutina tómalas tú. Si algo del pedido te parece equivocado o ves un camino mejor, dilo en una frase y sigue con lo que pedí.
- Antes de tu primera acción, dime en una frase qué vas a hacer. Después, actualízame solo cuando encuentres algo importante o cambies de rumbo.
- Al terminar, arranca con el resultado: qué quedó hecho y qué no.
Revisión de código: que reporte todo
El tip que casi nadie sabe. Pídele todo y filtra tú después, nunca al revés.
Revisa [ARCHIVO / CARPETA / CAMBIO] y repórtame TODO lo que encuentres. No filtres por severidad ni seas conservador: si algo te parece dudoso, va en la lista.
Para cada hallazgo:
- Dónde está: archivo y línea.
- Qué está mal, en una frase.
- Qué pasa si no se arregla.
- Qué tan seguro estás: alto, medio o corazonada.
Ordénalos por impacto real, no por qué tan fáciles son de arreglar. Al final, en tres líneas: lo que arreglarías hoy si solo tuvieras una hora.
No apliques ningún cambio. Yo filtro en un paso aparte.
Hoja de cálculo o presentación con tu plantilla
El carril de oficina se cae sin plantilla. Dale el formato antes que los datos.
Arma [LA HOJA DE CÁLCULO / LA PRESENTACIÓN] de [TEMA].
Sigue exactamente este formato: [PEGA LA PLANTILLA, EL ARCHIVO DE EJEMPLO O LA DESCRIPCIÓN DEL ESTILO: TIPOGRAFÍAS, COLORES, ORDEN DE LAS SECCIONES, CÓMO SE NOMBRAN LAS PESTAÑAS].
Estructura que necesito: [PESTAÑAS O SECCIONES, EN ORDEN]
Datos de entrada: [PEGA O ADJUNTA LOS DATOS]
Las fórmulas van vivas, no valores escritos a mano: quiero cambiar un dato de entrada y que se recalcule todo. Al terminar, dime en tres líneas qué supuestos usaste donde los datos no alcanzaban.
Bajar el esfuerzo para la pasada rápida de revisión
/effort
Dos de los siete carriles se resuelven moviendo el esfuerzo, no el prompt: revisión de código hacia abajo, razonamiento profundo hacia arriba. Si quieres los cinco niveles con dónde se cambian en el chat, en Cowork y en Claude Code:
Cuatro voces on-record del anuncio de Anthropic, cada una con su cifra. No son impresiones: son equipos que lo corrieron contra sus propias tareas.
«Supera a Opus 4.8 por 8%.»
11% de mejora en flujos de análisis de datos y 17% en due diligence.
Ben Kus · CTO de Box
«22% arriba de Opus 4.7 en las tareas de código agéntico más difíciles.»
Y mucha menos varianza de corrida a corrida.
Fabian Hedin · Co-Founder de Lovable
«El salto más claro en resolución de problemas que hemos visto de un modelo de Claude al siguiente.»
Piensa más antes de escribir una sola línea y atrapa sus propias fallas de lógica durante la planeación.
Denis Shiryaev · Head of AI in IDE de JetBrains
«Los modelos anteriores no pasaban; Opus 5 llegó a 100%.»
Encabezó el leaderboard de AutomationBench.
Wade Foster · CEO de Zapier
Un aviso que aplica a los siete carriles: todo esto se mide en trabajo terminado, no en velocidad. Opus 5 delega a subagentes con más facilidad que los modelos anteriores y su salida por mensaje es más larga, así que los carriles donde más brilla —lo agéntico, lo multi-agente, el razonamiento sostenido— son también los que más rápido se comen tu plan. Elígelos a propósito, no por inercia.
09 · LA FAMILIA
Cuándo subir a Fable 5 y cuándo bajar a Sonnet 5
Opus 5 no vive solo. En julio de 2026 la familia de Claude tiene cuatro modelos de disponibilidad general, y elegir bien entre ellos te ahorra más que cualquier truco de prompt. Aquí no vas a ver precios por token porque tú no los pagas: el único eje de costo que te importa es qué tan rápido se come tu plan cada modelo. Fable 5 es el que más rápido lo vacía —Anthropic ubica a Opus 5 en la mitad de lo que cuesta Fable—, Sonnet 5 rinde bastante más y Haiku 4.5 casi no pesa.
La tabla de abajo es tu referencia rápida. Fíjate sobre todo en dos columnas que casi nadie compara de verdad: la memoria de trabajo (cuánto le cabe de una sentada) y hasta cuándo sabe. Ahí están las dos sorpresas de esta generación.
Los cuatro modelos de julio de 2026
Modelo
Rol
Memoria de trabajo
Sabe hasta
Velocidad
Para qué sí
Fable 5
Lo más capaz de disponibilidad general (clase Mythos)
1 millón
Enero 2026
Más lento
Agentes que corren durante días y cargas que piden la mayor capacidad disponible.
Opus 5
El caballo de todos los días para trabajo complejo
1 millón
Mayo 2026
Moderada
Código agéntico de varios archivos, revisión de código, documentos y hojas de cálculo, razonamiento de muchos pasos.
Sonnet 5
El mejor balance entre velocidad e inteligencia
1 millón
Enero 2026
Rápida
Iterar rápido, tareas medianas y todo el volumen que no amerita Opus.
Haiku 4.5
El más rápido, con inteligencia casi de frontera
200 mil
Febrero 2025
La más rápida
Subagentes y respuestas instantáneas donde la espera es el problema.
Falta uno en la lista: Mythos 5. Existe, pero sigue siendo solo por invitación dentro del Project Glasswing, así que no es de disponibilidad general y no lo vas a ver en tu selector. Fable 5 es la clase Mythos que sí puedes usar hoy.
La regla oficial, textual
"Si no estás seguro de cuál usar, empieza con Claude Opus 5 para código agéntico complejo y trabajo de empresa. Para cargas que necesitan la mayor capacidad disponible, usa Claude Fable 5."
Léela despacio, porque cambió algo de fondo: el punto de partida recomendado ya no es «el más capaz que puedas pagar», es Opus 5. Fable 5 quedó como la excepción para cuando el techo de capacidad es lo que te está frenando, no como el default de la gente ambiciosa.
Cuándo subir a Fable 5
Subes cuando el problema es de techo, no de esfuerzo. Si todavía no agotaste la escalera de esfuerzo dentro de Opus 5, el salto es prematuro.
Agentes que corren durante días
Fable 5 es el modelo pensado para agentes de larga duración. Si lo tuyo no es una tarea de una sesión sino un proceso que sigue vivo día tras día, ese es su terreno.
Cuando la tarea pide la mayor capacidad disponible
Es la frase textual de Anthropic. Traducida: cuando el resultado vale más que el gasto y quieres el techo más alto que existe hoy en disponibilidad general, sin discutir cuánto se come tu plan.
Cuando Opus 5 en máximo ya se quedó corto
Primero recorre la escalera completa dentro de Opus 5. Si en máximo la calidad sigue sin alcanzar —la calidad, no la longitud—, entonces sí el problema es de modelo y no de perilla.
Cuando ya lo mediste y la diferencia se paga sola
En CursorBench 3.2, Anthropic reporta que Opus 5 quedó a 0.5% del pico de Fable 5, a la mitad del costo. Ese medio punto casi nunca justifica el salto; cuando en tus propias pruebas sí lo justifica, súbete sin culpa.
Cuándo bajar a Sonnet 5
Bajas cuando lo que te falta es velocidad y plan, no inteligencia. Sonnet 5 trae el mismo millón de contexto y latencia rápida contra la moderada de Opus.
Vas a iterar veinte veces
Cuando corres la misma tarea una y otra vez cambiando detalles, el cuello de botella es la espera, no el razonamiento. Ahí la diferencia de calidad rara vez te cambia la decisión y la de velocidad sí te cambia la tarde.
Tareas fáciles de un solo turno
Anthropic reconoce que en tareas de un turno la ventaja de Opus 5 sobre modelos anteriores es más chica. Si tu trabajo es corto y repetido, es justo donde Opus se paga peor.
Borradores y exploración
Para tantear enfoques o sacar un primer borrador, Sonnet 5 llega bien. Sube a Opus 5 cuando ya sepas qué quieres construir y le puedas dar la especificación completa por adelantado, que es donde Opus rinde más.
Te queda poco plan y el mes va largo
El criterio menos técnico y el más real. Antes de racionar tu Opus a la mitad, mueve a Sonnet 5 todo lo que no lo necesita y guarda el músculo para lo que sí.
El detalle que voltea la intuición
Opus 5 sabe hasta mayo de 2026. Fable 5 y Sonnet 5 se quedaron en enero de 2026. Para preguntas sobre lo que pasó entre enero y mayo de 2026, el modelo «más capaz» no es el que más sabe: Fable 5 razona mejor sobre lo que tú le des, pero por su cuenta trae cuatro meses menos de mundo. Si tu pregunta depende de hechos recientes, o le pegas el material a Fable, o se la haces directo a Opus 5.
Cambiar de modelo en Claude Code
/model
Te muestra cuál traes puesto y te deja moverte entre los modelos disponibles en tu plan; en claude.ai el mismo cambio se hace desde el selector de modelo. Y ubica dónde estás parado: Opus 5 es el modelo por default en Max y el más fuerte disponible en Pro, en claude.ai, Claude Code, Claude Cowork y las apps de Claude.
10 · LO HONESTO
Lo que Opus 5 no es
Todo lo de arriba es lo que sí hace. Esta sección es la otra mitad, sin suavizar, porque es la parte que no aparece en los hilos de lanzamiento.
Empecemos por la más grande: Anthropic no dice que Opus 5 sea su modelo más inteligente. Fable 5 y Mythos 5 siguen arriba en capacidad máxima. El argumento de Opus 5 es inteligencia por costo —se acerca a la frontera a la mitad del precio—, no el pico. Si alguien te lo vende como «el mejor modelo de Claude», está firmando algo que la propia Anthropic no firmó.
El máximo no siempre es mejor
El nivel máximo puede mostrar rendimientos decrecientes por el uso extra de tokens y es propenso a sobrepensar tareas simples. Dejarlo fijo hasta arriba no es una estrategia de calidad: es una forma silenciosa de quemarte el plan.
Es más verboso por default
Sus respuestas visibles salen más largas que en Opus 4.8, narra más mientras trabaja y los documentos que escribe a disco crecen. Y ojo: bajar el esfuerzo no lo arregla, porque el esfuerzo controla cuánto piensa, no qué tan larga sale la respuesta. La concisión hay que pedirla explícitamente.
Puede expandir el alcance
Es proactivo, y eso trae su costo: puede agregar pasos que no pediste o aplicar su propio criterio sobre qué debería ser la tarea. Cuando el alcance importa, hay que fijarlo por escrito en el prompt.
Delega más de lo necesario
Lanza subagentes con más facilidad que los modelos anteriores. Los coordina bien —los patrones escritor-verificador le salen y casi no se pisan entre ellos—, pero si te importa el gasto tienes que ponerle tope tú.
Ciberseguridad: lo que sí y lo que no
Opus 5 encuentra vulnerabilidades en código fuente, y para trabajo defensivo eso ya es mucho. Pero hay tres cosas que siguen bloqueadas y conviene saberlo antes de armar un flujo completo alrededor:
—El escaneo basado en binarios
—Las pruebas de penetración
—La generación de exploits
La parte fina: sus clasificadores intervienen alrededor de 85% menos seguido que los de Fable 5, así que en trabajo legítimo se te atraviesan mucho menos. Y cuando una petición sí queda marcada, no se rechaza en seco: cae a Opus 4.8 por default en claude.ai, Claude Code y Cowork. Si a media sesión de seguridad sientes que el modelo «cambió de personalidad», probablemente es eso.
Y una nota sobre los benchmarks
Los números de esta guía vienen del anuncio de Anthropic y están atribuidos como tales a propósito. Vale la pena decir en voz alta lo obvio: los números que publica un fabricante son los que le favorecen. Nadie publica la prueba donde salió mal.
Los rankings de terceros tampoco cierran el hueco: cada uno usa un arnés distinto —herramientas, reintentos, andamiaje, a veces asistencia de respaldo cuando el modelo falla— y eso hace que sus resultados no sean comparables directo con los oficiales ni entre sí. La única medición que de verdad decide tu caso es la tuya: agarra tres tareas reales de tu trabajo, córrelas con el modelo y el esfuerzo que traías, y luego con los nuevos. Ese es el benchmark que importa.
Nada de esto lo vuelve un mal modelo, al contrario: en auditoría automatizada de comportamiento sacó 2.3 en comportamiento desalineado, el más bajo de los modelos recientes, y Anthropic lo llama su modelo más alineado hasta la fecha, con las tasas más bajas de comportamiento engañoso. Solo significa que Opus 5 rinde cuando lo diriges, y se dispersa cuando lo dejas suelto.
11 · FAQ
Preguntas rápidas
¿Lo tengo en mi plan?
Si estás en Max, sí: Opus 5 es tu modelo por default. Si estás en Pro, también lo tienes, y además es el modelo más fuerte disponible ahí. Vive en claude.ai, Claude Code, Claude Cowork y las apps de Claude.
¿Tengo que hacer algo para activarlo?
No. El pensamiento viene encendido de fábrica y el esfuerzo arranca en alto en Claude Code, así que poner «alto» a mano es idéntico a no poner nada. Lo que sí conviene hacer es quitarle instrucciones viejas, no agregarle nuevas.
¿Por qué ahora me contesta más largo?
Porque es más verboso por default: las respuestas visibles, la narración mientras trabaja y los documentos que escribe salen más largos que en Opus 4.8. No es un error. Si los quieres cortos, pide concisión explícitamente en el prompt.
¿Le subo el esfuerzo al máximo y ya?
No. La recomendación oficial es empezar en alto —el default— y subir a extra-alto solo para código y trabajo agéntico exigente, o a máximo cuando la tarea justifique gasto de tokens sin restricción. El máximo es propenso a sobrepensar lo simple.
¿Sigo usando Sonnet 5 para algo?
Sí, cuando lo que te falta es velocidad y no inteligencia. Trae el mismo millón de contexto y latencia rápida. Úsalo para iterar, tareas de un solo turno y volumen; guarda Opus 5 para lo complejo.
¿Fable 5 sigue siendo mejor?
En capacidad máxima sí: Fable 5 y Mythos 5 siguen arriba, y Anthropic nunca dijo lo contrario. Pero en CursorBench 3.2 reporta a Opus 5 a 0.5% del pico de Fable, a la mitad del costo. La pregunta real es si ese medio punto te cambia algo.
¿Por qué se pone a verificar solo?
Porque lo hace por diseño: se revisa a sí mismo sin que se lo pidas. El problema aparece cuando además tu prompt viejo se lo ordena, porque ahí se duplica y sobre-verifica. Quita esas líneas y va a seguir verificándose igual, con menos tokens.
¿Por qué lanzó cinco subagentes cuando pedí algo chico?
Porque delega con más facilidad que los modelos anteriores. La regla que le puedes dar: delegar solo para trabajo grande, genuinamente independiente y paralelizable; nada de subagentes para revisar su propio trabajo; y si uno basta, uno.
¿Tengo que rehacer mis instrucciones viejas?
Sí, y es lo primero. Anthropic lo dice textual: si traías configuraciones de esfuerzo de un modelo anterior, corre un barrido de esfuerzo nuevo sobre tus propias pruebas en vez de reusarlas. Lo mismo aplica a los trucos de prompt de visión que afinaste antes.
¿El millón de contexto está siempre encendido?
Sí. En Opus 5 el millón de tokens es el default y el máximo a la vez: no hay variante chica ni modo largo que activar. La salida máxima es de 128 mil tokens, y el seguimiento de instrucciones se mantiene consistente a lo largo de toda la ventana.
Esta guía junta en un solo lugar lo que cambió con Opus 5: el comportamiento nuevo, el ajuste de esfuerzo, las instrucciones que ahora sobran y los prompts para dirigirlo. Se publica como parte de la bóveda de tododeia.
Cierre · pruébalo hoy con un prompt que ya tengas
“Yo llevo días usándolo y lo que más me sirvió no fue pedirle más, fue quitarle cosas: borré de mis prompts las líneas de «verifica» y «revisa dos veces», bajé el esfuerzo de extra-alto a alto y le pedí que se acortara. Hazlo hoy mismo: abre tu prompt más usado, tacha esas líneas, córrelo tal cual en Opus 5 y compara. Es un cambio de dos minutos y se nota en la primera respuesta.”
Anthropic no dice que Opus 5 sea su modelo más inteligente: Fable 5 y Mythos 5 siguen arriba en capacidad máxima, y el argumento de Opus 5 es inteligencia por costo, no el pico. También es más verboso por default, así que si no le pides concisión te va a escribir de más. El nivel máximo puede sobrepensar tareas simples y dar rendimientos decrecientes por los tokens extra. Y en ciberseguridad hay límites vigentes: encuentra vulnerabilidades en código fuente, pero el escaneo de binarios, las pruebas de penetración y la generación de exploits siguen bloqueados, y las peticiones marcadas caen a Opus 4.8 por default. Nada de eso lo hace peor: solo significa que rinde cuando lo diriges, no cuando lo dejas suelto.