Claude Opus 5.5: nivel Fable para el trabajo de todos los días
Opus 5.5 rinde al nivel de Fable 5.1 en la mayoría del trabajo, escribe más claro, es más rápido que Opus 5 y termina lo mismo gastando menos. En Claude Code ya es el modelo por defecto. Aquí va qué cambió, dónde brilla, qué dicen de verdad sus números y los prompts para estrenarlo.
De qué va
En corto: en la mayoría del trabajo rinde como Fable 5.1, y aun así se come tu plan más lento que Opus 5. Lo que cambia en tu día a día es poco y concreto: piensa siempre, arranca en esfuerzo medio y te cuenta lo que hizo en lenguaje llano.
Es el primer modelo de la familia Claude 5.5. Anthropic lo presenta como un salto grande sobre Opus 5 y dice que su ventaja más clara es la eficiencia: cuesta menos correrlo y usa menos para la misma tarea. En Claude Code es el modelo por defecto en Pro, Max, Team y Enterprise, y Anthropic subió los límites de cinco horas en Pro, Max, Team y Enterprise por asiento. Los números del anuncio son buenos, pero el propio Anthropic advierte que a este nivel las diferencias de benchmark ya dicen poco del uso real. Esta página los pone con su letra chica, sin inflarlos.
Once secciones y nueve prompts para copiar. Si ya lo usas y quieres hablarle mejor, ve directo a Prompting para Opus 5.5.
Las once secciones
Un Opus que trabaja a nivel Fable
El primero de la familia 5.5, y el matiz que casi nadie cita: «en la mayoría del trabajo».
Escribe más claro y llega antes
Lo importante primero, menos jerga, más rápido y menos vueltas para cerrar una tarea.
Default en Claude Code, límites más altos
Qué cambia en cada superficie, el reset que puedes guardar y lo que Anthropic no ha dicho.
Piensa siempre y arranca en medio
El pensamiento ya no se apaga, y el nivel que guardaste para Opus 5 no se hereda.
Código largo, documentos, gráficas
Migraciones de horas, revisión de código, modelos financieros y detalles que se pasan de largo.
Nueve pruebas y su letra chica
Gana siete de nueve. En dos gana GPT-6 Astra, y aquí se dice sin rodeos.
Por qué a veces cambia de modelo solo
Qué pasa si tu tarea toca biología o ciberseguridad, y cómo volver a Opus 5.5.
Nueve prompts, uno por caso
Migración, revisión, modelo financiero, gráficas, documentos largos, Cowork y una landing.
Cuándo subir a Fable 5.1
Qué modelo sirve para qué hoy, y qué viene en las próximas semanas.
Prompting y el system prompt
Las dos guías que siguen a esta: cómo escribirle y qué le dice Anthropic en cada chat.
Lo que no se sabe todavía
Números del día uno, lo que falta por plan y las preguntas que más se repiten.
Ficha
Antes de empezar
- Nivel
- Principiante. No se escribe código: se copian prompts y, si usas Claude Code, un par de comandos de una línea.
- Qué necesitas
- Una cuenta de Claude. Para Claude Code, la versión 2.1.280 o posterior: con una más vieja no aparece.
- Qué NO necesitas
- Programar, una llave de API ni configurar nada raro. Todo pasa en claude.ai, las apps, Claude Code o Cowork.
- Cuánto toma
- Quince minutos de lectura. Probar los prompts de la sección 08 es otra media hora, y es donde se nota el cambio.
- Qué te llevas
- Saber cuándo te conviene Opus 5.5 y cuándo Fable 5.1, cómo ajustar su esfuerzo, qué hacer si cambia de modelo solo y nueve prompts para probarlo.
- Verificado
- 22 de septiembre de 2026, contra el anuncio oficial, la guía de prompting de Opus 5.5 y la documentación de Claude Code.
01 · Qué es
Un Opus que trabaja a nivel Fable
Claude Opus 5.5 salió el 22 de septiembre de 2026 y es el primer modelo de la familia Claude 5.5. Anthropic lo llama un salto grande sobre Opus 5 y su nuevo modelo líder. La frase que más se va a repetir es que rinde al nivel de Claude Fable 5.1, y es cierta con un matiz que conviene no perder: en la mayoría del trabajo, no en todo.
Donde Anthropic dice que su ventaja es más clara no es en la inteligencia, sino en la eficiencia. Cuesta menos correrlo que Opus 5 y además usa menos para terminar la misma tarea. Para ti, que pagas un plan y no por uso, eso se traduce en algo simple: la misma tarea se come tu plan más lento. Y genera texto más de 30 % más rápido que Opus 5.
También es el primer lanzamiento desde que Anthropic pidió avanzar la frontera a un ritmo controlado. Antes de salir lo probaron evaluadores externos, entre ellos METR, y en seguridad sale con salvaguardas del mismo tipo que las de Fable 5.1. Eso tiene consecuencias prácticas que se ven en la sección 07.
De un vistazo
Opus 5.5 en ocho renglones
- Salió
- 22 de septiembre de 2026.
- Familia
- Es el primero de Claude 5.5. Sonnet 5.5 y Haiku 5.5 llegan «en las próximas semanas», sin fecha.
- Rinde
- Al nivel de Fable 5.1 en la mayoría del trabajo, según Anthropic.
- Velocidad
- Genera texto más de 30 % más rápido que Opus 5.
- Tu plan
- Usa menos para la misma tarea, así que rinde más tu plan que con Opus 5.
- Pensamiento
- Siempre encendido. No hay forma de apagarlo.
- Esfuerzo
- En Claude Code arranca en medio, no en alto como los demás modelos.
- Sabe hasta
- Finales de junio de 2026. Para lo más reciente, activa la búsqueda web.
Lo que el anuncio no dice
No dice que Opus 5.5 sea mejor que Fable 5.1 en todo. Dice que rinde a su nivel en la mayoría del trabajo, y que en su propio uso la distancia entre los dos es más chica de lo que sugieren los benchmarks.
Fable 5.1 sigue siendo el modelo para lo más grande: tareas que no caben en una sentada, sesiones autónomas muy largas y problemas ambiguos. La sección 09 dice cuándo subir.
02 · Lo que notas
Escribe más claro y llega antes
Antes de cualquier benchmark, esto es lo que la gente que lo probó antes del lanzamiento notó en el uso normal. No hace falta configurar nada para verlo.
Cómo escribe
Lo importante va primero
Los primeros en probarlo encontraron su escritura más clara y fácil de seguir: pone la información más importante al principio, usa menos jerga y sigue las reglas de escritura que le das. Uno de ellos lo resumió así: «escribe como yo».
Cómo reporta
Te dice qué hizo, qué encontró y qué necesita
Sus notas mientras trabaja y su resumen final dicen sin rodeos qué hizo, qué encontró y qué necesita de ti. Anthropic lo cuenta también como una mejora de seguridad: un trabajo que se entiende es un trabajo que puedes revisar.
Velocidad
Más de 30 % más rápido
Genera texto más rápido que Opus 5 y suele terminar la misma tarea con menos pasos. Box, una de las empresas que lo probó, lo midió como 40 % menos palabrería sin perder precisión.
Menos vueltas
Junta contexto una vez y se pone a trabajar
Lovable dice que reúne el contexto una sola vez y hace menos ediciones, pero más completas. Quantium lo probó en el chat, en Cowork y en Claude Code: una tarea que antes les llevó 38 prompts en cuatro días salió en 11 prompts y tres horas.
Dos conductas que vas a querer ajustar
- En tareas largas va reportando, y a veces uno de esos reportes termina su turno en lugar de seguir trabajando. Se arregla con una instrucción que nombra las paradas que no quieres.
- En chats de muchos turnos a veces vuelve sobre una respuesta anterior aunque tu mensaje nuevo sea corto, y eso lo hace tardar. También hay una frase que lo evita.
Las dos frases, en su original y listas para pegar, están en Prompting para Opus 5.5, junto con dónde se pega cada una. La de los chats largos está en la sección 08 de esa guía.
03 · En tu plan
Default en Claude Code y límites más altos
En Claude Code, Opus 5.5 es el modelo por defecto en Pro, Max, Team y Enterprise. En Pro eso es un cambio grande: hasta la versión anterior, el modelo por defecto de ese plan era Sonnet 5. Para que aparezca necesitas la versión 2.1.280 o posterior de Claude Code, y la actualización es un comando.
Con el lanzamiento, Anthropic subió los límites de cinco horas en Pro, Max, Team y Enterprise por asiento. Y a quienes tienen suscripción les da un reinicio de límite que puedes guardar y usar cuando tú quieras, por ejemplo el día que te quedas sin margen a media entrega.
Actualiza Claude Code (en la terminal)
claude updateSi no lo ves activo, elígelo dentro de Claude Code
/model opusEl atajo «opus» ya apunta a Opus 5.5. Fable no es el modelo por defecto en ningún plan: si lo quieres, se elige a mano (sección 09).
Qué se sabe en cada superficie
Claude Code
- Lo que se sabe hoy
- Modelo por defecto en Pro, Max, Team y Enterprise desde la versión 2.1.280. Puede tener a la vista muchísimo texto a la vez (un millón de tokens, del orden de varios libros) en todos los planes, incluido Pro.
- Lo que no se ha dicho
- Nada importante: es la superficie mejor documentada.
claude.ai y las apps
- Lo que se sabe hoy
- Está disponible, y el system prompt de claude.ai y de las apps de iOS y Android ya es el de Opus 5.5. Puedes cambiar de modelo a mitad de una conversación.
- Lo que no se ha dicho
- Si es el modelo que sale elegido por defecto, si está en el plan gratis y con qué nivel de esfuerzo arranca.
Cowork
- Lo que se sabe hoy
- Está disponible: Quantium lo usó ahí en sus pruebas. Las sesiones de Cowork corren sobre Claude Code.
- Lo que no se ha dicho
- Si es el modelo por defecto y con qué nivel de esfuerzo arranca.
| Superficie | Lo que se sabe hoy | Lo que no se ha dicho |
|---|---|---|
| Claude Code | Modelo por defecto en Pro, Max, Team y Enterprise desde la versión 2.1.280. Puede tener a la vista muchísimo texto a la vez (un millón de tokens, del orden de varios libros) en todos los planes, incluido Pro. | Nada importante: es la superficie mejor documentada. |
| claude.ai y las apps | Está disponible, y el system prompt de claude.ai y de las apps de iOS y Android ya es el de Opus 5.5. Puedes cambiar de modelo a mitad de una conversación. | Si es el modelo que sale elegido por defecto, si está en el plan gratis y con qué nivel de esfuerzo arranca. |
| Cowork | Está disponible: Quantium lo usó ahí en sus pruebas. Las sesiones de Cowork corren sobre Claude Code. | Si es el modelo por defecto y con qué nivel de esfuerzo arranca. |
Cómo se traduce el ahorro a tu plan
Anthropic dice que, con la configuración por defecto, correr Opus 5.5 cuesta bastante menos que Opus 5 en el trabajo típico, porque procesar cada pedazo de texto le sale más barato y además necesita menos para terminar. En un plan eso quiere decir que la misma tarea se come tu plan más lento.
Lo que no ha publicado es cuánto más te rinde el plan en la práctica. Si ves que alguien dice «40 % más de uso», está convirtiendo un dato de costo en un dato de límites que nadie dio.
Una advertencia: con el mismo nivel de esfuerzo piensa más que Opus 5, sobre todo en los dos niveles más altos, extra-alto y máximo. Si subes el esfuerzo, el ahorro se va rápido.
El reset que puedes guardar
Es nuevo y el anuncio lo menciona en una línea: un reinicio de tu límite que guardas y usas cuando decidas. No dice cuántos te tocan, dónde se activa ni si caduca. Revisa la sección de uso de tu cuenta antes de contar con él.
04 · El esfuerzo
Piensa siempre y arranca en medio
Opus 5.5 siempre piensa antes de contestar, y eso ya no se puede apagar. En Claude Code, el atajo Option+T (Alt+T fuera de Mac) y el interruptor de pensamiento de /config no hacen nada con este modelo. Lo que sí controlas es cuánto piensa, y eso es el esfuerzo.
En Claude Code, Opus 5.5 arranca en esfuerzo medio, cuando los demás modelos arrancan en alto. No es un recorte: según Anthropic, su nivel medio iguala o supera al nivel alto de Opus 5 en código y en trabajo de conocimiento, y en varias pruebas de código hasta el nivel bajo se le acerca gastando mucho menos.
El nivel que guardaste para Opus 5 no se hereda
- Claude Code guarda el esfuerzo por modelo: cada uno recuerda el suyo. Si tenías guardado «alto» para Opus 5, Opus 5.5 no lo toma y arranca en medio hasta que tú elijas otro.
- Tampoco le aplica un nivel general que hayas dejado en tu archivo de ajustes (el que se llama effortLevel). Para Opus 5.5 hay que elegirlo con /effort o desde el selector de /model.
- El encabezado de la sesión te dice en qué nivel vas, por ejemplo «with medium effort».
Abre el control de esfuerzo en Claude Code
/effort- Con Enter lo guardas como el nivel de ese modelo desde ahora.
- Con la tecla s lo aplicas solo a esta sesión.
- El nivel máximo siempre aplica solo a la sesión actual.
- /effort auto borra el nivel guardado del modelo activo y lo regresa a su valor de fábrica.
Cuándo moverlo
- Déjalo en medio para el día a día. Es donde Anthropic recomienda empezar.
- Sube a alto cuando una tarea compleja se quede corta en medio.
- Los dos niveles más altos (extra-alto y máximo) resérvalos para trabajo donde comprobaste que la calidad sube. El máximo puede dar rendimientos decrecientes y darle demasiadas vueltas.
- Baja a bajo para lo corto y acotado donde importa la rapidez.
«ultrathink» y «piensa más» ya no suben el nivel
Si escribes «ultrathink», Claude Code lo reconoce y agrega una instrucción en el contexto, pero el nivel de esfuerzo no cambia. «think», «think hard» y «think more» se leen como texto normal.
Lo que sí funciona es pedirlo directo, en el prompt o en tu CLAUDE.md: «piensa más en este tipo de tareas» o «no le des tantas vueltas». El modelo responde a esa guía dentro del nivel que tenga.
Si quieres ver cómo pensó, en Claude Code presiona Ctrl+O para el modo detallado: el razonamiento aparece en gris y en cursiva.
Qué hace cada nivel, cómo elegirlo para cada tarea y dónde se mueve en claude.ai y Cowork (en el menú del modelo) tiene su propia guía: los niveles de esfuerzo, explicados. Aquí solo va lo que cambia con Opus 5.5.
05 · Dónde brilla
Código largo, documentos, gráficas y pantallas
Anthropic dice que lidera en código con agentes, uso de computadora y trabajo de conocimiento. Traducido a lo que tú haces, son cuatro tipos de trabajo, cada uno con un caso del lanzamiento que lo respalda.
Código con agentes
Cambios grandes que llegan hasta que pasan las pruebas
Lo más fuerte es llevar un cambio por un proyecto grande hasta que sus pruebas pasan. Un probador hizo una migración de 680,000 líneas en menos de un día, trabajo que a un equipo le habría tomado semanas. Otro caso: auditó y arregló un proyecto de 200,000 líneas en menos de tres horas, donde Opus 5 tardó más de veinte. Clio lo dejó solo toda la noche en seis repositorios y siguió en la tarea más de 18 horas.
Revisión de código
Encuentra más fallas y da menos falsas alarmas
Deloitte midió que, incluso en su esfuerzo más bajo, detectó el 72 % de los errores conocidos en revisión de código, contra el 56 % de Opus 5 en esfuerzo alto, y con menos falsas alarmas. Además explica sus cambios en lenguaje llano, así que puedes revisar lo que hizo aunque no leas código con soltura.
Trabajo de conocimiento
Modelos financieros y detalles que se pasan de largo
Es mucho menos probable que dé una cifra equivocada o cite la fuente que no es. Arma modelos financieros y encuentra errores en libros de valuación. Y pesca lo que a una persona se le pasa en documentos largos: una fecha que cae en el día de la semana equivocado en un hilo de planeación, o una gráfica de una presentación que no coincide con sus propias cifras.
Gráficas y pantallas
Lee gráficas densas, diagramas y capturas
Incluso en su esfuerzo más bajo lee valores de gráficas densas con más precisión que Opus 5 en el más alto. Entiende lo que depende de la posición: qué cajas une una flecha, qué cambió entre dos versiones de un diagrama o a qué hora exacta empieza una reunión en una captura de tu calendario. En uso de computadora, con su esfuerzo por defecto alcanza lo que Opus 5 solo lograba con uno mucho más alto.
Un caso que resume el trabajo de oficina
En una prueba interna le pidieron el modelo financiero en Excel y la presentación ejecutiva de una fusión ficticia entre dos empresas de software de recursos humanos. Opus 5 y Opus 5.5 llegaron a la misma conclusión, pero el modelo de Opus 5.5 era más completo y su presentación más fácil de leer, mientras que el de Opus 5 tenía errores menores. Opus 5.5 tardó 63 minutos; Opus 5, 93.
Otro caso del anuncio: un reporte trimestral hecho buscando en una copia de la web, con una regla dura —cualquier cifra o cita inventada lo reprobaba—. 16 de los 18 reportes de Opus 5.5 pasaron. Ni Fable 5.1 ni Opus 5 lo pasaron en ningún intento.
06 · Los números
Nueve pruebas, con su letra chica
Esta es la tabla del anuncio, sin redondear. Léela con una advertencia que viene del propio Anthropic: a este nivel, los márgenes de benchmark ya dicen poco de las diferencias reales, y en su propio uso la distancia con Fable 5.1 es más chica de lo que marcan estos números.
Terminal-Bench 4.0
- Qué mide
- Código con agentes
- Opus 5.5
- 66.4 %
- Fable 5.1
- 55.8 %
- Opus 5
- 52.3 %
- GPT-6 Astra
- 57.9 %
- GPT-5.6 Sol
- 37.3 %
FrontierCode v1.1
- Qué mide
- Código con agentes
- Opus 5.5
- 54.4 %
- Fable 5.1
- 50.3 %
- Opus 5
- 48.0 %
- GPT-6 Astra
- 53.3 %
- GPT-5.6 Sol
- 47.5 %
CursorBench 4.0
- Qué mide
- Código con agentes
- Opus 5.5
- 57.8 %
- Fable 5.1
- 51.8 %
- Opus 5
- 46.6 %
- GPT-6 Astra
- —
- GPT-5.6 Sol
- 41.7 %
GDPval-AA v2.1
- Qué mide
- Trabajo de conocimiento (Elo)
- Opus 5.5
- 1846
- Fable 5.1
- 1735
- Opus 5
- 1708
- GPT-6 Astra
- 1542
- GPT-5.6 Sol
- 1588
AutomationBench
- Qué mide
- Flujos de negocio
- Opus 5.5
- 40.0 %
- Fable 5.1
- 31.4 %
- Opus 5
- 26.9 %
- GPT-6 Astra
- 41.4 %
- GPT-5.6 Sol
- 28.8 %
Humanity's Last Exam
- Qué mide
- Razonamiento, con herramientas
- Opus 5.5
- 67.7 %
- Fable 5.1
- 65.6 %
- Opus 5
- 63.6 %
- GPT-6 Astra
- 57.2 %
- GPT-5.6 Sol
- —
Terminal-Bench-Science 0.1
- Qué mide
- Investigación científica
- Opus 5.5
- 58.7 %
- Fable 5.1
- 52.6 %
- Opus 5
- 29.0 %
- GPT-6 Astra
- 64.6 %
- GPT-5.6 Sol
- 22.4 %
OSWorld 2.0
- Qué mide
- Uso de computadora
- Opus 5.5
- 81.8 %
- Fable 5.1
- 80.7 %
- Opus 5
- 74.0 %
- GPT-6 Astra
- —
- GPT-5.6 Sol
- —
Chartography
- Qué mide
- Lectura de gráficas, con herramientas
- Opus 5.5
- 89.0 %
- Fable 5.1
- 88.4 %
- Opus 5
- 83.4 %
- GPT-6 Astra
- —
- GPT-5.6 Sol
- —
| Prueba | Qué mide | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra | GPT-5.6 Sol |
|---|---|---|---|---|---|---|
| Terminal-Bench 4.0 | Código con agentes | 66.4 % | 55.8 % | 52.3 % | 57.9 % | 37.3 % |
| FrontierCode v1.1 | Código con agentes | 54.4 % | 50.3 % | 48.0 % | 53.3 % | 47.5 % |
| CursorBench 4.0 | Código con agentes | 57.8 % | 51.8 % | 46.6 % | — | 41.7 % |
| GDPval-AA v2.1 | Trabajo de conocimiento (Elo) | 1846 | 1735 | 1708 | 1542 | 1588 |
| AutomationBench | Flujos de negocio | 40.0 % | 31.4 % | 26.9 % | 41.4 % | 28.8 % |
| Humanity's Last Exam | Razonamiento, con herramientas | 67.7 % | 65.6 % | 63.6 % | 57.2 % | — |
| Terminal-Bench-Science 0.1 | Investigación científica | 58.7 % | 52.6 % | 29.0 % | 64.6 % | 22.4 % |
| OSWorld 2.0 | Uso de computadora | 81.8 % | 80.7 % | 74.0 % | — | — |
| Chartography | Lectura de gráficas, con herramientas | 89.0 % | 88.4 % | 83.4 % | — | — |
Un guion quiere decir que el anuncio no trae cifra para ese modelo en esa prueba. En Terminal-Bench 4.0 y Terminal-Bench-Science, las cifras de los modelos de OpenAI son las que reportó OpenAI; las de AutomationBench salen del leaderboard público de Zapier.
Donde gana GPT-6 Astra
En dos filas gana el modelo de OpenAI: AutomationBench (41.4 % contra 40.0 %), que mide flujos de negocio, y Terminal-Bench-Science (64.6 % contra 58.7 %), que mide investigación científica con agentes.
Las dos llevan su propio contexto. AutomationBench lo corrió Zapier sin modelos de respaldo, así que cada vez que una salvaguarda intervino contó como falla; el anuncio dice que por eso sale más bajo de lo que daría en la práctica. En Terminal-Bench-Science el margen de error es de 3.5 a 5 puntos por modelo.
Si tu trabajo es justo eso, vale la pena probar los dos con tus propias tareas antes de decidir. Y si ya dominas Claude, nada de esta tabla te obliga a cambiar de herramienta: el propio Anthropic advierte que, a este nivel, unos puntos de benchmark dicen poco del uso real, y tu forma de trabajar pesa más.
Cómo leer la tabla
- Son cifras del vendedor, publicadas el día del lanzamiento. Las mediciones independientes llegan después.
- Salvo nota, Opus 5.5 corrió en esfuerzo máximo. Terminal-Bench 4.0 es la excepción: va en el penúltimo nivel, y cada modelo aparece con su mejor cifra.
- Se midió con los mismos filtros de seguridad que usas tú. Cuando intervinieron, las tareas de ciberseguridad las terminó Opus 4.8, y las de biología y de desarrollo de modelos de IA, Opus 5. Es probable que eso le baje algunas cifras.
- GDPval-AA mide trabajo real en 44 ocupaciones, y su cifra es un puntaje tipo ajedrez (Elo), no un porcentaje.
Lo que pasa en esfuerzo medio, el que vas a usar
La tabla es casi toda en máximo, pero tú vas a usarlo casi siempre en medio. Ahí también sale bien parado:
- En CursorBench, en medio saca 52.5 %: arriba del 51.8 % de Fable 5.1 y del 46.6 % de Opus 5, los dos en máximo.
- En FrontierCode, en su esfuerzo por defecto ya queda arriba de todos los demás modelos de la tabla.
- En Terminal-Bench 4.0, en su esfuerzo por defecto le gana a Opus 5 en máximo gastando mucho menos.
07 · Seguridad
Por qué a veces cambia de modelo solo
Anthropic lo presenta como el modelo con mejor comportamiento que ha probado. Estos son los resultados que publicó, y después lo que eso cambia en tu trabajo diario.
Comportamiento
Mejor que cualquier Claude reciente
En una auditoría automática de casi 2,000 escenarios salió mejor que cualquier modelo Claude reciente en casi todas las medidas de mal comportamiento, y es su modelo más honesto en la mayoría de las medidas. Es mucho menos probable que haga algo difícil de revertir o que se salga de los límites que le diste.
Contención
85 % menos intentos de saltarse límites
En una prueba nueva, hecha para ver si un modelo intenta cruzar los límites que lo contienen, lo intentó alrededor de 85 % menos veces que Opus 5 o Mythos 5.1 (el modelo de acceso restringido que está por encima de Opus). Cada intento fue de gravedad baja y él mismo lo reportó.
Inyección
Difícil de engañar con texto escondido
En la prueba de Gray Swan empata con Fable 5.1 como el modelo al que menos le funcionan los intentos de inyección de instrucciones: texto metido en una página, un correo o un archivo para desviarlo. Resiste mejor que cualquier Opus anterior.
Salvaguardas
Parecidas a las de Fable 5.1
Es el primer Opus que sale con salvaguardas del mismo tipo que las de Fable 5.1 en ciberseguridad, biología y destilación (usar sus respuestas para entrenar otro modelo). En biología son las mismas, y si vienes de Opus 5, esas son nuevas. Y trae la marca de agua que Anthropic usa para cumplir la ley europea de IA.
Qué pasa si tu tarea toca biología o ciberseguridad
En Claude Code, cuando un filtro automático de seguridad marca un mensaje, Claude Code lo vuelve a correr en otro modelo y te deja un aviso en la conversación. Lo que se marca como biología se va a Opus 5 y lo que se marca como ciberseguridad, a Opus 4.8. No es una marca en tu cuenta: es el desvío esperado para esos temas.
- Después del cambio, la sesión sigue en el modelo de respaldo. Para volver a Opus 5.5, escribe /model y elígelo.
- Puede pasar desde el primer mensaje, porque ese primer envío lleva el contexto de tu proyecto (tu CLAUDE.md, el estado de tus archivos), y eso también pasa por el filtro.
- Si prefieres que te pregunte antes de cambiar, abre /config y apaga «Switch models when a message is flagged».
- En trabajo serio de biología, la sesión pasa a Opus 5 con la primera marca, y lo siguiente que se marque ahí termina en negativa, porque Opus 5 no tiene a quién pasarle la tarea.
Lo que sigue funcionando igual
- Encontrar y arreglar fallas en tu propio código es parte normal del desarrollo y está permitido. Lo que se va a Opus 4.8 es la mayoría del trabajo de ciberseguridad propiamente dicho.
- Las preguntas cotidianas de salud y las educativas no se ven afectadas por las salvaguardas de biología.
- Para organizaciones que hacen trabajo legítimo en esas áreas —laboratorios, farmacéuticas, equipos de seguridad— Anthropic tiene programas de verificación que dan más acceso.
Hay una negativa nueva que sí puede tocarte si vienes de Opus 5: si tu prompt le pide que escriba su razonamiento interno dentro de la respuesta, puede negarse. Qué pedirle en su lugar está en Prompting para Opus 5.5.
08 · Para estrenarlo
Nueve prompts, uno por caso
Cada prompt ataca algo en lo que Opus 5.5 es fuerte. Cambia lo que está entre corchetes y pega el resto tal cual. Ninguno le pide que piense con cuidado ni que escriba su razonamiento: ya piensa solo, y lo que le pides es el resultado, la evidencia y lo que no pudo verificar.
Una migración de código, parte por parte
En Claude Code, dentro de la carpeta del proyecto. Lleva la lista de pendientes en un archivo; por qué eso evita que se detenga a medias está en la guía de prompting, sección 04.
Quiero migrar [QUÉ: por ejemplo, este proyecto de JavaScript a TypeScript / de una librería vieja a la nueva]. Antes de tocar nada: 1. Revisa el proyecto completo y dime en un párrafo qué hay que cambiar, qué tan grande es y qué riesgos ves. 2. Crea un archivo PENDIENTES.md con la lista de partes de la migración, una por renglón. Luego trabaja parte por parte: - Antes de empezar cada parte, una línea diciendo qué vas a hacer. - Al terminar cada parte, corre las pruebas. Si fallan, arréglalas antes de seguir. - Marca la parte como hecha en PENDIENTES.md. - No cambies cómo se comporta la app: si algo tendría que cambiar de comportamiento, detente y pregúntame. Al final, un resumen corto: qué migraste, qué quedó pendiente y por qué, y qué necesitas de mí.
Revisión de código que no te llena de falsas alarmas
En Claude Code. Separa lo confirmado de lo dudoso y lo explica en lenguaje llano, para que puedas pasárselo a quien decide.
Revisa los cambios de [ESTA RAMA / ESTE PULL REQUEST / LOS ARCHIVOS QUE TE INDICO] como lo haría una persona con experiencia que tiene que aprobarlos. Busca: - Errores que romperían algo en uso real. - Casos que no se están cubriendo (datos vacíos, errores de red, usuarios sin permisos). - Cosas que funcionan pero son difíciles de mantener. Para cada hallazgo dime: dónde está, qué pasa, qué tan grave es (alto, medio o bajo) y cómo lo arreglarías. Solo reporta lo que de verdad veas en el código. Si algo te genera duda pero no puedes confirmarlo, ponlo aparte como «sin confirmar». Explícalo en lenguaje llano: quien lo va a leer no necesariamente programa.
Un modelo financiero con resumen de una página
En claude.ai o en Cowork, con la hoja de cálculo adjunta. Primero revisa tus datos y después arma el modelo.
Te comparto [LA HOJA DE CÁLCULO / LOS ESTADOS FINANCIEROS] de [EMPRESA O PROYECTO]. Quiero dos cosas: 1. Un modelo financiero en una hoja nueva con ingresos, costos y flujo de efectivo a [NÚMERO] años, con los supuestos en una pestaña aparte y cada supuesto explicado en una línea. 2. Un resumen de una página para alguien que tiene que decidir si entra o no: qué dice el modelo, los tres supuestos que más mueven el resultado y qué pasa si cada uno sale peor de lo esperado. Antes de armarlo, revisa los datos que te di y dime si encuentras errores, fórmulas rotas o cifras que no cuadran entre sí. No inventes ninguna cifra: si falta un dato, dilo y propón un supuesto marcado como supuesto.
Leer una gráfica o un diagrama al detalle
En claude.ai: sube la imagen con la mejor resolución que tengas. Sirve también para comparar dos versiones de un diagrama.
Te paso [UNA GRÁFICA / UN DIAGRAMA / UNA CAPTURA DE PANTALLA]. 1. Dime qué valores exactos se leen en ella, con su unidad. Si alguno no se alcanza a leer con certeza, márcalo como aproximado. 2. Explica en tres líneas qué muestra y qué conclusión sale de ahí. 3. Señala cualquier cosa rara: ejes que no empiezan en cero, etiquetas que no coinciden con los datos, flechas que conectan lo que no deberían. Si te paso dos versiones, dime exactamente qué cambió de una a otra.
Auditar un documento largo
En claude.ai o Cowork. Es justo el tipo de detalle que Anthropic dice que Opus 5.5 pesca mejor: fechas, cifras y gráficas que no cuadran.
Te comparto [EL DOCUMENTO LARGO / EL HILO DE CORREOS / LA PRESENTACIÓN]. Audítalo buscando lo que a una persona se le pasaría: - Fechas que no cuadran con el día de la semana que dicen. - Cifras que aparecen distintas en dos lugares. - Gráficas o tablas que no coinciden con los números del texto. - Compromisos o plazos que se contradicen entre secciones. Para cada hallazgo dame la ubicación exacta (página, diapositiva o correo) y cita el texto. Si no encuentras nada en alguna categoría, dilo; no rellenes.
Una tarea en Cowork que cruza varias apps
En Cowork, con tu correo, documentos u hojas conectados. Le pide explorar antes de actuar (el porqué, en la guía de prompting, sección 06). Úsalo solo si confías en lo que hay en esas apps, porque va a actuar según lo que encuentre.
Tarea: [LO QUE NECESITAS, por ejemplo: prepara la respuesta al cliente X sobre su reclamo de facturación]. Antes de actuar, revisa a fondo todo lo que podría ser relevante en las apps que tienes conectadas: correos anteriores con esa persona, documentos, pestañas de las hojas de cálculo y fichas del cliente, incluidas las que esta tarea no menciona. Usa lo que encuentres. Luego: - Dime en una línea qué encontraste que cambia la respuesta. - Deja el borrador listo, sin enviarlo. - Señala cualquier política o dato que contradiga lo que el cliente pide.
Una landing que no parezca hecha por IA
En claude.ai (Artifacts) o Claude Code. Nombra lo que no quieres y amplía la lista en cada vuelta; por qué funciona está en la guía de prompting, sección 11.
Hazme una landing page en HTML y CSS para [TU NEGOCIO O PRODUCTO], con textos de ejemplo. Público: [A QUIÉN LE VENDES]. Tono: [POR EJEMPLO: directo, cálido, técnico]. No uses: - Fondo crema o blanco hueso. - Palabras en cursiva para resaltar dentro de los títulos. - Etiquetas de sección numeradas tipo «01 / 02 / 03». - Etiquetas en tipografía monoespaciada. - Botones con forma de píldora. - Degradados morados. Cuando termines, dime qué estilo elegiste y por qué, para que yo decida qué más agregar a la lista de lo que no quiero.
Un reporte donde ninguna cifra es inventada
En claude.ai con la búsqueda web activada. Es más difícil que dé una cifra equivocada, pero la regla de «sin fuente no entra» la vuelve verificable.
Investiga [TEMA] y arma un reporte de [EXTENSIÓN] para [QUIÉN LO VA A LEER]. Reglas: - Cada cifra y cada cita va con su fuente, con enlace. - Si no encuentras una fuente para algo, no lo pongas. Una cifra inventada invalida el reporte entero. - Lo más importante va en el primer párrafo. - Escríbelo en prosa. Solo usa una tabla si compara más de tres cosas en varias columnas. Al final, una lista corta de lo que no pudiste verificar.
Reacomodar tu semana desde una captura
En claude.ai: sube la captura de tu calendario. Lee horas exactas en capturas mejor que los modelos anteriores.
Te paso una captura de mi calendario de [ESTA SEMANA]. 1. Dime a qué hora exacta empieza y termina cada reunión. 2. Marca los choques y los huecos de menos de 15 minutos entre reuniones. 3. Propón cómo reacomodarla para tener [UN BLOQUE DE 2 HORAS LIBRE AL DÍA / LAS MAÑANAS LIBRES], sin mover las reuniones que tengan más de tres personas.
Para la lista de lo que no quieres y cómo ampliarla, empieza por Diseño web en Prompting para Opus 5.5.
Y para ir más lejos, sigue con el kit de diseño con Claude.
¿Tareas largas que se detienen a medias, respuestas lentas en chats largos, texto pegado de fuera? Las frases exactas de Anthropic para cada caso, en su original y con dónde pegarlas, están en Prompting para Opus 5.5.
09 · La familia
Cuándo subir a Fable 5.1
Los modelos públicos más recientes, según el propio system prompt de claude.ai, son cuatro: Fable 5.1, Opus 5.5, Sonnet 5 y Haiku 4.5. Así se reparten el trabajo hoy.
Fable 5.1
- Para qué
- Lo más capaz de Claude Code, para tareas que no caben en una sentada, sesiones autónomas largas y problemas ambiguos. Comparte modelo base con Mythos 5.1, con salvaguardas extra en biología, ciberseguridad e investigación de IA.
- Cómo lo eliges en Claude Code
- /model fable (versión 2.1.257 o posterior). Según tu plan, su uso puede cobrarse con créditos aparte en vez de salir de tus límites; el selector lo avisa con «Requires usage credits».
Opus 5.5
- Para qué
- El trabajo de todos los días, incluido el pesado: rinde al nivel de Fable 5.1 en la mayoría de las tareas y se come tu plan más lento.
- Cómo lo eliges en Claude Code
- Viene por defecto en Pro, Max, Team y Enterprise. Si cambiaste, /model opus.
Sonnet 5
- Para qué
- El modelo intermedio vigente mientras llega Sonnet 5.5.
- Cómo lo eliges en Claude Code
- /model sonnet.
Haiku 4.5
- Para qué
- El más chico de la lista vigente, mientras llega Haiku 5.5.
- Cómo lo eliges en Claude Code
- Búscalo en el selector de /model.
| Modelo | Para qué | Cómo lo eliges en Claude Code |
|---|---|---|
| Fable 5.1 | Lo más capaz de Claude Code, para tareas que no caben en una sentada, sesiones autónomas largas y problemas ambiguos. Comparte modelo base con Mythos 5.1, con salvaguardas extra en biología, ciberseguridad e investigación de IA. | /model fable (versión 2.1.257 o posterior). Según tu plan, su uso puede cobrarse con créditos aparte en vez de salir de tus límites; el selector lo avisa con «Requires usage credits». |
| Opus 5.5 | El trabajo de todos los días, incluido el pesado: rinde al nivel de Fable 5.1 en la mayoría de las tareas y se come tu plan más lento. | Viene por defecto en Pro, Max, Team y Enterprise. Si cambiaste, /model opus. |
| Sonnet 5 | El modelo intermedio vigente mientras llega Sonnet 5.5. | /model sonnet. |
| Haiku 4.5 | El más chico de la lista vigente, mientras llega Haiku 5.5. | Búscalo en el selector de /model. |
Lo demás que conviene saber
- Sonnet 5.5 y Haiku 5.5 llegan «en las próximas semanas», con muchas de las mismas mejoras en rendimiento, eficiencia y seguridad. No hay fecha.
- Por encima de Opus está el nivel Mythos. Mythos 5.1 tiene acceso restringido a organizaciones verificadas; Fable 5.1 es el mismo modelo con más salvaguardas y es el que puedes usar.
- Opus 5 y Opus 4.8 siguen existiendo: son a donde Claude Code manda lo que se marca como biología o ciberseguridad (sección 07).
- Si preguntas por Fable en el chat, el system prompt le pide a Claude contar sin rodeos que Fable 5 se suspendió del 12 de junio al 1 de julio de 2026 por controles de exportación, y que el acceso ya se restauró.
10 · Las otras dos guías
Ya sabes qué es. Ahora, cómo hablarle
Esta guía es la puerta de entrada. Con Opus 5.5 salieron dos documentos oficiales que cambian cómo le escribes, y cada uno tiene su propia guía en la bóveda. Léelas en este orden.
Prompting para Opus 5.5
La guía oficial de Anthropic para escribirle a este modelo, pasada a claude.ai, Claude Code y Cowork. Es donde está lo que tienes que quitar y poner en tus instrucciones.
- Por qué «piensa con cuidado» ya estorba y conviene quitarlo de tus preferencias.
- La instrucción que evita que se detenga a medias en tareas largas.
- Qué pedir en lugar de «escribe tu razonamiento paso a paso».
- Las frases originales para copiar, con dónde se pega cada una.
El system prompt de Opus 5.5
Lo que Anthropic le dice a Claude en cada chat de claude.ai y las apps, antes de que tú escribas nada. Entenderlo explica por qué contesta como contesta.
- El texto completo en inglés, para descargar o copiar.
- Por qué prefiere prosa a viñetas, y cómo pedirle tablas cuando sí las quieres.
- Por qué te hace una sola pregunta, y qué hace cuando duda antes de negarse.
- Cómo usar su misma estructura para escribir tus instrucciones de Proyecto.
11 · Lo honesto
Lo que todavía no se sabe
Todo lo de esta página viene de Anthropic y salió el mismo día del lanzamiento. Vale la pena tener presente lo que falta antes de reorganizar tu forma de trabajar alrededor de un modelo nuevo.
- Los números son del vendedor, del día uno. Las mediciones independientes llegan después, y Anthropic mismo dice que a este nivel los márgenes de benchmark ya guían poco.
- Anthropic ve señales de que Opus 5.5 muchas veces sospecha que lo están evaluando, y reconoce que eso le complica saber cómo se va a portar en la enorme variedad de situaciones reales. Por eso combina su trabajo de alineación con salvaguardas.
- No se sabe cuánto suben los límites de cinco horas ni cómo funciona el reset que puedes guardar.
- No se sabe cuánto más te rinde el plan en la práctica. Que cueste menos correrlo no se traduce en un porcentaje de uso publicado.
- Fuera de Claude Code no hay dato público de cuál es el modelo por defecto ni de si está en el plan gratis. El esfuerzo en claude.ai y Cowork se elige desde el menú del modelo, pero Anthropic no ha dicho con qué nivel arranca ahí Opus 5.5.
- Con el mismo nivel de esfuerzo piensa más que Opus 5, sobre todo en los dos niveles más altos. Subirlo por costumbre se come tu plan.
Preguntas frecuentes
›¿Tengo que reescribir mis prompts de Opus 5?
No. Anthropic dice que los prompts de Opus 5 deberían funcionar bien sin cambios. Lo que sí conviene es quitar dos cosas: las instrucciones de «piensa con cuidado antes de responder» y las que le piden escribir su razonamiento dentro de la respuesta. Los detalles están en Prompting para Opus 5.5.
›¿Puedo apagar el pensamiento para que conteste más rápido?
No. Con Opus 5.5 el pensamiento siempre está encendido. Si quieres respuestas más rápidas, en Claude Code baja el esfuerzo con /effort: eso reduce cuánto piensa de forma más confiable que pedírselo en el prompt.
›¿Por qué Claude Code cambió a Opus 5 u Opus 4.8 en medio de mi sesión?
Porque un filtro automático marcó algo como biología (se va a Opus 5) o como ciberseguridad (se va a Opus 4.8). Te deja un aviso en la conversación y no es una marca en tu cuenta. Para volver, /model. Si prefieres que te pregunte antes, apaga «Switch models when a message is flagged» en /config.
›¿Opus 5.5 o Fable 5.1?
Para el día a día, Opus 5.5: rinde a su nivel en la mayoría del trabajo y se come tu plan más lento. Sube a Fable 5.1 para tareas que no caben en una sentada, sesiones autónomas muy largas o problemas ambiguos, y revisa antes si en tu plan se cobra con créditos aparte.
›¿Está en el plan gratis?
Anthropic no lo ha dicho. Lo confirmado es que en Claude Code es el modelo por defecto en Pro, Max, Team y Enterprise.
›¿Hasta cuándo sabe cosas?
Su conocimiento confiable llega hasta finales de junio de 2026. Para cualquier cosa más reciente, activa la búsqueda web en claude.ai.
›¿Sirve escribir «ultrathink»?
Claude Code lo reconoce y agrega una instrucción, pero no sube el nivel de esfuerzo. «think hard» y parecidos se leen como texto normal. Si quieres que piense más, sube el esfuerzo con /effort o díselo directo en el prompt.
›Mi Claude Code no muestra Opus 5.5. ¿Qué hago?
Necesitas la versión 2.1.280 o posterior. Corre claude update en la terminal, vuelve a abrir Claude Code y elige el modelo con /model opus.
›¿Cuándo salen Sonnet 5.5 y Haiku 5.5?
«En las próximas semanas», según el anuncio. No hay fecha.
Guía de la bóveda
Esta guía es una de las gratuitas de la bóveda.
Si te llevas una sola cosa
Con Opus 5.5 la jugada no es pedirle más, sino dejarlo trabajar: ya piensa solo, ya arranca en un nivel de esfuerzo que rinde como el alto de Opus 5 y ya te cuenta lo que hizo en lenguaje llano. Quítale las instrucciones que lo empujaban a pensar, sube el esfuerzo solo cuando lo compruebes, y guarda Fable 5.1 para lo que de verdad no cabe en una sentada.
Dónde sigue cada tema
Los niveles de esfuerzo, explicados
Aquí solo va lo que cambia con Opus 5.5. Allá está la perilla completa: qué hace cada nivel, cuándo no usarlo y dónde se cambia en cada superficie.
Mejores prácticas de prompting
La referencia general de Anthropic en español, para cualquier modelo: contexto largo, formato, trabajo con agentes. La guía de Prompting para Opus 5.5 cubre solo lo propio de este modelo.
La guía de Opus 5
Si todavía trabajas con Opus 5 o quieres ver de dónde viene este modelo: cómo piensa, cómo hablarle y en qué rendía.
Lo nuevo sale primero en Instagram
Ahí aviso cuando entra una guía nueva a la bóveda y cuando algo de esto cambia.
@soyenriquerocha
Cuándo se verificó esto
Cada dato de esta página se contrastó el 22 de septiembre de 2026, el día del lanzamiento, contra el anuncio oficial de Anthropic, su guía de prompting para Opus 5.5 y la documentación de modelos de Claude Code. Un modelo recién salido cambia rápido: límites, defaults y versiones se mueven. Si algo no cuadra con lo que ves en tu cuenta, lo que manda es tu cuenta.