Niveles de esfuerzo: deja de traer Claude en máximo para todo
Si traes Claude en máximo o en ultra para todo, creyendo que así te da mejores respuestas, ojo: estás quemando tu cuenta sin darte cuenta. Y lo más loco es que ni siquiera te responde mejor: a veces, peor. Cada vez que le pones el tope a una tarea sencilla se pone a pensar de más, se va por las ramas y gasta un montón. La jugada no es bajarle a todo ni subirle a todo: es ponerle el nivel que la tarea pide. Lo simple en bajo, el día a día en medio, alto cuando equivocarse sale caro, y el máximo casi nunca. Esta guía es el mapa: qué es el esfuerzo, qué nivel va para qué tarea, cómo se comporta cada modelo (Fable, Opus, Sonnet, Haiku) y dónde se cambia en el chat, en Cowork y en Claude Code.
El recorrido · de un vistazo
Qué es el esfuerzo
La perilla de cuánto piensa Claude — y por qué más pensamiento no es mejor respuesta.
Qué nivel para qué tarea
Bajo, medio, alto, extra-alto y máximo: para qué sirve cada uno y cuándo NO usarlo.
Cada modelo, su nivel
Fable, Opus, Sonnet y Haiku piensan distinto, y Haiku 5.5 es el primero de su línea con niveles.
Chat, Cowork y Code
El menú exacto en cada superficie, los comandos de Code y prompts para afinar el pensamiento.
Guía comunidad · actualizada a septiembre 2026
El esfuerzo (o nivel de pensamiento) es una perilla: le dice a Claude cuánto pensar antes de responderte, de bajo a máximo. Ni Claude Code viene en máximo por default — con Opus 5.5 y Sonnet 5.5, los dos modelos nuevos, arranca en MEDIO; con el resto, en alto; y solo con Opus 4.7 en extra-alto. Nunca en el tope. Poner todo al máximo no te da mejores respuestas: se come tu plan más rápido y a veces te la entrega peor.
Aquí no hay código: son las perillas que Claude ya trae. Vas a ver la tabla de qué nivel usar según la tarea (con el «cuándo NO» de cada uno), cómo cambia la cosa entre Fable 5.1, Opus 5.5, Sonnet 5.5 y Haiku 5.5, el primer Haiku con niveles, y el paso a paso para cambiarlo en el chat de claude.ai, en Cowork y en Claude Code, con prompts copia-pega para afinar el pensamiento dentro del nivel que tengas. El resultado: bajas el gasto y, encima, mejores respuestas, porque deja de pensar de más.
El concepto · qué es y por qué importa
El esfuerzo es una perilla, no un botón de “más es mejor”
El esfuerzo —o nivel de pensamiento— es una perilla que le dice a Claude cuánto pensar antes de responderte. Va de bajo a máximo, pasando por medio, alto y extra-alto. No es un presupuesto fijo de tokens: es una señal de qué tan a fondo quieres que le entre. Con bajo, contesta rápido y casi no gasta; con máximo, se toma su tiempo, razona un montón y gasta mucho más.
La trampa es creer que más pensamiento siempre es mejor respuesta. No lo es. En una tarea sencilla, ponerlo en máximo hace que se vaya por las ramas: la analiza como si le hubieras pedido armar un cohete. Y eso no solo te vacía la cuenta — la propia doc de Anthropic dice que, en la mayoría de los casos, el máximo suma bastante costo por una mejora chica, y que en tareas estructuradas puede pensar de más. O sea: pagas un montón por pensar de más en algo que no lo pedía.
Ojo con dos cosas que suenan igual pero no lo son. El esfuerzo es qué tan exhaustivo es Claude en cada respuesta. El interruptor de “pensamiento” (o “thinking”) es si razona primero en una sección desplegable antes de contestarte. Son ajustes distintos. Eso sí: en Sonnet 5.5, Opus 5.5, Fable 5.1 y Opus 5 el pensamiento no se puede apagar en el chat, y en Claude Code tampoco con Opus 5.5, Sonnet 5.5 ni Fable. Ahí lo único que mueves es el esfuerzo. Cuando alguien dice “lo puse a pensar” suele mezclar las dos cosas.
La regla
La regla en una línea: lo simple en bajo, el día a día en medio, alto cuando equivocarse sale caro, y el máximo casi nunca. Todo lo demás de esta guía es aprender a leer en qué grupo cae cada tarea.
La tabla · qué nivel para qué tarea
Bajo, medio, alto, extra-alto y máximo
Esta es la escalera completa, de menos a más pensamiento. Para cada nivel, para qué sirve — y el “cuándo NO”, que es donde la gente se equivoca. Un detalle antes: la escala está calibrada por modelo, así que el mismo nombre no vale igual en dos modelos distintos. Léela una vez y ya vas a calibrar de reojo.
Para: Intercambios rápidos donde tú revisas cada resultado: una lluvia de ideas, un primer borrador, un cambio chico como renombrar algo, buscar un dato o resumir algo corto. Responde volando y apenas toca tu plan.
Cuándo NO: Cuando necesitas que razone un problema de varios pasos o que se revise solo: ahí se queda corto, y en algunos modelos hasta se salta la verificación.
Para: El trabajo del día a día con alcance claro, como implementar una función nueva o armar un documento que ya sabes cómo quieres. Es el default de Opus 5.5 y Sonnet 5.5. En modelos anteriores, bajar a medio ahorra a cambio de algo de inteligencia.
Cuándo NO: Cuando importa que verifique o hay casos raros de por medio: súbele a alto. Para un dato suelto, bájale a bajo.
Para: Cuando importa verificar o hay casos raros: arreglar un bug en algo que ya existe, un análisis donde equivocarse sale caro. En Claude Code es el default de Fable 5.1, Opus 5 y casi todos los demás; las excepciones son Opus 5.5 y Sonnet 5.5 (medio) y Opus 4.7 (extra-alto).
Cuándo NO: Para un “¿cómo se escribe X?” es desperdicio. Ahí bájale y ya.
Para: Razonamiento más profundo a cambio de más gasto: código y trabajo agéntico difícil, sesiones largas, muchas herramientas seguidas. Existe en Opus 4.7 y posteriores, Sonnet 5 y posteriores, y Fable. Solo es el default con Opus 4.7; en los demás subes aquí a propósito.
Cuándo NO: Para chat normal es matar moscas a cañonazos: se come tu plan sin ganar nada.
Para: Casi nunca. Problemas difíciles que quieres que resuelva sin ti, como revisar un proyecto buscando fallas de seguridad, y solo después de que alto o extra-alto no alcanzaron. Pruébalo antes de adoptarlo.
Cuándo NO: Para casi todo lo demás. Da rendimientos decrecientes: en la mayoría de los casos gastas mucho más por una mejora chica, y en tareas estructuradas puede pensar de más. (Sí, tal cual lo dice Anthropic.)
¿La prueba de que el máximo no es la meta? Claude Code, la herramienta oficial para programar, nunca viene en máximo por default. Con Opus 5.5 y Sonnet 5.5, los modelos nuevos, arranca en medio; con Fable, Opus 5 y el resto, en alto; y solo con Opus 4.7 en extra-alto. Ni ellos lo maxean: con los modelos más nuevos, de hecho, arranca más abajo. El objetivo nunca es “el nivel más alto”, es “el nivel correcto”.
Por modelo · cada uno piensa distinto
El nivel cambia según el modelo que traigas
El mismo nivel no cuesta ni rinde igual en cada modelo. Y hay uno que ni siquiera tiene niveles. Esto es lo que necesitas saber de los que vas a usar.
Fable 5.1
El tope · para lo más exigente
El modelo para el razonamiento más exigente y el trabajo agéntico largo. En Claude Code arranca en alto. Ojo con cómo se paga: en Pro corre con créditos de uso desde el primer token, y en Max viene incluido hasta el 50% de tu límite semanal. Cada nivel que le subes se nota en tus créditos o en tu tope semanal.
Tip: Sube a extra-alto o máximo solo para lo más sensible; para lo rutinario, bájale a medio o bajo sin culpa. Ya con Fable 5, los niveles bajos a menudo superaban el extra-alto de modelos anteriores.
Opus 5.5
El default de Claude Code
En Claude Code arranca en medio y piensa siempre: el pensamiento no se apaga. Con el mismo nivel piensa más por turno que Opus 5, y su medio iguala o supera el alto de Opus 5 en código y trabajo de conocimiento.
Tip: El nivel se guarda por modelo: si venías usando Opus 5 en alto, Opus 5.5 no lo hereda y empieza en medio. Pruébalo así antes de subirle.
Sonnet 5.5
Rápido · se come tu plan más lento
Sus niveles vienen recalibrados y arranca en medio, en Claude Code y en las apps. En bajo puede dar algo por terminado sin probarlo, y en bajo y medio, en tareas largas, es más probable que se frene a preguntarte.
Tip: Si quieres que piense menos, bájale el nivel: pedírselo con palabras no lo reduce de forma confiable. Lo que hace en cada nivel, a detalle, está en la guía de prompting de Sonnet 5.5, en las guías hermanas de abajo.
Generaciones anteriores
Opus 5 · Opus 4.8 · Opus 4.7
Opus 5 arranca en alto, y ahí bajo y medio son tu control de gasto sin culpa. En Opus 4.8 y 4.7 la recomendación era arrancar en extra-alto para código y trabajo agéntico. Hoy, en Claude Code, Opus 4.8 arranca en alto y Opus 4.7 en extra-alto.
Tip: Si sigues en uno de estos, sube a extra-alto solo para código exigente, nunca a máximo por costumbre.
Haiku 5.5
El velocista
El modelo rápido y ligero, y el primer Haiku con niveles de esfuerzo. En Claude Code arranca en medio y el pensamiento no se apaga. Haiku 4.5 no tenía niveles, así que no hay ajuste viejo que arrastrar.
Tip: Úsalo para lo veloz, como resumir, clasificar o trabajar de subagente. Si para que te dé lo que quieres tienes que subirlo a extra-alto o máximo, mejor cámbiate a Sonnet 5.5.
El detalle que casi nadie te dice: con Haiku 5.5, los niveles de esfuerzo ya existen en los cuatro modelos. Pero subirle el nivel a Haiku no lo convierte en Sonnet: si en extra-alto o máximo todavía no te alcanza, te cambias a Sonnet u Opus.
Dónde se cambia · chat, Cowork y Code
El menú exacto en cada superficie
Ya sabes qué nivel quieres. Ahora, dónde le mueves. Es distinto en cada lado, pero en todos es un clic — y al final te dejo prompts para afinar el pensamiento dentro del nivel que tengas.
En el chat (claude.ai)
Toca el menú del modelo, junto al botón de enviar. Controla tres cosas: el modelo, el esfuerzo y si usa pensamiento. Entra a “Effort” y eliges bajo, medio, alto, extra-alto (en Opus 4.7 y más nuevos) o máximo; cada modelo marca con “Default” el nivel que le recomiendan. El interruptor de pensamiento aparece al pasar el mouse sobre “Effort”, aunque en los modelos nuevos no se apaga. Lo que cambies aplica desde la siguiente respuesta.
En Cowork
Cowork corre dentro de la app de escritorio y ahí eliges el modelo con el que trabaja. Ni qué nivel trae de fábrica ni dónde se mueve el esfuerzo están documentados, así que antes de una tarea larga revisa el menú del modelo. Misma regla: baja el nivel para lo rápido, súbelo para lo que arma cosas de verdad.
En Claude Code
En Claude Code el esfuerzo se maneja por comando, y aquí está la prueba de todo lo anterior: el default nunca es el máximo. Con Opus 5.5 y Sonnet 5.5 viene en medio, con el resto en alto, y solo Opus 4.7 arranca en extra-alto. El nivel activo se ve en el encabezado de la sesión. Escribe uno de estos:
Abre un control deslizante con los cinco niveles. Con Enter lo guardas para ese modelo; si presionas la tecla S, solo vale para esta sesión. El máximo dura solo la sesión.
/effortBorra el nivel que guardaste para el modelo activo y lo regresa al de fábrica.
/effort autoExtra-alto + workflows automáticos para cada tarea grande. No aparece si tu modelo no tiene extra-alto o si tienes los workflows apagados, o si tu organización o tu configuración le ponen un tope de esfuerzo por debajo de extra-alto.
/effort ultracodeFast mode en Opus 5.5, Opus 5 y Opus 4.8: el mismo Opus, más rápido. En suscripción va con créditos de uso y no entra en tu plan.
/fastDos mitos que vale aclarar. Uno: “ultracode” no es un nivel más alto que extra-alto; es un ajuste de Claude Code. Por dentro es el mismo extra-alto, más el permiso para que Code arme workflows con varios agentes. La inteligencia es la misma; lo que cambia es la orquestación. Dos: escribir “ultrathink” en tu mensaje no cambia el nivel. Solo le agrega a ese turno la instrucción de pensar más.
¿Y si solo quieres ajustar una respuesta puntual sin mover el menú? Pídelo con palabras. Estos prompts no reemplazan la perilla: Claude les hace caso dentro del nivel que tengas puesto. Sirven en el chat, en Cowork y en Code.
Bájale el pensamiento (para lo rápido)
Pégalo cuando la tarea es sencilla y solo quieres la respuesta corta y directa. Acorta lo que te contesta; lo que piensa por dentro es otra cosa: en Sonnet 5.5, pedirle que piense menos no lo reduce de forma confiable. Para eso, bájale el nivel.
Esto es una tarea sencilla. Respóndeme directo y al grano, sin darle mil vueltas ni explicarme de más. Necesito la respuesta, no el análisis.
Súbele para lo que de verdad importa
Pégalo cuando el error sale caro o hay casos raros de por medio: le pides que lo piense bien y se revise antes de responder. No le pidas que escriba su razonamiento paso a paso en la respuesta; que lo piense, y te dé el resultado.
Esto importa y prefiero que aciertes a que vayas rápido. Piénsalo bien antes de contestar, considera los casos que se pueden romper y revisa tu respuesta antes de dármela.
Que te enseñe a calibrar (bonus)
En vez de adivinar el nivel, deja que Claude te diga qué tan difícil ve cada cosa. Así aprendes a calibrar el esfuerzo tú mismo.
Te voy a pedir varias cosas seguidas. Antes de resolver cada una, dime en una línea si la ves como tarea de esfuerzo bajo, medio o alto y por qué. Quiero aprender a calibrar cuánto pensamiento pedirte para cada tipo de tarea.
Guía de la comunidad
Esta es la guía de niveles de esfuerzo: qué es, qué nivel usar por tarea y por modelo, y dónde se cambia en cada superficie de Claude, sin quemar tu cuenta. Es el punto de partida para manejar el esfuerzo; de aquí saltas a las guías de prompting de cada modelo. Vive en la bóveda de la comunidad de tododeia.
Cierre · lo pro no es maxear
“Poner Claude en máximo no te hace más pro — te vacía la cuenta más rápido y no te lo entrega mejor. Lo pro es leer la tarea y ponerle el nivel que pide: lo simple en bajo, el día a día en medio, alto cuando equivocarse sale caro, y guardar el máximo para lo que de verdad lo amerita, que es casi nunca.”
Guías hermanas · para que el nivel rinda
Claude Opus 5.5 — arranca en medio y piensa siempre
El modelo que hoy traes por default en Claude Code: por qué su medio iguala o supera al alto de Opus 5, por qué el pensamiento no se apaga y qué te conviene revisar al pasarte.
Fable 5 Prompting — cómo escribirle al modelo tope
El nivel es la mitad; la otra mitad es el prompt. Los 4 principios de Fable, sus niveles de esfuerzo y 16 prompts listos.
Opus 4.8 — effort control, fast mode y workflows
La guía a fondo del control de esfuerzo en la generación anterior de Opus: cuándo subirlo, cuándo bajarlo, qué es el fast mode y los dynamic workflows.
Sonnet 5.5 Prompting — qué hace en cada nivel
Sus niveles vienen recalibrados: qué hace en bajo y en medio, por qué pedirle que piense menos no funciona igual que bajarle el nivel, y las frases que le sirven.
Ahorra tokens en Claude Code
El /effort en acción: los trucos para estirar tu plan en Code sin quemarlo, del lado práctico.
Prompting 101 — los pilares de Anthropic
El prompting uno a uno: cómo hablarle bien a Claude para que el esfuerzo que le pones rinda de verdad.
¿Qué modelo de Claude uso? — la guía de los 4
La otra cara: no solo qué nivel, sino qué modelo. Haiku, Sonnet, Opus y Fable, la regla para saber si le cambias de modelo o le subes el esfuerzo, y cómo ponerlos a trabajar juntos.
Lo honesto antes de cerrar
Tres aclaraciones honestas. Una: el esfuerzo es una señal de comportamiento, no un presupuesto exacto — Claude igual va a pensar en un problema difícil aunque le pongas bajo, solo que menos. Dos: la escala está calibrada por modelo, así que el «medio» de Opus 5.5 no vale lo mismo que el «medio» de Opus 5; cuando cambies de modelo, vuelve a probar el nivel. Tres: cuánto ahorras depende de tu mezcla de tareas; si de por sí solo haces cosas difíciles, bajarle poco cambia. La regla que no falla es la misma: no lo traigas en máximo por costumbre, ponle el nivel que la tarea pide.