Ahora sí termina
Las tareas largas que antes se quedaban a medias —o que según terminaban— ahora las cierra de verdad, de punta a punta, sin abandonarte a mitad del camino.
Si pagas Claude, ya traes puesto el nuevo Sonnet 5 — y probablemente lo estás usando mal. Cambió la regla de cuándo usar cada modelo. Aquí va cuándo conviene, cuándo mejor Opus, qué cambió por dentro (incluido el cobro que nadie te cuenta) y cómo sacarle el máximo.
El nuevo modelo · de un vistazo
Razona antes de responder
Lo nuevo que casi nadie usa: piensa solo en lo difícil, y tú le subes o bajas el esfuerzo. La palanca más útil que traes.
Cuándo brincar
Opus 4.8 para lo difícil o lo que no puede fallar; Sonnet 5 para el resto — y para agentes le gana.
Cuenta ~30% más
Bajó el precio de etiqueta, pero la nueva forma de contar tokens hace que ese espacio enorme rinda menos.
Prompts listos
Copia, rellena los corchetes y pega: terminar tareas largas, que se revise solo, exprimir el contexto y dirigir el esfuerzo.
Guía comunidad · actualizada a julio 2026
En corto: Sonnet 5 para casi todo tu día, Opus 4.8 para lo que no quieres que falle, y una perilla —el esfuerzo— para exprimirlo.
Sonnet 5 es el modelo por defecto en Free y Pro: rápido como siempre, pero con una inteligencia que en muchas tareas ya roza a Opus. Lo nuevo de fondo: ahora piensa antes de responder cuando la tarea lo pide, termina los trabajos largos, se revisa solo y le caben proyectos enteros —cerca de un millón de tokens de una—. La letra chica: bajó el precio de etiqueta, pero la nueva forma de contar tokens suma alrededor de 30% más, así que ese espacio rinde menos de lo que parece. Esta página te dice cuándo usarlo, cuánto hacerlo pensar, cuándo brincar a Opus y cómo hacer que rinda.
01 · QUÉ ES
Sonnet 5 es la nueva generación después de Sonnet 4.6: la velocidad de siempre del Sonnet, con una inteligencia que en muchas tareas ya roza a Opus. Le caben un millón de tokens de contexto, saca hasta 128 mil de salida y trae conocimiento del mundo hasta enero de 2026. Y desde hace poco es el modelo por defecto en Free y Pro: si no cambiaste nada, ya lo traes puesto.
Antes la regla era fácil: Sonnet para lo ligero, Opus para lo serio. Eso ya cambió. Ahora Sonnet 5 hace bien casi todo el trabajo del día, y hasta le gana a Opus en una cosa importante (los agentes). Lo primero es confirmar que de verdad ya lo estás usando.
Cómo revisar que ya lo traes puesto
En claude.ai lo ves en el selector de modelo, arriba del chat: si dice Sonnet, ese es Sonnet 5. En Claude Code, escribe este comando para ver cuál traes y cambiarlo si quieres.
En Claude Code: ver o cambiar de modelo
/modelNada de esta página necesita que sepas programar. Todo son cosas que le pides a Claude en español; los prompts vienen listos más abajo, con corchetes [ASÍ] donde va lo tuyo. (Y si programas, al final hay una sección corta con lo de la API.)
02 · CUÁNDO SÍ
El cuándo sí es el fácil: casi todo lo que haces en el día. Código, automatizaciones, herramientas — ahí Sonnet 5 se mueve como pez en el agua. Para el 80% de tus tareas es el default correcto, y ni se te va a notar en el plan.
La idea de fondo: ya no necesitas pensar “¿esto amerita Opus?” cada vez. Arranca con Sonnet 5 por costumbre y solo brinca a Opus cuando la tarea de verdad lo pida (en la sección 04 está la regla exacta).
Regla de bolsillo: si dudas, es de Sonnet. Opus es la excepción, no el default.
03 · LO QUE CAMBIÓ
No es solo “un poco mejor”. Son tres saltos que se sienten desde el primer uso:
Las tareas largas que antes se quedaban a medias —o que según terminaban— ahora las cierra de verdad, de punta a punta, sin abandonarte a mitad del camino.
Le pones un error de código o un proyecto viejo y él encuentra la causa, la arregla y la prueba. Escribe la prueba que reproduce la falla, aplica el arreglo y verifica que quedó.
Aguanta cerca de un millón de tokens de una: proyectos completos y documentos gigantes sin tener que cortarlos en pedazos. Mucho más que antes.
Junta las tres y tienes un modelo al que le puedes confiar trabajo de verdad, no solo respuestas cortas.
04 · CÓMO PIENSA
Este es el cambio que casi nadie te explica, y es el que más te conviene entender. Sonnet 5 razona antes de contestar cuando la tarea lo amerita —solo, sin que se lo pidas—. En lo fácil responde directo como siempre; en lo difícil se toma un momento para pensar y por eso a veces “tarda” un poco más. No está lento: está pensando, y eso sube la calidad de lo que te entrega.
Encima de eso tienes una perilla: el esfuerzo. Va de menos a más —bajo, medio, alto (el que trae de fábrica), extra alto y máximo— y define qué tanto piensa y trabaja antes de responder. Subes el esfuerzo cuando la tarea es difícil; lo bajas cuando quieres rapidez y no te importa perder un poco de profundidad. Es la palanca más útil que traes y casi nadie la toca.
Los cinco niveles, en cristiano:
Rápido y ligero. Para chatear, cosas simples y volumen. Ojo: en tareas medianas se puede quedar corto de pensar, así que no lo uses para lo difícil.
Equilibrio, y el default en la app. Ahorra sin perder mucho: rinde parecido al Sonnet anterior a tope. Buen punto medio cuando quieres cuidar el gasto.
Buen balance para casi todo: razona bien en lo complejo. Es el default en Claude Code y la API. Si no sabes cuál usar, este.
Para lo más difícil de código y para agentes. Explora más, usa más herramientas y aguanta tareas largas. Es el que recomienda Anthropic para lo pesado.
Capacidad máxima, sin freno de tokens. Guárdalo para lo que de verdad no puede fallar; en lo normal gasta de más para ganar poco.
Cómo le mueves el esfuerzo
Y sí se puede mover —en los dos lados—. En la app tiene su propio menú (medio escondido) y en Claude Code, un comando.
En la app (claude.ai): el menú escondido
Aquí está la parte que casi nadie encuentra. Toca el nombre del modelo, abajo del chat (junto al micrófono): se abre el menú de modelos y, hasta abajo, aparece “Esfuerzo”. Ábrelo y elige el nivel.



Dos cosas que conviene saber: en la app el esfuerzo arranca en Medio (en Claude Code y la API arranca en Alto), y el interruptor de “Razonamiento” es justo el “piensa antes de responder” de esta sección: déjalo encendido para lo complejo. La propia app te avisa que a más esfuerzo, respuestas más completas pero más lentas y que gastan tus límites más rápido.
En Claude Code: el comando
Subir o bajar el esfuerzo
/effortEl menú te deja elegir entre bajo, medio, alto, extra y ultracode (que es extra + permiso para lanzar varios agentes a la vez). Súbelo para lo difícil, bájalo para lo rápido.
En cualquier lado: con palabras
Con menú o sin él (por ejemplo en el celular), también lo empujas escribiendo la intención al inicio de tu mensaje:
Regla de bolsillo: si en algo difícil te da respuestas superficiales, súbele el esfuerzo (o pídele que piense) en vez de pelearte con el prompt. Y si algo simple se siente lento, bájalo. Esa sola costumbre ya te pone por delante del 90% que lo usa en automático.
05 · EL MILLÓN
Sonnet 5 aguanta cerca de un millón de tokens de contexto de una sola vez: proyectos completos, documentos larguísimos, expedientes enteros sin cortarlos en pedazos. Y no es un “modo largo” que se paga aparte —es el tamaño normal—. Ese es el músculo; la gracia está en usarlo bien.
El detalle honesto: con la nueva forma de contar tokens, el mismo texto ocupa alrededor de 30% más que antes. Así que ese millón rinde menos texto del que suena, y se te llena antes de lo que crees. No es un problema —es cómo mide el modelo nuevo—, pero cambia cómo te conviene trabajar.
Cuatro costumbres para que ese espacio te cunda:
Pégale todo de una
No lo cortes en pedacitos. Dale el proyecto o el documento completo y pídele el análisis entero: así conecta cosas que en pedazos sueltos se le escapan.
Sé conciso tú también
No lo hagas repetir contexto que ya tiene ni le pidas resúmenes que no vas a usar. Entre menos relleno metas, más espacio libre le queda para lo que importa.
En Claude Code, usa /compact
Cuando la conversación se alarga, /compact resume lo dicho y libera espacio sin que pierdas el hilo. Es como ordenar el escritorio a media tarea.
Chat nuevo al cambiar de tema
Arrastrar una conversación vieja a un tema nuevo llena la ventana y lo confunde. Si vas a algo distinto, abre uno limpio y empieza fresco.
En Claude Code: liberar espacio sin perder el hilo
/compactEsto se conecta con el cobro: el mismo cambio que hace que un trabajo cuente ~30% más es el que hace que, en Free o Pro, el contexto se te llene antes. Ser conciso te rinde en los dos mundos —pagues por token o no—.
06 · SONNET VS OPUS
Entonces, ¿cuándo NO usar Sonnet 5? La regla nueva es corta: Sonnet para casi todo, Opus para lo que no quieres que falle. Ubica cuál de estos casos es el tuyo:
Si tu caso es: Tu día a día
Código, automatizaciones, herramientas, escribir, investigar.
Tu default. Rápido, rinde y ya casi tan listo como Opus.
Si tu caso es: Agentes y subagentes
Orquestar tareas, agentes que llaman a otros agentes.
Aquí Sonnet le gana a Opus. Es el mejor para esto.
Si tu caso es: Lo difícil o lo que no puede fallar
Código pesado, decisiones caras, trabajo largo-horizonte.
Cuando el error sale caro, Opus sigue siendo el rey.
Si tu caso es: Máxima capacidad, sin importar el costo
Lo más pesado, donde de verdad no te puedes equivocar.
Ahí no arriesgues. Para lo más difícil, Opus manda.
"Sonnet para casi todo. Opus para lo que no quieres que falle o la verdad lo difícil."
Piénsalos como dos empleados. Uno es rápido, rinde y hace casi todo el trabajo. El otro es el especialista caro — brillante para lo pesado, pero desperdiciado si lo pones a hacer lo de todos los días.
Sonnet 5
El caballo de batalla
Casi todo tu día: código, automatizaciones y —sobre todo— agentes y subagentes. En muchas tareas ya roza a Opus, a precio de Sonnet.
Opus 4.8
El especialista
Lo más difícil, lo largo-horizonte, lo que no puede salir mal. Cuesta más y por eso lo reservas para cuando de verdad hace falta.
Los números que publicó Anthropic
Sonnet 5 mejora a Sonnet 4.6 en código, en búsqueda con agentes y en uso de computadora, y en varias pruebas se acerca a Opus 4.8 — a precio de Sonnet. En la API arrancó en 2 y 10 dólares por millón (intro) contra los 5 y 25 de Opus 4.8. La diferencia de costo es real; por eso Sonnet es el default y Opus la excepción.
Y los otros dos peldaños
Sonnet y Opus no son los únicos. Arriba y abajo tienes otros dos, por si tu tarea cae en los extremos:
Haiku 4.5
El más rápido y baratoPara lo simple y de mucho volumen: clasificar, respuestas cortas, tareas ligeras donde la velocidad manda. Menos listo, pero vuela.
Fable 5
Lo más capazEl tope de gama para agentes de larga duración y lo más difícil. Cuesta bastante más; lo reservas para cuando ni Opus alcanza.
07 · EL COBRO
Aquí está lo que casi nadie te dice. En la API bajó el precio de etiqueta: arrancó en 2 dólares por millón de tokens de entrada y 10 por millón de salida (precio de intro hasta finales de agosto de 2026), y después queda en 3 y 15. Suena a rebaja, y de etiqueta lo es.
Pero cambió la forma de contar tokens: el mismo texto ahora cuenta alrededor de 30% más que antes (según el tipo de contenido, hasta cerca de 1.35 veces). No es trampa — es cómo mide el nuevo modelo. El detalle es que ese espacio enorme de un millón rinde menos de lo que parece, y por dentro un trabajo te puede salir parecido o más caro aunque el precio de etiqueta haya bajado. Ese es el cobro que no viene en el anuncio.
La jugada no es asustarte, es medir. Pídele las cosas concisas, no lo hagas repetir contexto que ya tiene, y en trabajos largos revisa cuánto llevas. En Free o Pro no pagas por token, pero este mismo cambio explica por qué el contexto se te llena antes — y por qué ser conciso te conviene igual.
08 · EL MÁXIMO
Ya sabes cuándo usarlo y cuánto hacerlo pensar. Ahora, cómo sacarle el jugo. Estos prompts están en español y se pegan tal cual en claude.ai o en Claude Code — los corchetes [ASÍ] son donde va lo tuyo.
Pégalo al inicio de una tarea larga para aprovechar que Sonnet 5 ahora sí las cierra de punta a punta.
Voy a darte una tarea larga y quiero que la termines completa, de principio a fin, sin dejarla a medias. La tarea es: [DESCRIBE LA TAREA] Trabaja paso por paso. Si algo te falta para seguir, pregúntame en vez de suponer. Cuando termines, dime en pocas líneas qué quedó hecho y qué probaste, sin adornos.
Para código o un proyecto viejo que falla: que diagnostique la causa de raíz, la corrija y verifique que quedó.
Este [CÓDIGO / PROYECTO] tiene un error: [DESCRIBE QUÉ FALLA O PEGA EL MENSAJE DE ERROR]. Encuentra la causa de raíz, no solo el síntoma. Luego: escribe una prueba que reproduzca el error, aplica el arreglo, y vuelve a correr la prueba para confirmar que quedó resuelto. Al final dime en una línea qué era y qué cambiaste.
Aprovecha el millón de tokens de contexto: pégale todo y pídele el análisis de una, sin cortarlo en pedazos.
Te voy a pasar [UN PROYECTO COMPLETO / UN DOCUMENTO LARGO]: [ADJUNTA O PEGA TODO]. No lo cortes en pedazos: tómalo completo. Después dime [QUÉ QUIERES — por ejemplo: un resumen por secciones, los riesgos, o dónde está el problema]. Si algo se contradice adentro, señálamelo.
La palanca contra el tokenizer que cuenta más: respuestas al grano, sin relleno ni repetir contexto.
Para esta conversación: respóndeme al grano, sin relleno ni repetir lo que ya te dije. Ve directo a lo que pedí. Nada de resúmenes largos ni de explicarme tu proceso a menos que te lo pida. Si una respuesta corta basta, dámela corta.
Cuando dudes qué modelo usar, deja que Claude te lo diga antes de arrancar.
Antes de empezar, dime si esta tarea la haría mejor Sonnet 5 o Opus 4.8, y por qué en una o dos líneas. La tarea es: [DESCRIBE LA TAREA] Regla: Sonnet para casi todo, incluidos agentes y subagentes; Opus para lo más difícil o lo que no puede fallar. Si es tarea de Sonnet, arranca; si es de Opus, dímelo para que cambie de modelo.
Además del menú de Esfuerzo, en cualquier lado (incluido el celular) lo empujas con palabras. Copia la línea que necesites al inicio de tu mensaje.
Para lo difícil (que piense más): Piensa con cuidado antes de responder; esta tarea tiene varios pasos y prefiero que razones bien a que vayas rápido. Para lo simple (que vaya directo): Ve al grano, sin pensar de más ni explicarme tu proceso. Si una respuesta corta basta, dámela corta.
Sonnet 5 tiende a caer en un mismo estilo visual. Como ya no puedes variar la “temperatura”, pídele opciones primero.
Antes de construir [LA PÁGINA / EL COMPONENTE], propón 4 direcciones visuales distintas para este brief. Para cada una dame: color de fondo, color de acento, tipografía y una línea de por qué encaja. Espera a que elija una y solo entonces constrúyela. El brief es: [DESCRIBE QUÉ ESTÁS HACIENDO Y PARA QUIÉN].
Y si quieres cambiar de modelo a mano: en claude.ai usas el selector arriba del chat; en Claude Code, este comando te muestra cuál traes y te deja cambiarlo.
Ver o cambiar de modelo en Claude Code
/modelY para exprimirlo en lo difícil, súbele el esfuerzo (más arriba está la explicación completa). En Claude Code, con este comando:
Subir el esfuerzo para lo pesado
/effort09 · SI PROGRAMAS
Esta sección es la única con algo de código, y es solo para quien conecta Claude desde su propio programa. Si tú usas Claude en la app o en Claude Code, sáltatela entera: no te pierdes nada del resto de la guía.
Lo bueno: Sonnet 5 es un reemplazo directo de Sonnet 4.6. En la mayoría de los casos cambias el identificador del modelo y sigues trabajando. El identificador es claude-sonnet-5.
model = "claude-sonnet-4-6" # antes
model = "claude-sonnet-5" # ahoraPero hay tres cambios de comportamiento que sí tienes que revisar antes de mandarlo a producción:
1Piensa por defecto
El pensamiento adaptativo viene encendido (en Sonnet 4.6 estaba apagado). Si no lo quieres, manda thinking: {type: "disabled"}. Y ojo: ahora el pensar también consume de tu max_tokens, así que revisa los límites que dejaste justos o te truncan la respuesta.
2Adiós a budget_tokens
El pensamiento manual con thinking: {type: "enabled", budget_tokens: N} ya no existe: devuelve error 400. Usa el pensamiento adaptativo y controla la profundidad con el parámetro effort (va en output_config, niveles low → max, incluido xhigh).
3Sin temperature ni top_p / top_k
Mandar temperature, top_p o top_k con un valor distinto al de fábrica devuelve error 400. Para tono o variedad, dilo en el system prompt; para variar el diseño, pídele que proponga opciones antes de construir.
Y no olvides el tokenizer nuevo: el mismo texto cuenta alrededor de 30% más tokens. Vuelve a medir tus prompts y revisa cualquier max_tokens que hayas dejado ajustado al milímetro, o verás salidas cortadas donde antes cabían completas.
Para el detalle fino —migración, streaming, caché de prompts— está la doc oficial de Anthropic (busca “What's new in Claude Sonnet 5” y “Prompting Claude Sonnet 5”). Aquí te dejamos lo que te ahorra los tres tropiezos más comunes.
10 · DÓNDE LO USAS
Está prácticamente en todos lados donde ya usas Claude, así que no tienes que mudarte a ningún sitio nuevo:
claude.ai
El default en Free y Pro. También disponible en Max, Team y Enterprise.
Claude Code
Aquí es donde tienes el comando /model y el /effort a la mano.
La API de Claude
Para todos los clientes, con el identificador claude-sonnet-5.
Amazon Bedrock y Google Cloud
Disponible en ambas nubes (Bedrock y Vertex) para equipos que ya viven ahí.
Microsoft Foundry
También llegó a la plataforma de Microsoft para IA.
Una cosa nueva: puede rechazar temas de ciberseguridad
Sonnet 5 es el primer Sonnet con filtros de ciberseguridad en tiempo real: puede rechazar peticiones de ciber de alto riesgo. No es censura de tu trabajo normal —ni lo vas a notar en el día a día—; es un guardarraíl. Si haces trabajo legítimo de seguridad y necesitas menos fricción, ese es de los pocos casos donde Opus 4.8 encaja mejor.
11 · FAQ
¿Ya estoy usando Sonnet 5?
Muy probablemente sí. Es el modelo por defecto en Free y Pro; si no cambiaste nada, ya lo traes. Revísalo en el selector de modelo de claude.ai o con /model en Claude Code.
¿Me sale más caro?
En la API el precio de etiqueta bajó, pero el nuevo tokenizer cuenta alrededor de 30% más tokens, así que por dentro un trabajo puede costar parecido o más. En Free o Pro no pagas por token; ahí lo que notas es que el contexto se llena antes. Ser conciso ayuda en los dos casos.
¿Cuándo mejor Opus?
Para lo más difícil o lo que no puede fallar: código pesado, decisiones caras, trabajo largo-horizonte. Ahí Opus 4.8 sigue arriba. Para agentes y subagentes, en cambio, Sonnet 5 le gana.
¿En Free o Pro cambia algo?
El modelo es mejor y termina más cosas. Sigues con tus mismos límites de uso por ventana; el cambio grande es que las tareas largas ahora sí las cierra y le caben documentos enormes de una.
¿Sigo pudiendo elegir modelo?
Sí. En claude.ai desde el selector arriba del chat, y en Claude Code con /model. Sonnet 5 es el default, pero puedes brincar a Opus 4.8 cuando la tarea lo pida.
¿Por qué a veces tarda más en responder?
Porque ahora piensa antes de contestar en lo difícil (es a propósito y sube la calidad). En lo simple sigue igual de rápido. Si tienes prisa, dile “ve al grano, sin pensar de más” y responde directo.
¿Qué es el “esfuerzo” y cómo lo cambio?
Es la perilla de cuánto piensa y trabaja: va de bajo a máximo. En la app la cambias tocando el nombre del modelo → “Esfuerzo”; en Claude Code, con /effort. Súbela en lo pesado, bájala para ganar velocidad. (Ojo: en la app arranca en Medio; en Claude Code y la API, en Alto.)
¿Me sirve si programo con la API?
Sí. El identificador es claude-sonnet-5 y es un reemplazo directo de Sonnet 4.6, con tres cambios que revisar: piensa por defecto, se fue budget_tokens y se fue temperature. Todo está en la sección “Si programas”.
¿Puede rechazar algo?
Sí: es el primer Sonnet con filtros de ciberseguridad en tiempo real, así que puede rechazar peticiones de ciber de alto riesgo. En tu trabajo normal no lo vas a notar.
Guía de la comunidad
Esta página acompaña al video sobre el nuevo Sonnet 5: junta en un solo lugar cuándo usarlo, qué cambió por dentro y los prompts para sacarle jugo. Se publica como parte de la bóveda de tododeia.
Cierre · ¿en qué lo vas a poner a prueba?
“La pregunta con la que cerraba el video sigue abierta: ¿te diste cuenta de que ya traes puesto el nuevo modelo? ¿En qué lo vas a poner a prueba? Métete a tu cuenta, míralo en el selector, y aviéntale hoy una de esas tareas largas que antes se quedaban a medias.”
Guías hermanas · antes o después de esta
Ahorra tokens en Claude Code
Si el nuevo tokenizer te preocupa, aquí están los trucos para que el contexto y el gasto te rindan más.
Los modelos de Claude, sin enredos
El panorama completo: qué modelo usar según la tarea y cómo no quemar tu plan a media semana.
Opus 4.8 a fondo
El otro lado de la moneda: cuándo de verdad vale la pena brincar al modelo pesado.
Lo honesto antes de cerrar
Lo honesto: el precio de etiqueta bajó, pero la nueva forma de contar tokens suma alrededor de 30% más, así que por dentro un trabajo te puede rendir menos. No es trampa ni letra chica malintencionada — es cómo mide el nuevo modelo. La jugada es simple: pídele las cosas concisas, súbele el esfuerzo cuando la tarea lo pida y elige bien entre Sonnet y Opus. Con eso, ese millón de contexto sí te rinde.