MentorMe

Guía de modelo · lanzado el 24 de julio de 2026 · claude-opus-5

El dial es el modelo.

Opus 5 es el primer Claude en el que lo principal que ajustas no es la redacción de tu prompt — es cuánto esfuerzo le pides que aplique. Rendimiento de primer nivel a $5/$25 por millón de tokens, la mitad de Fable 5.

Esto es lo que realmente cambió, qué eliminar de tus prompts antiguos y los nueve bloques de prompt que vale la pena conservar.

Compilado a partir de la documentación de Opus 5 de Anthropic y la cobertura del día de lanzamiento · Principios de prompting, no intuición.

01 — las cifras

Qué estás comprando.

Mismo precio que Opus 4.8. Aproximadamente el doble de puntaje en el benchmark agéntico más difícil de Anthropic.

Entrada
$5 / M tokens
Salida
$25 / M tokens
Contexto
1M predeterminado y máximo
Salida máxima
128k tokens
Razonamiento
Activado por defecto
Modo rápido
2.5× a $10/$50
BenchmarkResultadoQué significa
Frontier-Bench v0.143.3% vs 18.7% (Opus 4.8)Más del doble, a menor costo por tarea
CursorBench 3.2A 0.5% de Fable 5Mitad de precio para una codificación casi equivalente
ARC-AGI 33× el siguiente mejor modeloBrecha en razonamiento novedoso, no un margen de error
OSWorld 2.0 (uso de computadora)Supera lo mejor de Fable 5A cerca de un tercio del costo
Zapier AutomationBench~1.5× el siguiente mejor; 100% en tareas de retenciónAutomatización real de negocio, no tareas de juguete
Química orgánica (interno)+10.2 pts sobre 4.8El mejor Claude disponible al público para ciencia
Redlines legales de primer borrador~2× Opus 4.8Primeros borradores profesionales, no esquemas
La cifra que más importa en producción

Harvey reportó que Opus 5 igualó la calidad de salida de Opus 4.8 en razonamiento máximo, mientras reducía el uso promedio de tokens un 26%. El ahorro no está en el precio de lista — está en que un esfuerzo menor ahora supera el estándar que el modelo anterior necesitaba esfuerzo máximo para alcanzar.

02 — la escala de esfuerzo

Elige un peldaño, y deja de ajustar.

El esfuerzo rige cada token de la respuesta — razonamiento, llamadas a herramientas y argumentos — no solo el razonamiento. Un esfuerzo menor implica menos llamadas a herramientas, menos preámbulo, confirmaciones más breves.

NivelÚsalo paraVeredicto en Opus 5
lowClasificación, búsquedas, subagentes, chat de alto volumenúsalo libremente — notablemente más fuerte que los "low" anteriores de Opus
mediumTrabajo agéntico rutinario, equilibrio entre costo y velocidadúsalo libremente — tu principal palanca de costo
high (predeterminado)Razonamiento complejo, la mayoría del trabajo de conocimientovalor seguro por defecto — idéntico a omitir el parámetro
xhighProgramación, ejecuciones agénticas de más de 30 minutos, búsqueda profundaempieza aquí para código — recomendación propia de Anthropic
maxSolo problemas genuinamente de fronteramide antes — costo alto, diferencia pequeña en la mayoría de los casos

En Claude Code y claude.ai

Escribe /effort xhigh para una sesión de programación real o una ejecución de agente; déjalo en high para ediciones y preguntas rápidas. Baja a medium cuando hagas algo repetitivo y quieras velocidad. ultracode en el menú de Claude Code no es un sexto nivel de la API — es xhigh más permiso permanente para lanzar flujos de trabajo multiagente.

En la API

0 · output_config.effort

{
  "model": "claude-opus-5",
  "max_tokens": 64000,
  "stream": true,
  "output_config": { "effort": "xhigh" },
  "messages": [{ "role": "user", "content": "..." }]
}

En xhigh o max, fija max_tokens alto — 64k es un punto de partida razonable — porque limita el razonamiento más el texto de respuesta juntos. Y usa streaming: 64k de salida puede superar el límite de tiempo sin streaming.

Tres trampas

1. El esfuerzo controla el volumen de razonamiento, no la longitud visible de la respuesta. Bajarlo no acortará la respuesta — tienes que pedir brevedad con palabras. 2. Cambiar el esfuerzo a mitad de conversación invalida tu caché de prompt, porque el esfuerzo da forma al prompt renderizado. Elige un nivel por sesión. 3. thinking: {"type":"disabled"} en xhigh o max devuelve un error 400. Ese es el cambio disruptivo respecto a 4.8.

03 — migración

Las instrucciones que hay que eliminar.

Lo más rentable que puedes hacer con un prompt antiguo de Opus 4.8 es quitarle cosas. Opus 5 ya realiza varios de los comportamientos que tu prompt compensaba, y decírselo dos veces hace que los repita dos veces.

Si tu prompt dice…Haz estoPorque
"Incluye un paso final de verificación" / "usa un subagente para verificar"deleteSe autoverifica. La instrucción provoca sobre-verificación y quema tokens sin ganancia de calidad.
"Verifica dos veces tu respuesta antes de responder"deleteEl mismo problema acumulativo: ya detecta y corrige sus propios errores.
"Reporta solo problemas de alta severidad" (revisión de código)deleteLo sigue al pie de la letra y subreporta. Pide todo y filtra en una segunda pasada.
"No razones" / "no pienses"deleteAumenta la probabilidad de que se filtren etiquetas XML internas en la salida visible.
Soluciones alternativas de visión ajustadas para modelos anterioresre-testLa precisión en gráficos, diagramas y replicación de interfaces mejoró; la muleta ahora puede perjudicar.
Valores de esfuerzo heredados de 4.8 / 4.7re-sweepLow y medium superan estándares que antes no alcanzaban. Repite la evaluación con tus propios tests.
thinking: {"type":"adaptive"}keepSigue siendo válido, ahora equivalente al valor por defecto. Pero revisa max_tokens: el razonamiento ahora cuenta dentro de ese límite.

Qué añadir en su lugar

Las aristas de Opus 5 tienen todas la misma forma — hace más. Respuestas más largas, documentos más largos, más narración, más delegación, alcance más amplio. Cada prompt de abajo recorta uno de esos excesos.

04 — la biblioteca de prompts

Nueve bloques que vale la pena conservar.

Pégalos en un system prompt, un CLAUDE.md, o al inicio de un chat largo. Cada uno apunta a un comportamiento medido específico, no a una intuición.

1 · Concisión — productos de cara al usuario

Keep responses focused, brief, and concise. Keep disclaimers and caveats short, and spend most of the response on the main answer. When asked to explain something, give a high-level summary unless an in-depth explanation is specifically requested.

Las respuestas por defecto de Opus 5 son más largas que las de 4.8. Esta es la solución — el esfuerzo no lo es.

2 · El recordatorio al final del prompt

<tone_preference>
Keep outputs reasonably concise.
</tone_preference>

En un system prompt largo, combina la instrucción completa cerca del inicio con este recordatorio breve cerca del final.

3 · Cadencia de narración durante ejecuciones de agente

Before your first tool call, say in one sentence what you're about to do. While working, give a brief update only when you find something important or change direction. When you finish, lead with the outcome: your first sentence should answer "what happened" or "what did you find," with supporting detail after it for readers who want it.

Opus 5 anuncia lo que va a hacer, a veces con demasiado detalle. Describe la cadencia que quieres; los ejemplos positivos funcionan mejor que las prohibiciones.

4 · Longitud de entregables escritos

Match the length of written documents to what the task needs: cover the substance, but do not pad with filler sections, redundant summaries, or boilerplate.

Los archivos escritos a disco —informes, Markdown, resúmenes— se inflan de forma independiente a la verbosidad conversacional. Es una palanca separada.

5 · Control de alcance

Deliver what was asked, at the scope intended. Make routine judgment calls yourself, and check in only when different readings of the request would lead to materially different work. If the request seems mistaken or a better approach exists, say so in a sentence and continue with the task as asked rather than quietly narrowing, widening, or transforming it. Finish the whole task, and stop short of actions that are clearly beyond what was asked.

El mejor bloque de uso general de esta página. Opus 5 aplicará su propio criterio sobre lo que la tarea "debería" ser a menos que traces el límite.

6 · Limitar la generación de subagentes

Delegate to a subagent only for large tasks that are genuinely independent and parallelizable, such as a wide multi-file investigation. Do not delegate work you can finish yourself in a handful of tool calls, and do not use subagents to verify or double-check your own work. If one subagent can complete the task, use one rather than several, and keep spawn counts low.

La delegación multiplica el costo y el tiempo de ejecución en tareas pequeñas. Opus 5 recurre a ella con más facilidad que 4.8.

7 · Deja de narrar correcciones

Only correct an earlier statement when the error would change the user's code, conclusions, or decisions. State corrections plainly and briefly, then continue the task. For slips that change nothing for the user, make the fix and move on without noting it.

La autocorrección es una ventaja; narrar cada autocorrección a un cliente no lo es.

8 · Revisión de código que encuentra todo

Review this change and report every issue you find, including low-severity ones and anything you are only moderately confident about. Do not filter for severity — I will triage in a separate pass. For each finding give the file and line, a one-sentence statement of the defect, and a concrete failure scenario with inputs and the wrong result.

La precisión y la exhaustividad son altas en Opus 5, y la exactitud se mantiene incluso con menor esfuerzo — así que corre una pasada rápida en medium al momento de revisar y una pasada completa en xhigh más adelante.

9 · Si debes desactivar el razonamiento

You may say a brief sentence before using a tool.
Do not include internal or system XML tags in your response.

Con el razonamiento desactivado, Opus 5 a veces escribe una llamada a herramienta como texto plano (nunca se ejecuta, y contamina turnos posteriores) o filtra etiquetas. Estas dos líneas mitigan ambos casos. Mejor: mantén el razonamiento activo y baja el esfuerzo en su lugar.

Nueve prompts son un comienzo, no un sistema

Dar prompts no es una estrategia. Querer un plan de 90 días que corra todo tu negocio con IA sí lo es.

Construir mi roadmap de IA a 90 días →

05 — enrutamiento

A qué apuntarlo.

Dónde el modelo justifica su precio, y dónde uno más barato bastaría.

Dale toda la especificación y retírate

Opus 5 es más fuerte en funciones multiarchivo, grandes refactorizaciones y trabajo de principio a fin, y termina en vez de dejar stubs y TODOs. Entrégale la especificación completa desde el inicio en lugar de darle pasos por goteo.

Revisión de código a dos velocidades

Encuentra errores reales a una tasa alta por pasada, con hallazgos adicionales que en su mayoría son reales. La exactitud se mantiene en niveles bajos, así que corre barato al momento del commit y a fondo antes del lanzamiento.

Visión con herramientas, no solo razonamiento

Gráficos, documentos densos, diagramas y replicación de interfaces. Dale bash y herramientas de recorte para que pueda inspeccionar y verificar visualmente — eso supera invertir el presupuesto solo en razonamiento.

El millón de tokens completo

El contexto de 1M es a la vez predeterminado y máximo, y el seguimiento de instrucciones, las llamadas a herramientas y el razonamiento se mantienen consistentes en toda la ventana. Trabajo con repositorios completos o salas de datos completas está sobre la mesa.

Hojas de cálculo y presentaciones

Libros de trabajo multihoja con fórmulas no triviales, y diapositivas bien estructuradas. Seguirá una plantilla corporativa — pero solo si le das una.

Orquestación

Los equipos de subagentes escritor-verificador se mantienen coherentes, con pocos agentes pisándose el trabajo entre sí. Limita la cantidad de agentes por costo, no por corrección.

06 — silenciosamente útil

Cuatro cambios que nadie puso en el titular.

El mínimo de caché de prompt bajó a 512 tokens (desde 1,024). System prompts cortos que nunca podían almacenarse en caché en 4.8 ahora pueden, sin cambiar código.

Cambios de herramientas a mitad de conversación (beta). Agrega o elimina herramientas entre turnos sin invalidar la caché — encabezado mid-conversation-tool-changes-2026-07-01.

Modo de fallbacks predeterminado (beta). fallbacks: "default" enruta los rechazos por categoría a las alternativas recomendadas de Anthropic en vez de una lista que tú mantienes — encabezado server-side-fallback-2026-07-01.

Modo rápido. 2.5× de rendimiento al doble de tarifa ($10/$50), solo en la API de Claude — todavía no en Bedrock, Google Cloud ni Microsoft Foundry.

Fundador —

Ya sabes cómo correr Opus 5: el dial de esfuerzo, qué eliminar de tus prompts, los nueve bloques que aguantan plazos reales.

Dar prompts es el 20% fácil. El otro 80% es decidir a qué apuntarlo primero, en qué orden, dentro de un negocio que todavía tiene que pagar nómina. Esa es la parte que construimos contigo — un roadmap de 90 días, no otro paquete de prompts.

— Italo

Las herramientas cambian. Los principios de prompting no.

— por qué esta guía no quedará obsoleta el próximo mes

Respuestas directas · sin rodeos

07 — respuestas directas

Las preguntas que todos hacen.

No del todo, y ese es justo el punto. Opus 5 queda a 0.5% de Fable 5 en CursorBench 3.2 y lo supera en uso de computadora OSWorld, a la mitad o un tercio del costo. Fable 5 se mantiene por delante en el trabajo más difícil, de horizonte largo, ambiguo y de múltiples días. Si una tarea le toma a una persona horas o días y todavía nadie la ha resuelto, esa es tarea para Fable. Todo lo demás es para Opus 5.

¿Todavía tienes preguntas sobre cómo correr tu negocio con esto?

Sáltate el ensayo y error. Consigue el plan de 90 días que convierte estas respuestas en ingresos.

Consigue mi roadmap gratis →

La aventura es la subida

Conoce el modelo. Ahora construye el negocio.

Construir mi roadmap a 90 días →
Roadmap gratis · 4 minutos · sin tarjetaConstruido alrededor de tu negocio — no una plantilla