Investigación · lanzamiento del 22/09/2026

Claude Opus 5.5: más barato, más fuerte y con API nueva

Precios, benchmarks, qué cambia en la API y qué actualizar en cada sistema para usar el nuevo modelo.

Banner de Claude Opus 5.5: investigación y plan de actualización
Resumen

Más barato que Opus 5 y por delante de él en casi todo

Con cuatro cambios de API que rompen código antiguo. API ID claude-opus-5-5, 1M de contexto, 128K de salida, effort predeterminado medium.

Precio vs Opus 5
−20%

US$ 4/20 frente a 5/25 por millón de tokens

Cache read
−60%

US$ 0,20 frente a 0,50

Costo por tarea
−40%

aproximado; estimación de Anthropic con la configuración predeterminada

SWE-bench Pro
89,9

Opus 5: 79,2 (system card, effort max)

Terminal-Bench 4.0
66,4%

+14 puntos sobre Opus 5

AA Intelligence Index
58

1.º puesto en Artificial Analysis el 22/09/2026

Precios

El Opus más barato hasta hoy

Y con el mayor descuento de caché de la línea Opus.

ModeloEntradaSalidaCache readBatch (in/out)Fast (in/out)
Fable 5.110500,255 / 25—
Opus 5.54200,202 / 108 / 40
Opus 55250,502,50 / 12,5010 / 50
Opus 4.85250,502,50 / 12,5010 / 50
Sonnet 52100,201 / 5—
Haiku 4.5150,100,50 / 2,50—

US$ por millón de tokens. Fuente: página oficial de precios de Anthropic [PR]. El fast mode es un research preview y solo existe en la Claude API.

Qué significa en la práctica
  • Con el cache read a 0,05x de la entrada, las sesiones largas de agentes que releen el mismo prefijo (bots, Claude Code) salen mucho más baratas. En cambio, un cache miss pesa más en términos relativos.
  • En las suscripciones (Claude Code, claude.ai) el precio por token no se ve, pero Anthropic aumentó los límites de 5 horas en los planes de pago.
Benchmarks

Supera a Opus 5 y a Fable 5.1 en casi todas las pruebas del system card

Y pierde frente a GPT-6 Astra en tres.

Léalo con cuidado
  • Los números oficiales son autoinformados y medidos con effort max (Terminal-Bench en xhigh), con los safeguards de producción activados. Varios los ejecutaron socios (Cognition, Cursor, Zapier, Artificial Analysis).
  • Anthropic reevalúa los modelos anteriores en cada system card. Opus 5 tiene 1861 en GDPval-AA v2 en su propio card y 1708 en v2.1 en el card de 5.5. No mezcle tablas.
  • Donde Opus 5.5 pierde: Terminal-Bench-Science (58,7 frente a 64,6 de GPT-6 Astra), AutomationBench (40,0 frente a 41,4), FrontierSWE v2 (62,3 frente a 65,5) y OfficeQA (frente a Fable 5.1).
  • No se informaron para 5.5: SWE-bench Verified, ARC-AGI, GPQA, AIME/USAMO, BrowseComp ni τ-bench. El modelo aún no aparece en LMArena.
  • La propia Anthropic dice que "los márgenes de benchmark se han vuelto una guía menos fiable" y que la distancia real con Fable 5.1 "es menor de lo que sugieren las notas".
Effort × costo

En high, Opus 5.5 ya supera a Fable 5.1 en max

Por menos de una cuarta parte del costo por tarea, según Artificial Analysis.

En la práctica: la misma app en seis niveles

Prueba de terceros (24/09/2026): el mismo /goal en Claude Code en todos los niveles, convirtiendo ~105 GB de grabaciones de un evento en una conferencia 3D explorable. Una ejecución por nivel, con el juicio visual del autor y costo estimado a precio de API.

EffortTiempoCosto (est.)TokensChecksResultado
low16m43sUS$ 3,91191k22Funciona, pero con marca equivocada y videos estáticos
medium1h13mUS$ 12,44419k23El mayor salto de calidad
high1h07mUS$ 16,31~559k22Más detalle y narrativa
xhigh1h30mUS$ 25,92~723k34Preferido por el autor
max2h28mUS$ 50,381,18M512× el costo de xhigh y con más bugs
ultracode1h35mUS$ 18,69?42No creó workflows; funcionó como xhigh

El experimento de GPT-6 Astra con el mismo diseño llegó al mismo patrón: el nivel máximo no fue el preferido, y allí ganó medium. Gráficos, los ocho patrones y los límites de los datos están en Esfuerzo en la práctica.

Opinión de Nei

Usar Opus 5.5 en medium es la mejor opción para el día a día. Sube a high cuando haga falta más razonamiento y deja xhigh para casos extremos. Lo mismo vale para GPT-6 Astra. max queda fuera. Es una opinión registrada, no una regla.

Cambios de API

Cuatro breaking changes y un cambio silencioso

Respecto de Opus 5. Quien viene de 4.x también hereda las restricciones anteriores.

#Qué cambiaErrorCómo migrar
1El thinking no se desactiva. {type:"disabled"} y budget_tokens se rechazan con cualquier effort.400Omitir thinking (o usar adaptive) y controlarlo con output_config.effort. Para baja latencia, low.
2Sin forced tool use. tool_choice any/tool se rechazan, también en Batches y count_tokens.400auto + strict: true + una instrucción en el prompt, y comprobar que la llamada ocurrió. Para extraer JSON, structured outputs.
3Preserved thinking. Los thinking blocks quedan ligados al modelo y a la conversación. Las cuentas creadas desde el 31/08/2026 reciben un 400 si se edita el historial.400 / descarteHistorial solo por adición. Un mensaje system en medio de la conversación en lugar de editar el system. O el beta thinking-binding-controls con drop_block.
4Computer use solo mediante computer_toolset_20260801. computer_20251124 se rechaza (API y Google Cloud).400Cambiar la declaración de la tool y el bucle del agente (la acción pasa a ser el name del bloque, varios por turno).
5El texto entre tool calls llega ahora como thinking blocks de progreso, vacíos con el display predeterminado.ningunothinking.display: "updates" (beta) o "summarized", y mostrar esos bloques.

Antes y después (Python)

# Antes: aceptado en Opus 5, 400 en Opus 5.5
client.messages.create(model="claude-opus-5", max_tokens=16000,
    thinking={"type": "disabled"}, temperature=0.4, messages=[...])

# Después: thinking siempre activado, el effort es el control
client.messages.create(model="claude-opus-5-5", max_tokens=16000,
    output_config={"effort": "low"}, messages=[...])

También heredado (si viene de 4.x)

Seguridad

El primer Opus con clasificadores de cyber, bio y anti-extracción del razonamiento (reasoning_extraction). Un rechazo vuelve como HTTP 200 con stop_reason: "refusal". La recomendación es activar el fallback del lado del servidor (fallbacks: "default"), sabiendo que el modelo de fallback funciona sin los thinking blocks de 5.5. El system card no cita ningún nivel ASL y señala salvedades: el modelo sigue más instrucciones maliciosas pegadas por el usuario y acepta más afirmaciones de autorización que no se pueden verificar.

Sistemas

Dónde funciona Claude hoy en los sistemas de INEMA

Inventario de solo lectura del servidor el 22/09/2026: modelo, forma de llamada, qué hacer y prioridad.

Dos hallazgos que van antes de cualquier cambio de modelo
  • Hay dos claude instalados. ~/.local/bin/claude es la 2.1.280 y /usr/bin/claude es la 2.1.63, de un npm global antiguo. Las 17 yt-scheduler*.service y dos crons ponen /usr/bin primero en el PATH, así que ejecutan la versión antigua, que usa claude-opus-4-6 por defecto. Cambiar el modelo en la configuración no llega a ellos.
  • openpcbotv2 usa el Agent SDK 0.2.50, que trae un CLI 2.1.50 integrado. Primero actualizar el SDK y después cambiar el ID.
SistemaHoyCómo llamaQué hacerPrioridad
yt-pub-lives (17 schedulers)claude-opus-4-6 (predeterminado de 2.1.63)claude -p, CLI antiguoCorregir el PATH de las units (o actualizar /usr/bin/claude) y pasar --model opus de forma explícita.ALTA
openpcbotv2claude-opus-5, effort lowAgent SDK 0.2.50Actualizar el SDK, cambiar a claude-opus-5-5 en los agent.yaml, mantener el effort explícito e incluir xhigh en el tipo.ALTA
openpcbotv3alias opus → ya es 5.5CLI 2.1.280Nada en el modelo. Comprobar que el effort es explícito en el yaml (el predeterminado de 5.5 es medium).OK
openpcbotv3 (tiers de OpenRouter)haiku-4.5 / sonnet-5OpenRouter, temperature 0.4Si el tier premium pasa a Opus 5.5, quitar temperature. Corregir la tabla de precios de opus-5 (dice 15/75; lo correcto es 5/25).MEDIA
cerebro-vip (API de chat)opus-4.8, sonnet-5, fable-5 (predeterminado glm-5.2)OpenRouter, temperature 0.2Añadir Opus 5.5 a la lista y no enviar temperature a los modelos Claude 4.7+.MEDIA
Crons de cerebro-vip y telegramtopicosindexalias sonnetCLI 2.1.63La misma corrección de PATH que los schedulers.MEDIA
inemaccvbot (detenido)claude-opus-5, effort lowCLICambiar a claude-opus-5-5 cuando se reactive.MEDIA
musicavideoclaude-fable-5CLIDecisión de producto: probar Opus 5.5, que en el system card supera a Fable 5.1 en la mayoría de las pruebas y cuesta un 60% menos.MEDIA
inemaccbot (10 perfiles)alias sonnet, effort lowCLINada por ahora. Sonnet 5.5 llega en semanas y el alias se actualiza solo.BAJA
Portal (chat del sitio)haiku-4.5OpenRouterNada por ahora. Esperar a Haiku 5.5.BAJA
iccmonitclaude-haiku-4-5-20251001SDK de PythonMantener. Si algún día pasa a Opus 5.5, leer la respuesta por type (hoy usa content[0].text, que se rompe con thinking).BAJA
claudebot, inemabot, dsh-sandboxsonnet-4-6, opus-4-6, sonnet-4.5variosLegado detenido. Actualizar solo si vuelve a funcionar.BAJA

No usan Claude: inemanews, inemaeventos y las novedades del portal (Groq), webmcp-readiness, inemacbot, agentehermes, dsh-orchestrator y cerebro-pro.

Plan de actualización · paso a paso

De lo que más desbloquea al ajuste fino

Cinco pasos con comandos reales. El orden importa: sin el paso 1, los cambios de modelo no llegan a los servicios que ejecutan el CLI antiguo.

1

Desbloquear el CLI

Averiguar qué claude ve cada servicio y hacer que todos usen la versión actual.

# ver las dos instalaciones
which -a claude; /usr/bin/claude --version; ~/.local/bin/claude --version
# opción A: actualizar el npm global antiguo
npm i -g @anthropic-ai/claude-code@latest
# opción B: en las units yt-scheduler*.service, poner ~/.local/bin primero en el PATH
Environment=PATH=/home/nmaldaner/.local/bin:/usr/local/bin:/usr/bin:/bin
systemctl --user daemon-reload && systemctl --user restart 'yt-scheduler*'
2

Confirmar a dónde apunta el alias

El alias opus sigue al modelo más nuevo. Prefiera el alias a fijar un ID; fíjelo solo donde importe la reproducibilidad.

# qué modelo respondió de verdad
claude --model opus -p "ok" --output-format json | jq -c '.modelUsage|keys'
# el 22/09/2026: ["claude-opus-5-5"]
3

Cambiar el ID donde está fijado

En openpcbotv2, actualizar primero el Agent SDK y después cambiar el modelo en los agent.yaml, manteniendo el effort explícito.

# 1) SDK actual (el 0.2.50 trae un CLI 2.1.50 integrado)
npm i @anthropic-ai/claude-agent-sdk@latest
# 2) agents/*/agent.yaml
model: claude-opus-5-5
effort: low
4

Limpiar las llamadas vía OpenRouter

Antes de apuntar a Claude 4.7 o posterior, quitar temperature, top_p y top_k del cuerpo de la petición. Falta comprobar el slug de Opus 5.5 en OpenRouter.

# sin temperature/top_p/top_k para Claude 4.7+
{ "model": "anthropic/claude-opus-...", "messages": [...] }
5

Checklist oficial para código de la API

Para cualquier código que llame a la API directamente (guía de migración de Anthropic).

TipoElemento
BLOQUEAID claude-opus-5-5 (Bedrock: anthropic.claude-opus-5-5).
BLOQUEAQuitar thinking disabled y budget_tokens. Dimensionar max_tokens para thinking + respuesta. Leer los bloques por type.
BLOQUEACambiar tool_choice any/tool por auto + strict, o structured outputs.
BLOQUEAComputer use mediante computer_toolset_20260801.
BLOQUEAHistorial solo por adición (preserved thinking). Tratar stop_reason: "refusal" y activar el fallback.
AJUSTEDefinir el effort de forma explícita y medir low/medium antes de subir.
AJUSTEInterfaces que mostraban texto entre tool calls: display: "updates".
AJUSTEVolver a medir costo y latencia. Revisar los prompts escritos para Opus 5 (verbosidad, verificación).
Todavía no se cambió nada
  • Esta página es la investigación y el plan. Aplicarlo en los sistemas de producción es un paso aparte.
Cronología

Nueve lanzamientos en diez meses

Fechas de la API, según las release notes de Anthropic.

24/11/2025
Opus 4.5El parámetro effort entra en beta.
05/02/2026
Opus 4.6Adaptive thinking; budget_tokens obsoleto; prefill eliminado.
16/04/2026
Opus 4.7Tokenizer nuevo; parámetros de muestreo rechazados.
28/05/2026
Opus 4.81M de contexto por defecto.
09/06/2026
Fable 5Y Mythos 5, restringido al Project Glasswing.
30/06/2026
Sonnet 5US$ 2/10 por millón de tokens.
24/07/2026
Opus 5US$ 5/25 por millón de tokens.
01/09/2026
Fable 5.1Y Mythos 5.1; cache read a US$ 0,25.
22/09/2026
Opus 5.5US$ 4/20; el tema de esta página.
Próximamente
Sonnet 5.5 · Haiku 5.5"En las próximas semanas", según el anuncio.
Metodología y fuentes

De dónde salen los números

Investigación realizada el 22/09/2026, día del lanzamiento: documentación oficial de Anthropic, cobertura de terceros y un inventario local de solo lectura. Cada gráfico usa una única tabla de origen. Los números autoinformados están marcados como tales.

Oficiales (Anthropic)

  1. [A] Anuncio — anthropic.com/claude-opus-5-5
  2. [MP] Descripción del modelo — platform.claude.com/…/opus-5-5/overview
  3. [W] What's new — platform.claude.com/…/whats-new-opus-5-5
  4. [MG] Guía de migración — platform.claude.com/…/opus-5-5/migration-guide
  5. [MO] Descripción de los modelos — platform.claude.com/…/models/overview
  6. [PR] Precios — platform.claude.com/…/pricing
  7. [RN] Release notes — platform.claude.com/…/release-notes
  8. [SC] System Card Opus 5.5 — PDF
  9. [SC5] System Card Opus 5 — PDF

Terceros

  1. Artificial Analysis — release · leaderboard
  2. GitHub Changelog — Opus 5.5 / Copilot
  3. CodeRabbit — "More catches, different misses"
  4. OrcaRouter — Opus 5.5 vs Opus 5
  5. The Decoder — the-decoder.com
  6. MacRumors · 9to5Mac · XDA · Thurrott