Preços, benchmarks, o que muda na API e o que atualizar em cada sistema para usar o novo modelo.

E com quatro mudanças de API que quebram código antigo. API ID claude-opus-5-5, 1M de contexto, 128K de saída, effort padrão medium.
US$ 4/20 contra 5/25 por milhão de tokens
US$ 0,20 contra 0,50
aproximado; estimativa da Anthropic na configuração padrão
Opus 5: 79,2 (system card, effort max)
+14 pontos sobre o Opus 5
1º lugar na Artificial Analysis em 22/09/2026
anthropic.claude-opus-5-5), Vertex, Foundry, Claude Platform on AWS e GitHub Copilot.effort, e o padrão caiu de high para medium.opus resolve para claude-opus-5-5 (testado em 22/09). Nenhum sistema fixa o ID novo ainda.E com o maior desconto de cache da linha Opus.
| Modelo | Entrada | Saída | Cache read | Batch (in/out) | Fast (in/out) |
|---|---|---|---|---|---|
| Fable 5.1 | 10 | 50 | 0,25 | 5 / 25 | — |
| Opus 5.5 | 4 | 20 | 0,20 | 2 / 10 | 8 / 40 |
| Opus 5 | 5 | 25 | 0,50 | 2,50 / 12,50 | 10 / 50 |
| Opus 4.8 | 5 | 25 | 0,50 | 2,50 / 12,50 | 10 / 50 |
| Sonnet 5 | 2 | 10 | 0,20 | 1 / 5 | — |
| Haiku 4.5 | 1 | 5 | 0,10 | 0,50 / 2,50 | — |
US$ por milhão de tokens. Fonte: página oficial de preços da Anthropic [PR]. Fast mode é research preview e existe só na Claude API.
E perde para o GPT-6 Astra em três.
max (Terminal-Bench em xhigh), com os safeguards de produção ligados. Vários foram rodados por parceiros (Cognition, Cursor, Zapier, Artificial Analysis).Por menos de um quarto do custo por tarefa, segundo a Artificial Analysis.
medium. Quem não define o effort cai um degrau em relação ao Opus 5. Nos testes da Anthropic, o 5.5 em medium supera o Opus 5 em high em código e trabalho de conhecimento.medium marca 54,6% e max 54,4%. No CursorBench, subir de medium (52,5%, ~US$ 3 por tarefa) para max (57,8%) rende cerca de 5 pontos, pagando mais por tarefa.xhigh e max. Deixe folga no max_tokens (64K é o ponto de partida sugerido para turnos longos de agente).Teste de terceiros (24/09/2026): o mesmo /goal no Claude Code em todos os níveis, transformando ~105 GB de gravações de um evento em uma conferência 3D explorável. É uma rodada por nível, com o julgamento visual do autor, e custo estimado em preço de API.
| Effort | Tempo | Custo (est.) | Tokens | Checks | Resultado |
|---|---|---|---|---|---|
low | 16m43s | US$ 3,91 | 191k | 22 | Funciona, mas com marca errada e vídeos estáticos |
medium | 1h13m | US$ 12,44 | 419k | 23 | O maior salto de qualidade |
high | 1h07m | US$ 16,31 | ~559k | 22 | Mais detalhe e narrativa |
xhigh | 1h30m | US$ 25,92 | ~723k | 34 | Preferido pelo autor |
max | 2h28m | US$ 50,38 | 1,18M | 51 | 2× o custo do xhigh e com mais bugs |
| ultracode | 1h35m | US$ 18,69 | ? | 42 | Não criou workflows; funcionou como xhigh |
O experimento do GPT-6 Astra com o mesmo desenho chegou ao mesmo padrão: o nível máximo não foi o preferido, e lá o vencedor foi o medium. Gráficos, os oito padrões e os limites dos dados estão em Esforço na prática.
Usar o Opus 5.5 em medium é a melhor opção para o dia a dia. Suba para high quando precisar de mais raciocínio e deixe o xhigh para caso extremo. O mesmo vale para o GPT-6 Astra. O max fica de fora. É uma opinião registrada, não uma regra.
Em relação ao Opus 5. Quem vem do 4.x também herda as restrições anteriores.
| # | O que muda | Erro | Como migrar |
|---|---|---|---|
| 1 | Thinking não desliga. {type:"disabled"} e budget_tokens são rejeitados em qualquer effort. | 400 | Omitir thinking (ou usar adaptive) e controlar pelo output_config.effort. Para latência baixa, low. |
| 2 | Sem forced tool use. tool_choice any/tool rejeitados, inclusive em Batches e count_tokens. | 400 | auto + strict: true + instrução no prompt, e conferir se a chamada veio. Para extrair JSON, structured outputs. |
| 3 | Preserved thinking. Thinking blocks ficam presos ao modelo e à conversa. Contas criadas a partir de 31/08/2026 levam 400 se o histórico for editado. | 400 / descarte | Histórico só por acréscimo. Mensagem system no meio da conversa em vez de editar o system. Ou o beta thinking-binding-controls com drop_block. |
| 4 | Computer use só pelo computer_toolset_20260801. O computer_20251124 é rejeitado (API e Google Cloud). | 400 | Trocar a declaração da tool e o loop do agente (a ação vira o name do bloco, vários por turno). |
| 5 | Texto entre tool calls passa a vir em thinking blocks de progresso, vazios no display padrão. | nenhum | thinking.display: "updates" (beta) ou "summarized", e renderizar esses blocos. |
# Antes: aceito no Opus 5, 400 no Opus 5.5 client.messages.create(model="claude-opus-5", max_tokens=16000, thinking={"type": "disabled"}, temperature=0.4, messages=[...]) # Depois: thinking sempre ligado, effort é o controle client.messages.create(model="claude-opus-5-5", max_tokens=16000, output_config={"effort": "low"}, messages=[...])
temperature, top_p e top_k com valor fora do padrão dão 400 desde o Opus 4.7.Primeiro Opus com classificadores de cyber, bio e anti-extração de raciocínio (reasoning_extraction). Uma recusa volta como HTTP 200 com stop_reason: "refusal". A recomendação é ligar o fallback do lado do servidor (fallbacks: "default"), sabendo que o modelo de fallback roda sem os thinking blocks do 5.5. O system card não cita nível ASL e aponta ressalvas: o modelo segue mais instruções maliciosas coladas pelo usuário e aceita mais alegações de autorização que não podem ser verificadas.
Inventário somente leitura do servidor em 22/09/2026: modelo, forma de chamada, o que fazer e prioridade.
claude instalados. ~/.local/bin/claude é a 2.1.280 e /usr/bin/claude é a 2.1.63, de um npm global antigo. Os 17 yt-scheduler*.service e dois crons põem /usr/bin antes no PATH, então rodam a versão antiga, que usa o claude-opus-4-6 por padrão. Trocar modelo em config não chega neles.| Sistema | Hoje | Como chama | O que fazer | Prioridade |
|---|---|---|---|---|
| yt-pub-lives (17 schedulers) | claude-opus-4-6 (padrão da 2.1.63) | claude -p, CLI antigo | Corrigir o PATH das units (ou atualizar o /usr/bin/claude) e passar --model opus explícito. | ALTA |
| openpcbotv2 | claude-opus-5, effort low | Agent SDK 0.2.50 | Atualizar o SDK, trocar para claude-opus-5-5 nos agent.yaml, manter o effort explícito e incluir xhigh no tipo. | ALTA |
| openpcbotv3 | alias opus → já é 5.5 | CLI 2.1.280 | Nada no modelo. Conferir que o effort está explícito no yaml (o padrão do 5.5 é medium). | OK |
| openpcbotv3 (tiers OpenRouter) | haiku-4.5 / sonnet-5 | OpenRouter, temperature 0.4 | Se o tier premium virar Opus 5.5, tirar o temperature. Corrigir a tabela de preço do opus-5 (está 15/75; o certo é 5/25). | MÉDIA |
| cerebro-vip (API de chat) | opus-4.8, sonnet-5, fable-5 (padrão glm-5.2) | OpenRouter, temperature 0.2 | Incluir o Opus 5.5 na lista e não enviar temperature para modelos Claude 4.7+. | MÉDIA |
| Crons do cerebro-vip e do telegramtopicosindex | alias sonnet | CLI 2.1.63 | Mesma correção de PATH dos schedulers. | MÉDIA |
| inemaccvbot (parado) | claude-opus-5, effort low | CLI | Trocar para claude-opus-5-5 quando for reativado. | MÉDIA |
| musicavideo | claude-fable-5 | CLI | Decisão de produto: testar o Opus 5.5, que no system card supera o Fable 5.1 na maioria dos testes e custa 60% menos. | MÉDIA |
| inemaccbot (10 perfis) | alias sonnet, effort low | CLI | Nada agora. O Sonnet 5.5 chega em semanas e o alias sobe sozinho. | BAIXA |
| Portal (chat do site) | haiku-4.5 | OpenRouter | Nada agora. Aguardar o Haiku 5.5. | BAIXA |
| iccmonit | claude-haiku-4-5-20251001 | SDK Python | Manter. Se um dia for para o Opus 5.5, ler a resposta por type (hoje usa content[0].text, que quebra com thinking). | BAIXA |
| claudebot, inemabot, dsh-sandbox | sonnet-4-6, opus-4-6, sonnet-4.5 | vários | Legado parado. Atualizar só se voltar a rodar. | BAIXA |
Não usam Claude: inemanews, inemaeventos e as novidades do portal (Groq), webmcp-readiness, inemacbot, agentehermes, dsh-orchestrator e cerebro-pro.
Cinco passos com comandos reais. A ordem importa: sem o passo 1, as trocas de modelo não chegam aos serviços que rodam o CLI antigo.
Descobrir qual claude cada serviço enxerga e fazer todos usarem a versão atual.
# ver as duas instalações which -a claude; /usr/bin/claude --version; ~/.local/bin/claude --version # opção A: atualizar o npm global antigo npm i -g @anthropic-ai/claude-code@latest # opção B: nas units yt-scheduler*.service, pôr ~/.local/bin antes no PATH Environment=PATH=/home/nmaldaner/.local/bin:/usr/local/bin:/usr/bin:/bin systemctl --user daemon-reload && systemctl --user restart 'yt-scheduler*'
O alias opus acompanha o modelo mais novo. Prefira o alias a fixar um ID; fixe só onde a reprodutibilidade importa.
# que modelo respondeu de fato claude --model opus -p "ok" --output-format json | jq -c '.modelUsage|keys' # em 22/09/2026: ["claude-opus-5-5"]
No openpcbotv2, atualizar o Agent SDK antes e depois trocar o modelo nos agent.yaml, mantendo o effort explícito.
# 1) SDK atual (o 0.2.50 traz um CLI 2.1.50 embutido) npm i @anthropic-ai/claude-agent-sdk@latest # 2) agents/*/agent.yaml model: claude-opus-5-5 effort: low
Antes de apontar para um Claude 4.7 ou mais novo, remover temperature, top_p e top_k do corpo da requisição. O slug do Opus 5.5 no OpenRouter ainda precisa ser conferido.
# sem temperature/top_p/top_k para Claude 4.7+ { "model": "anthropic/claude-opus-...", "messages": [...] }
Para qualquer código que chame a API diretamente (guia de migração da Anthropic).
| Tipo | Item |
|---|---|
| BLOQUEIA | ID claude-opus-5-5 (Bedrock: anthropic.claude-opus-5-5). |
| BLOQUEIA | Remover thinking disabled e budget_tokens. Dimensionar max_tokens para thinking + resposta. Ler os blocos por type. |
| BLOQUEIA | Trocar tool_choice any/tool por auto + strict, ou structured outputs. |
| BLOQUEIA | Computer use pelo computer_toolset_20260801. |
| BLOQUEIA | Histórico só por acréscimo (preserved thinking). Tratar stop_reason: "refusal" e ligar o fallback. |
| AJUSTE | Definir o effort explicitamente e medir low/medium antes de subir. |
| AJUSTE | Interface que mostrava texto entre tool calls: display: "updates". |
| AJUSTE | Refazer a medição de custo e latência. Rever prompts feitos para o Opus 5 (verbosidade, verificação). |
Datas da API, segundo as release notes da Anthropic.
Pesquisa feita em 22/09/2026, dia do lançamento: documentação oficial da Anthropic, cobertura de terceiros e um inventário local somente leitura. Cada gráfico usa uma única tabela-fonte. Números auto-reportados estão marcados como tal.