Resumo
Mais barato que o Opus 5, à frente dele em quase tudo, e com quatro mudanças de API que quebram código antigo.
- Lançado em 22/09/2026, o primeiro da família "Claude 5.5". Sonnet 5.5 e Haiku 5.5 chegam "nas próximas semanas".
- Disponível em claude.ai (Pro, Max, Team, Enterprise), Claude Code, API, Bedrock (
anthropic.claude-opus-5-5), Vertex, Foundry, Claude Platform on AWS e GitHub Copilot. - Recomendação oficial: "comece pelo Opus 5.5 na maioria das cargas". O Fable 5.1 fica para raciocínio muito exigente.
- Thinking sempre ligado. A única alavanca de custo e latência passa a ser o
effort, e o padrão caiu dehighparamedium. - Aqui no servidor já está em uso: no Claude Code 2.1.280 o alias
opusresolve paraclaude-opus-5-5(testado hoje). Nenhum sistema nosso fixa o ID novo ainda.
Preços
O Opus mais barato até hoje, com o maior desconto de cache da linha Opus.
| Modelo | Entrada | Saída | Cache read | Batch (in/out) | Fast (in/out) |
|---|---|---|---|---|---|
| Fable 5.1 | 10 | 50 | 0,25 | 5 / 25 | — |
| Opus 5.5 | 4 | 20 | 0,20 | 2 / 10 | 8 / 40 |
| Opus 5 | 5 | 25 | 0,50 | 2,50 / 12,50 | 10 / 50 |
| Opus 4.8 | 5 | 25 | 0,50 | 2,50 / 12,50 | 10 / 50 |
| Sonnet 5 | 2 | 10 | 0,20 | 1 / 5 | — |
| Haiku 4.5 | 1 | 5 | 0,10 | 0,50 / 2,50 | — |
US$ por milhão de tokens. Fonte: página oficial de preços da Anthropic [PR]. Fast mode é research preview e existe só na Claude API.
- Com o cache read a 0,05x da entrada, sessões longas de agente que releem o mesmo prefixo (bots, Claude Code) ficam bem mais baratas. Em compensação, um cache miss pesa mais em termos relativos.
- Nas assinaturas (Claude Code, claude.ai) o preço por token não aparece, mas a Anthropic aumentou os limites de 5 horas nos planos pagos.
Benchmarks
Supera o Opus 5 e o Fable 5.1 em quase todo teste do system card. Perde para o GPT-6 Astra em três.
- Os números oficiais são auto-reportados e medidos em effort
max(Terminal-Bench emxhigh), com os safeguards de produção ligados. Vários foram rodados por parceiros (Cognition, Cursor, Zapier, Artificial Analysis). - A Anthropic reavalia modelos antigos a cada system card. O Opus 5 tem 1861 no GDPval-AA v2 no card dele e 1708 no v2.1 no card do 5.5. Não misture tabelas.
- Onde o Opus 5.5 perde: Terminal-Bench-Science (58,7 vs 64,6 do GPT-6 Astra), AutomationBench (40,0 vs 41,4), FrontierSWE v2 (62,3 vs 65,5) e OfficeQA (para o Fable 5.1).
- Não foram reportados para o 5.5: SWE-bench Verified, ARC-AGI, GPQA, AIME/USAMO, BrowseComp e τ-bench. O modelo ainda não aparece no LMArena.
- A própria Anthropic diz que "as margens de benchmark se tornaram um guia menos confiável" e que a distância real para o Fable 5.1 "é menor do que as notas sugerem".
Effort × custo
Em high o Opus 5.5 já passa o Fable 5.1 em max, por menos de um quarto do custo por tarefa.
- O padrão agora é
medium. Quem não define o effort cai um degrau em relação ao Opus 5. Nos testes da Anthropic, o 5.5 emmediumsupera o Opus 5 emhighem código e trabalho de conhecimento. - Mais effort nem sempre rende mais. No FrontierCode,
mediummarca 54,6% emax54,4%. No CursorBench, subir demedium(52,5%, ~US$ 3 por tarefa) paramax(57,8%) rende cerca de 5 pontos, pagando mais por tarefa. - No mesmo nível, pensa mais por turno que o Opus 5, sobretudo em
xhighemax. Deixe folga nomax_tokens(64K é o ponto de partida sugerido para turnos longos de agente).
Na prática: o mesmo app em seis níveis
Teste de terceiros (24/09/2026): o mesmo /goal no Claude Code em todos os níveis, transformando ~105 GB de gravações de um evento em uma conferência 3D explorável. É uma rodada por nível, com o julgamento visual do autor, e custo estimado em preço de API.
| Effort | Tempo | Custo (est.) | Tokens | Checks | Resultado |
|---|---|---|---|---|---|
low | 16m43s | US$ 3,91 | 191k | 22 | Funciona, mas com marca errada e vídeos estáticos |
medium | 1h13m | US$ 12,44 | 419k | 23 | O maior salto de qualidade |
high | 1h07m | US$ 16,31 | ~559k | 22 | Mais detalhe e narrativa |
xhigh | 1h30m | US$ 25,92 | ~723k | 34 | Preferido pelo autor |
max | 2h28m | US$ 50,38 | 1,18M | 51 | 2× o custo do xhigh e com mais bugs |
| ultracode | 1h35m | US$ 18,69 | ? | 42 | Não criou workflows; funcionou como xhigh |
O experimento do GPT-6 Astra com o mesmo desenho chegou ao mesmo padrão: o nível máximo não foi o preferido, e lá o vencedor foi o medium. Gráficos, os oito padrões e os limites dos dados estão em Esforço na prática (EN · ES).
medium é a melhor opção para o dia a dia. Suba para high quando precisar de mais raciocínio e deixe o xhigh para caso extremo. O mesmo vale para o GPT-6 Astra. O max fica de fora.
Mudanças de API
Quatro breaking changes em relação ao Opus 5 e uma mudança silenciosa no formato da resposta.
| # | O que muda | Erro | Como migrar |
|---|---|---|---|
| 1 | Thinking não desliga. {type:"disabled"} e budget_tokens são rejeitados em qualquer effort. | 400 | Omitir thinking (ou usar adaptive) e controlar pelo output_config.effort. Para latência baixa, low. |
| 2 | Sem forced tool use. tool_choice any/tool rejeitados, inclusive em Batches e count_tokens. | 400 | auto + strict: true + instrução no prompt, e conferir se a chamada veio. Para extrair JSON, structured outputs. |
| 3 | Preserved thinking. Thinking blocks ficam presos ao modelo e à conversa. Contas criadas a partir de 31/08/2026 levam 400 se o histórico for editado. | 400 / descarte | Histórico só por acréscimo. Mensagem system no meio da conversa em vez de editar o system. Ou beta thinking-binding-controls com drop_block. |
| 4 | Computer use só pelo computer_toolset_20260801. O computer_20251124 é rejeitado (API e Google Cloud). | 400 | Trocar a declaração da tool e o loop do agente (a ação vira o name do bloco, vários por turno). |
| 5 | Texto entre tool calls passa a vir em thinking blocks de progresso, vazios no display padrão. | nenhum | thinking.display: "updates" (beta) ou "summarized", e renderizar esses blocos. |
Antes e depois (Python)
# Antes: aceito no Opus 5, 400 no Opus 5.5
client.messages.create(model="claude-opus-5", max_tokens=16000,
thinking={"type": "disabled"}, temperature=0.4, messages=[...])
# Depois: thinking sempre ligado, effort é o controle
client.messages.create(model="claude-opus-5-5", max_tokens=16000,
output_config={"effort": "low"}, messages=[...])
Também herdado (para quem vem do 4.x)
temperature,top_petop_kcom valor fora do padrão dão 400 desde o Opus 4.7.- Prefill de mensagem do assistente dá 400 desde o Opus 4.6.
- Tokenizer do 4.7 em diante gera de 1x a 1,35x mais tokens que os modelos anteriores.
Segurança
Primeiro Opus com classificadores de cyber, bio e anti-extração de raciocínio (reasoning_extraction). Uma recusa volta como HTTP 200 com stop_reason: "refusal". A recomendação é ligar o fallback do lado do servidor (fallbacks: "default"), sabendo que o modelo de fallback roda sem os thinking blocks do 5.5. O system card não cita nível ASL e aponta ressalvas: o modelo segue mais instruções maliciosas coladas pelo usuário e aceita mais alegações de autorização que não podem ser verificadas.
Nossos sistemas
Inventário do servidor: onde o Claude roda hoje e com qual modelo.
- Há dois
claudeinstalados.~/.local/bin/claudeé a 2.1.280, e/usr/bin/claudeé a 2.1.63, de um npm global antigo. Os 17yt-scheduler*.servicee os crons do cerebro-vip e do telegramtopicosindex põem/usr/binantes no PATH, então rodam a versão antiga, que usa oclaude-opus-4-6por padrão. Trocar modelo em config não chega neles. - O openpcbotv2 usa o Agent SDK 0.2.50, que traz um CLI 2.1.50 embutido. Primeiro atualizar o SDK, depois trocar o ID.
| Sistema | Hoje | Como chama | O que fazer | Prioridade |
|---|---|---|---|---|
| yt-pub-lives (17 schedulers) | claude-opus-4-6 (padrão da 2.1.63) | claude -p, CLI antigo | Corrigir o PATH das units (ou remover/atualizar o /usr/bin/claude) e passar --model opus explícito. | ALTA |
| openpcbotv2 | claude-opus-5, effort low | Agent SDK 0.2.50 | Atualizar o SDK, trocar para claude-opus-5-5 nos agent.yaml, manter effort explícito e incluir xhigh no tipo. | ALTA |
| openpcbotv3 | alias opus → já é 5.5 | CLI 2.1.280 | Nada no modelo. Conferir que o effort está explícito no yaml (padrão do 5.5 é medium). | OK |
| openpcbotv3 (tiers OpenRouter) | haiku-4.5 / sonnet-5 | OpenRouter, temperature 0.4 | Se o tier premium virar Opus 5.5, tirar o temperature. Corrigir a tabela de preço do opus-5 (está 15/75, o certo é 5/25). | MÉDIA |
| cerebro-vip (API de chat) | opus-4.8, sonnet-5, fable-5 (padrão glm-5.2) | OpenRouter, temperature 0.2 | Incluir o Opus 5.5 na lista e não enviar temperature para modelos Claude 4.7+. | MÉDIA |
| cerebro-vip e telegramtopicosindex (crons) | alias sonnet | CLI 2.1.63 | Mesma correção de PATH dos schedulers. | MÉDIA |
| inemaccvbot (parado) | claude-opus-5, effort low | CLI | Trocar para claude-opus-5-5 quando for reativado. | MÉDIA |
| musicavideo | claude-fable-5 | CLI | Decisão de produto: testar o Opus 5.5, que no system card supera o Fable 5.1 na maioria dos testes e custa 60% menos. | MÉDIA |
| inemaccbot (10 perfis) | alias sonnet, effort low | CLI | Nada agora. O Sonnet 5.5 chega em semanas e o alias sobe sozinho. | BAIXA |
| portal (chat do site) | haiku-4.5 | OpenRouter | Nada agora. Aguardar o Haiku 5.5. | BAIXA |
| iccmonit | claude-haiku-4-5-20251001 | SDK Python | Manter. Se um dia for para Opus 5.5, ler a resposta por type (hoje usa content[0].text, que quebra com thinking). | BAIXA |
| claudebot, inemabot, dsh-sandbox | sonnet-4-6, opus-4-6, sonnet-4.5 | vários | Legado parado. Atualizar só se voltarem a rodar. | BAIXA |
Levantamento somente leitura em 22/09/2026. Não usam Claude: inemanews, inemaeventos e as novidades do portal (Groq), webmcp-readiness, inemacbot, agentehermes, dsh-orchestrator e cerebro-pro.
Plano de atualização
Três passos, do que destrava mais para o que é ajuste fino.
1. Destravar o CLI (antes de tudo)
# ver qual claude cada serviço enxerga
which -a claude; /usr/bin/claude --version; ~/.local/bin/claude --version
# opção A: atualizar o npm global antigo
npm i -g @anthropic-ai/claude-code@latest
# opção B: nas units yt-scheduler*.service, pôr ~/.local/bin antes no PATH
Environment=PATH=/home/nmaldaner/.local/bin:/usr/local/bin:/usr/bin:/bin
systemctl --user daemon-reload && systemctl --user restart 'yt-scheduler*'
2. Trocar o modelo onde ele está fixo
- openpcbotv2: atualizar
@anthropic-ai/claude-agent-sdk, trocarclaude-opus-5porclaude-opus-5-5nosagent.yamle mantereffort: lowexplícito. - CLI em geral: preferir o alias
--model opus, que já aponta para o 5.5, a fixar um ID. Fixar só onde a reprodutibilidade importa. - Chamadas via OpenRouter: remover
temperatureantes de apontar para um Claude 4.7+. O slug do Opus 5.5 no OpenRouter ainda não foi conferido.
3. Checklist oficial para código na API
| Tipo | Item |
|---|---|
| BLOQUEIA | ID claude-opus-5-5 (Bedrock: anthropic.claude-opus-5-5). |
| BLOQUEIA | Remover thinking disabled e budget_tokens. Dimensionar max_tokens para thinking + resposta. Ler blocos por type. |
| BLOQUEIA | Trocar tool_choice any/tool por auto + strict, ou structured outputs. |
| BLOQUEIA | Computer use pelo computer_toolset_20260801. |
| BLOQUEIA | Histórico só por acréscimo (preserved thinking). Tratar stop_reason: "refusal" e ligar fallback. |
| AJUSTE | Definir o effort explicitamente e medir low/medium antes de subir. |
| AJUSTE | UI que mostrava texto entre tool calls: display: "updates". |
| AJUSTE | Refazer medição de custo e latência. Rever prompts feitos para o Opus 5 (verbosidade, verificação). |
- Esta página é a pesquisa e o plano. A aplicação nos sistemas em produção é um passo separado, a ser autorizado.
Linha do tempo
Nove lançamentos em dez meses.
- 24/11/2025Opus 4.5 e o parâmetro
effortem beta - 05/02/2026Opus 4.6: adaptive thinking,
budget_tokensdepreciado, prefill removido - 16/04/2026Opus 4.7: tokenizer novo, parâmetros de amostragem rejeitados
- 28/05/2026Opus 4.8, 1M de contexto por padrão
- 09/06/2026Fable 5 (e Mythos 5, restrito)
- 30/06/2026Sonnet 5 (US$ 2/10)
- 24/07/2026Opus 5 (US$ 5/25)
- 01/09/2026Fable 5.1 e Mythos 5.1
- 22/09/2026Opus 5.5 (US$ 4/20)
- próximas semanasSonnet 5.5 e Haiku 5.5
Metodologia e fontes
Pesquisa feita em 22/09/2026, dia do lançamento, em três frentes: documentação oficial da Anthropic (anúncio, docs, preços, guia de migração, system card), cobertura de terceiros e um inventário local somente leitura dos projetos do servidor. Cada gráfico usa uma única tabela-fonte. Números auto-reportados estão marcados como tal.
Oficiais (Anthropic)
- [A] Anúncio — anthropic.com/claude-opus-5-5
- [MP] Visão geral do modelo — platform.claude.com/…/opus-5-5/overview
- [W] What's new — platform.claude.com/…/whats-new-opus-5-5
- [MG] Guia de migração — platform.claude.com/…/opus-5-5/migration-guide
- [MO] Visão geral dos modelos — platform.claude.com/…/models/overview
- [PR] Preços — platform.claude.com/…/pricing
- [RN] Release notes — platform.claude.com/…/release-notes
- [SC] System Card do Opus 5.5 — PDF
- [SC5] System Card do Opus 5 — PDF
Terceiros
- Artificial Analysis — release e leaderboard
- GitHub Changelog — Opus 5.5 no Copilot
- CodeRabbit — "More catches, different misses"
- OrcaRouter — Opus 5.5 vs Opus 5
- The Decoder — análise do lançamento
- Cobertura geral: MacRumors · 9to5Mac · XDA · Thurrott