A Anthropic lançou o Opus 5.5 em 22 de setembro de 2026

Claude Opus 5.5mais trabalho, menos tokens

O primeiro modelo da família Claude 5.5. Alcança o nível do Claude Fable 5.1 na maior parte das tarefas, custa 40% menos para rodar que o Opus 5 e gera a saída mais de 30% mais rápido.

22 de set.
Lançamento em 2026
Primeiro modelo da família Claude 5.5
US$ 4 / US$ 20
API entrada / saída
Por milhão de tokens, contra US$ 5 / US$ 25 do Opus 5
medium
Effort padrão
Um nível abaixo do Opus 5, que começa em high
1 M / 128 K
Contexto / saída máxima
Mesma janela do Opus 5, conhecimento até junho de 2026

Agora na busca do Felo

Mande o conjunto inteiro de documentos e só depois pergunte.

O Claude Opus 5.5 está disponível na busca do Felo para tarefas com entradas longas: cruzar números entre arquivos, rastrear uma afirmação até a fonte e devolver uma resposta que você possa repassar.

Testar o Opus 5.5 na busca do Felo

01

Segurar todo o contexto

Janela de contexto de 1 milhão de tokens e conhecimento até junho de 2026. Uma conversa longa, um repositório inteiro ou um conjunto de documentos cabem em uma única tarefa.

02

Conferir o número, não só a conclusão

Em um teste interno da Anthropic, 16 de 18 relatórios passaram no critério de qualidade. Um único número ou citação inventados reprovariam o exercício.

03

Dizer o que fez e o que ainda falta

A Anthropic refez a forma de o modelo se comunicar: o mais importante vem primeiro, e o relatório diz com clareza o que está pronto, o que foi encontrado e o que segue em aberto.

Passo a passo rápido

Trocar para o Claude Opus 5.5 no Felo

O Claude Opus 5.5 aparece no seletor de modelos ao lado dos outros modelos de ponta da sua conta.

Abra o seletor de modelos, escolha o Claude Opus 5.5 e comece a tarefa no mesmo espaço de trabalho.

A diferença do Opus 5.5

A queda de custo é o argumento.

A Anthropic aposta em eficiência, não em uma pontuação maior de benchmark: menos tokens por tarefa, preço por token mais baixo e 40% menos custo em cargas de trabalho típicas. É isso que torna viável deixar um agente rodando por horas.

01

Terminar o serviço gigantesco

A Anthropic relata que um testador auditou e corrigiu uma base de 200 mil linhas em menos de três horas, enquanto o Opus 5 levava mais de 20 horas e consumia 2,5 vezes mais tokens.

02

Achar o bug antes do merge

A Deloitte relatou que, no nível de effort mais baixo, o Opus 5.5 encontrou 72% dos bugs conhecidos na revisão de código, contra 56% do Opus 5 em high, com menos falsos positivos.

03

Deixar um relatório utilizável

Os textos são mais curtos e mais bem estruturados. A Box relatou respostas 40% menos prolixas sem perda de precisão e com um terço dos tokens do Opus 5.

Escolha do modelo

Compare o custo de um token com o custo de errar.

Os preços abaixo são tarifas públicas oficiais da API por milhão de tokens, não preços de assinatura ou de uso do Felo. A linha de effort importa tanto quanto a de preço: o mesmo prompt pode custar bem diferente dependendo de onde cada modelo começa.

Fator de decisão
Claude Opus 5.5
Claude Fable 5.1
Claude Opus 5
GPT-6 Astra
Preço de API / milhão de tokens
US$ 4 entrada / US$ 20 saída
US$ 10 entrada / US$ 50 saída
US$ 5 entrada / US$ 25 saída
US$ 10 entrada / US$ 50 saída
Leitura de cache / milhão de tokens
US$ 0,20, 0,05 vez o preço de entrada
US$ 0,25, 0,025 vez o preço de entrada
US$ 0,50, o fator padrão de 0,1
Varia conforme o provedor e o nível de cache
Effort padrão
medium. O raciocínio adaptativo fica sempre ligado e não pode ser desativado.
high. O raciocínio adaptativo fica sempre ligado.
high. O raciocínio pode ser desativado até high.
Definido por quem chama, a cada requisição
Onde ele se paga
Programação agêntica de longa duração, revisão de código e trabalho de conhecimento a preço de linha intermediária.
O raciocínio mais difícil e as execuções de agente mais longas, quando o Opus 5.5 não basta nem com mais effort.
A referência Opus anterior. Compare disponibilidade e latência reais com o seu próprio tráfego.
A linha de topo da OpenAI, no teto da tabela de preços.

As tarifas públicas da API e os valores padrão foram conferidos em 23 de setembro de 2026 no anúncio do Claude Opus 5.5 da Anthropic, nas páginas de modelos da Claude Platform e na página do GPT-6 Astra da OpenAI. O preço por token é só uma parte do custo total de uma tarefa. A afirmação de eficiência da Anthropic é uma queda de 40% em cargas típicas, que combina preço por token menor com menos tokens por tarefa.

Resultados publicados pela Anthropic

Onde o Opus 5.5 lidera e onde não lidera.

A Anthropic publicou seus próprios números ao lado de Fable 5.1, Opus 5, GPT-6 Astra e GPT-5.6 Sol. Dois dos quatro gráficos abaixo mostram precisão contra custo por tarefa, e não precisão isolada, porque é exatamente essa a comparação que a Anthropic faz.

Tabela comparativa publicada pela Anthropic para o Claude Opus 5.5 contra Fable 5.1, Opus 5, GPT-6 Astra e GPT-5.6 Sol

A comparação publicada por completo

Programação agêntica, trabalho de conhecimento, fluxos de negócio, raciocínio multidisciplinar, pesquisa científica, uso do computador e leitura de gráficos, nos cinco modelos medidos.

Gráficos de programação agêntica publicados pela Anthropic para o Claude Opus 5.5

Programação agêntica

Terminal-Bench 4.0, FrontierCode v1.1 e CursorBench 4.0, traçados como precisão contra custo por tarefa.

Gráficos de trabalho de conhecimento publicados pela Anthropic para o Claude Opus 5.5

Trabalho de conhecimento

GDPval-AA v2.1 em 44 ocupações, AutomationBench e o WANDR, benchmark de coleta de dados da Perplexity.

Gráficos de uso do computador e raciocínio publicados pela Anthropic para o Claude Opus 5.5

Uso do computador e raciocínio

OSWorld 2.0, Humanity's Last Exam e Chartography, sendo que o último mede a precisão ao ler valores de um gráfico.

Gráficos de precisão contra custo por tarefa publicados pela Anthropic para o Claude Opus 5.5

Precisão contra custo por tarefa

A tese central da Anthropic não é uma pontuação maior a qualquer preço, e sim a mesma pontuação, ou melhor, por uma fração do custo por tentativa.

Números publicados pelo fabricante. Salvo indicação em contrário, a Anthropic executou o Opus 5.5 com raciocínio adaptativo em max effort e o avaliou com as proteções de produção ativadas. Quando essas proteções intervieram, as tarefas de cibersegurança foram concluídas pelo Opus 4.8 e as de biologia pelo Opus 5, o que provavelmente reduz os números publicados do Opus 5.5 nesses benchmarks. Os números do GPT-6 Astra e do GPT-5.6 Sol são os reportados pela OpenAI. Diferenças de benchmark entre fabricantes são um indício fraco das diferenças reais, o que a própria Anthropic diz sobre esses números.

Se você já roda o Opus 5

Quatro mudanças que quebram o código existente.

A Anthropic lista quatro mudanças incompatíveis para integrações que já rodam no Claude Opus 5, além de uma quinta que altera o formato da resposta sem fazer nenhuma requisição falhar. Vale ler antes de trocar o ID do modelo, porque três delas retornam erro 400 em vez de degradar em silêncio.

01

O raciocínio não pode mais ser desativado

No Opus 5, o raciocínio podia ser desativado até high. No Opus 5.5 ele fica sempre ligado, e tanto a desativação quanto um orçamento manual de tokens retornam erro 400. O effort passa a ser o único controle, e o padrão muda de high para medium.

thinking: {"type": "disabled"} -> 400 invalid_request_error

02

O uso forçado de ferramentas é rejeitado

tool_choice definido como "any" ou como uma ferramenta nomeada retorna erro 400, inclusive no endpoint de contagem de tokens. Use auto com uso estrito de ferramentas ou saídas estruturadas, e diga no prompt quando a ferramenta se aplica.

tool_choice: {"type": "tool", "name": "..."} -> 400 invalid_request_error

03

Os blocos de raciocínio ficam presos ao modelo

Cada bloco de raciocínio registra qual modelo o produziu. O Opus 5.5 lê blocos do Opus 5 e de modelos Opus, Sonnet e Haiku anteriores, mas não do Fable nem do Mythos. Se um roteador mover a conversa para outro modelo, os turnos seguintes rodam sem o raciocínio anterior.

Opus 5.5 -> Fable 5.1 / Mythos 5.1 mantêm o raciocínio; os outros modelos o descartam

04

A ferramenta antiga de uso do computador saiu

Na API da Claude e no Google Cloud, a ferramenta computer_20251124 retorna erro 400. Declare o toolset computer_toolset_20260801, remova o cabeçalho beta e adapte o loop do agente para blocos member tool_use. No Amazon Bedrock a ferramenta antiga continua funcionando.

computer_20251124 -> computer_toolset_20260801

O effort agora é o único controle do raciocínio

Como o raciocínio não pode ser desativado, o que se ajusta é o effort. O Opus 5.5 suporta os cinco níveis e começa em medium, um nível abaixo do Opus 5. A recomendação da Anthropic é refazer a varredura nas suas próprias avaliações em vez de reaproveitar uma configuração, e definir um max_tokens generoso nos níveis altos, já que os tokens de raciocínio contam nesse limite mesmo quando o texto do raciocínio não é devolvido.

Nível
Padrão
Uso recomendado pela Anthropic
low
Não
O nível mais econômico, com alguma perda de capacidade. A Anthropic recomenda para tarefas simples e subagentes.
medium
Sim
O padrão do Opus 5.5. Segundo a Anthropic, iguala ou supera o Opus 5 em high nas avaliações de programação e trabalho de conhecimento.
high
Não
O padrão da maioria dos outros modelos Claude. Raciocínio complexo e problemas de programação difíceis.
xhigh
Não
Trabalho agêntico e de programação de longo prazo, acima de 30 minutos, com orçamentos de tokens na casa dos milhões.
max
Não
O raciocínio mais profundo disponível, sem limite de gasto de tokens. Reserve para trabalhos em que você mediu ganho de qualidade.

O effort é um sinal de comportamento, não um orçamento rígido de tokens: em um nível baixo o modelo ainda raciocina diante de problemas realmente difíceis, só que menos do que em um nível alto. A Anthropic também observa que o Opus 5.5 tende a pensar mais por turno que o Opus 5 no mesmo nível, sobretudo em xhigh e max, então uma configuração herdada do Opus 5 vai gerar turnos mais longos e mais caros.

Onde ele encaixa

Trabalho longo demais para ficar vigiando.

O Opus 5.5 se paga quando uma tarefa dura horas, cobre mais arquivos do que uma pessoa consegue segurar ou gera algo que outra pessoa precisa revisar. São os casos que a Anthropic e seus primeiros testadores descrevem, não prompts genéricos de conversa.

Migrações e auditorias no repositório inteiro

Levar uma mudança por um repositório grande até os testes passarem, em vez de parar no primeiro patch plausível. A Anthropic relata uma migração de 680 mil linhas concluída em menos de um dia por um testador.

Revisão de código que acha o bug de verdade

A Column, testadora citada pela Anthropic, relatou ter encontrado um bug ao consultar documentação externa de uma integração de terceiros que havia sido modelada errado vários commits antes.

Análise financeira e de documentos

Montar o modelo e depois o resumo de uma página, mantendo as ressalvas. A Anthropic relata uma análise de fusão concluída em 63 minutos contra 93 do Opus 5, pela metade do custo.

Times de agentes de longa duração

Ele delega para subagentes e ajusta o ritmo a um orçamento de tempo. A recomendação da Anthropic é dar a uma arquitetura multiagente um sinal de tempo decorrido para que ela paralelize em vez de serializar.

Teste com uma tarefa longa

01

Traga o contexto real

Inclua o repositório, os documentos e os requisitos que uma resposta útil precisa considerar. A janela de 1 milhão de tokens existe para isso.

02

Diga a condição de conclusão

Deixe claro o que precisa ser verdade para o trabalho ser considerado pronto. A orientação da própria Anthropic para execuções sem supervisão é manter as partes da tarefa em uma lista que o modelo atualiza.

03

Compare o artefato final

Rode a mesma tarefa no Opus 5.5, no Opus 5 e no Fable 5.1 dentro do Felo. Compare os testes, as ressalvas e o consumo de tokens, não só a resposta.

Selecione o Claude Opus 5.5 quando ele aparecer no seletor de modelos da sua conta.

Testar o Opus 5.5 no Felo

Perguntas frequentes sobre o Claude Opus 5.5

O Claude Opus 5.5 é o modelo da Anthropic para programação agêntica de longa duração e trabalho de conhecimento, lançado em 22 de setembro de 2026 como primeiro modelo da família Claude 5.5. Segundo a Anthropic, ele alcança o nível do Claude Fable 5.1 na maior parte das tarefas e custa 40% menos para rodar que o Claude Opus 5.

Rode a tarefa longa por um preço menor.

Coloque o Claude Opus 5.5 ao lado dos outros modelos de ponta no Felo e teste naquele trabalho que você vem adiando porque leva horas.

Testar o Opus 5.5 no Felo

Comece pela busca do Felo AI e selecione o modelo onde ele estiver disponível.