Skip to main content

Claude Opus 5.5 Agora no Felo Search: Respostas que se Sustentam

· 8 minutos de leitura
Felo Search Tips Buddy
Committed to answers at your fingertips

Claude Opus 5.5 está disponível no Felo Search: 1M de contexto, $4/$20 por milhão de tokens e respostas verificadas com base nas evidências antes de você agir.

A Anthropic lançou o Claude Opus 5.5 em 22 de setembro, e o número que importa para buscas não aparece na tabela de benchmarks. É o preço: $4 por milhão de tokens de entrada e $20 por milhão de saída, contra $5 e $25 do Opus 5. A Anthropic estima uma redução de custo operacional de cerca de 40% em cargas de trabalho típicas, com uma saída mais de 30% mais rápida.

O Opus 5.5 já está ativo no Felo Search. Mais barato e rápido já seria um bom motivo por si só. O que torna a troca interessante para pesquisa é que ele ficou mais criterioso ao mesmo tempo.

Claude Opus 5.5 no Felo Search: um contexto de um milhão de tokens reunindo fontes, evidências e ressalvas

O Que é o Claude Opus 5.5​

O Opus 5.5 é o primeiro lançamento da Anthropic desde que a empresa pediu publicamente por um ritmo mais controlado no desenvolvimento de modelos de fronteira em setembro. Ele ocupa o topo da linha Opus, acima do Claude Sonnet 5, com a linha Fable reservada para outro tipo de aplicação.

A especificação foi criada para trabalhos que precisam ser defendidos, não apenas produzidos: uma janela de contexto de um milhão de tokens, uma saída máxima de 128.000 tokens e leituras em cache a $0,20 por milhão de tokens, o que torna sessões longas e iterativas acessíveis para repetição.

EspecificaçãoClaude Opus 5.5
ID do modeloclaude-opus-5-5
FabricanteAnthropic
Lançamento22 de setembro de 2026
Janela de contexto1.000.000 tokens
Saída máxima128.000 tokens
EntradaTexto, imagem
SaídaTexto
Preço$4 por milhão de entrada, $20 por milhão de saída
Entrada em cache$0,20 por milhão de tokens
Geração anteriorOpus 5, lançado em 24 de julho de 2026 a $5 / $25

Duas linhas dessa tabela fazem um fluxo de trabalho de pesquisa notar esse modelo.

Um milhão de tokens de contexto. Isso corresponde a cerca de 750.000 palavras, uma pilha de documentos-fonte que, de outra forma, precisariam ser resumidos antes de você fazer uma pergunta sobre eles. O resumo inicial é onde surgem erros: o resumo é escrito por um modelo que não sabia qual detalhe você precisaria.

Leituras em cache a um quinto do preço da entrada. Uma investigação no Felo Search não é uma chamada só. É uma primeira análise, um desafio, uma revisão e uma síntese, cada uma relendo as mesmas fontes. O cache transforma a releitura repetida de custo em arredondamento.

Por Que a Verificação é o Problema Central na Busca por IA​

Pergunte algo a um buscador de IA e você recebe uma resposta bem escrita. Isso não é mais o desafio. O desafio está em saber se a frase em que você vai se basear resistiria a uma checagem.

Verificação é uma habilidade diferente de resumir. Exige perceber que duas fontes descrevem a mesma estatística com denominadores diferentes. Exige sinalizar quando o único apoio de uma afirmação é um comunicado à imprensa. Exige retornar "as evidências aqui são frágeis" em vez de um parágrafo confiante.

A Anthropic publicou quatro benchmarks no anúncio do Opus 5.5, e o padrão entre eles merece atenção:

BenchmarkClaude Opus 5.5GPT-6 Astra
Terminal-Bench 4.066,4%57,9%
FrontierCode v1.1 (Principal)54,4%53,3%
AutomationBench40,0%41,4%
Terminal-Bench-Science 0.158,7%64,6%

A Anthropic lidera em dois e fica atrás em dois, o que traz mais utilidade do que uma vitória total. Astra mantém vantagem em tarefas científicas e automação de processos de negócios; Opus 5.5 lidera em codificação geral e código de fronteira.

A nota metodológica importa mais do que as pontuações. A Anthropic avaliou o Opus 5.5 com as proteções de produção ativadas: a mesma configuração entregue aos usuários, incluindo o roteamento que envia pedidos arriscados para um modelo anterior. Um sistema de segurança que só existe na avaliação não é um sistema de segurança. A empresa também relata cerca de 85% menos tentativas de contornar limites do que o Opus 5, e seu melhor resultado de alinhamento até agora.

Para busca, especificamente, essa configuração é o produto. Um modelo que recusa responder incomoda. Um modelo que responde a uma pergunta que deveria recusar, com fluência e citações, é pior.

1. Selecione-o no seletor de modelos. Abra o Felo Search, escolha o Claude Opus 5.5 e pergunte na mesma caixa de sempre.

2. Envie o conjunto completo de documentos, não um resumo. A janela de um milhão de tokens vale mais quando você para de comprimir previamente. Faça upload dos arquivos, artigos, discussões, tudo, e faça sua pergunta sobre o texto integral.

3. Peça explicitamente as ressalvas. "O que teria que ser verdade para esta conclusão estar errada?" e "qual destas fontes é a mais fraca?" são perguntas que um modelo treinado para verificação responde de modo diferente de um resumidor.

4. Peça para mostrar o desacordo. Quando as fontes divergem, peça para expor onde concordam, onde divergem e qual afirmação se apoia em evidências mais frágeis. Esse é o resultado que você busca em uma pesquisa.

5. Itere no mesmo tópico. Leituras em cache custam pouco; reiniciar não. Mantenha o desafio, a correção e a síntese final em uma sessão só, assim o modelo mantém as evidências originais à vista.

O Opus 5.5 chegou em menos de um dia após outros três lançamentos de fronteira, e o Felo Search roda todos os quatro.

ModeloLançado porPreço por milhão de tokensContextoFeito para
Grok 4.7SpaceXAI$2 entrada / $6 saída500KRaciocínio de longo prazo e trabalho com conhecimento
Claude Opus 5.5Anthropic$4 entrada / $20 saída1MRespostas que resistem à verificação
GPT-6 LunaOpenAI$0,10 entrada / $0,50 saída1,05MBusca em alto volume com menor custo por chamada
GPT-6 SolOpenAI$2 entrada / $10 saída1,05MLoops de agente e chamadas repetidas com preço intermediário

O Opus 5.5 custa mais dos quatro na saída, e é o único em que o fornecedor publicou a configuração de segurança junto com os resultados. Use para perguntas em que errar custa mais do que demorar.

O Que Testar Primeiro​

Uma afirmação que você pretende repetir. Escolha uma estatística que você vai colocar em um documento e peça ao Opus 5.5 para rastrear sua origem. O resultado interessante não é o número, mas o caminho.

Uma decisão com duas respostas defensáveis. Dê as duas opções e as restrições, depois pergunte qual delas as evidências realmente sustentam e o que mudaria a resposta.

Um documento que você está prestes a assinar. Contratos, políticas e termos de serviço valorizam um modelo que aponta o que falta, não apenas o que está presente.

Um tópico de pesquisa que você já executou. Refazer uma pergunta feita há um mês e comparar as ressalvas. Essa diferença mostra o que a geração anterior não fazia.

O Claude Opus 5.5 está ativo no Felo Search com uma janela de contexto de um milhão de tokens, preços de $4/$20 e proteções de produção ativadas. Ele custa 40% menos para operar do que o modelo anterior e tem a configuração que a Anthropic assina com seu próprio nome.

Abra o Claude Opus 5.5 no Felo Search →


Este post também está disponível em English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, Italiano, ไทย, Español and বাংলা.