Skip to main content

Claude Opus 5: Recursos, Preços e Teste Gratuito de 7 Dias

· 12 minutos de leitura
Felo Search Tips Buddy
Committed to answers at your fingertips

Explore os recursos, benchmarks, segurança e preços da API do Claude Opus 5. Membros Felo Pro podem experimentar gratuitamente o novo modelo de codificação agentica da Anthropic por 7 dias.

Procurando por recursos, preços ou um teste gratuito do Claude Opus 5? O mais novo modelo da Anthropic, da categoria Opus, foi desenvolvido para codificação agentica, análise profissional e tarefas de longa duração que exigem mais do que uma resposta inicial forte. Claude Opus 5 já está disponível no Felo para esse tipo de trabalho.

Para marcar o lançamento, assinantes do Felo Pro podem usar o Claude Opus 5 sem custo adicional por sete dias a partir da data de lançamento. É uma oportunidade de colocar o modelo à prova com o trabalho difícil que já está em sua mesa: um bug persistente, um relatório de pesquisa com evidências conflitantes, uma análise de múltiplos passos ou um documento que precisa de mais de uma revisão para ficar correto.

Este post é mais do que uma nota de lançamento. Abaixo está um guia claro sobre para que o Opus 5 foi projetado, o que a Anthropic relata em suas avaliações, onde ainda existem limites e como obter resultados úteis com ele no Felo.

Imagem original do anúncio do Claude Opus 5 da Anthropic, mostrada sem alterações e com uma borda cinza

Imagem original do anúncio do Claude Opus 5 da Anthropic. A imagem está sem alterações; a borda cinza distingue este material de fonte terceirizada.

Recursos do Claude Opus 5: para que o modelo foi construído

A Anthropic lançou o Claude Opus 5 em 24 de julho de 2026, posicionando-o como um modelo de alta capacidade para o dia a dia em agentes de longa duração, engenharia de software e trabalho profissional de conhecimento. Na própria descrição da Anthropic, a principal mudança não é apenas uma resposta inicial melhor. O Opus 5 foi projetado para trabalhar de forma mais deliberada: verificar resultados intermediários, preservar o fio de uma tarefa complexa e iterar quando a primeira tentativa não resolve o problema real.

Essa distinção é importante no trabalho prático. Uma pergunta rotineira pode precisar apenas de uma resposta rápida e concisa. Uma tarefa maior pode exigir que o modelo leia materiais de origem, decida o que ainda precisa saber, execute um cálculo ou ferramenta, compare alternativas, verifique seu resultado e explique a solução. Esses são os casos em que um modelo da categoria Opus vale mais a pena ser escolhido.

A Anthropic destaca três forças sobrepostas:

  • Codificação agentica: recursos maiores, depuração difícil, análise de causa raiz, refatorações e tarefas que abrangem mais de um arquivo ou ferramenta.
  • Trabalho de conhecimento e análise: raciocínio estruturado sobre material denso, trabalho com números e tabelas, diligência, pesquisa e suporte à decisão.
  • Fluxos de uso de computador e automação: completar uma sequência de etapas em vez de produzir uma única resposta isolada.

Nenhuma dessas afirmações significa que um modelo deve ser deixado sem supervisão. Elas indicam que ele pode assumir um rascunho mais completo de trabalhos difíceis antes que uma pessoa revise a decisão, as evidências e a ação final.

Benchmarks e capacidades do Claude Opus 5

Benchmarks de modelos são sinais úteis, mas não garantem que um modelo terá o mesmo desempenho em todo projeto. Eles dependem da tarefa, do ambiente, das configurações e do método de pontuação. Ainda assim, o lançamento da Anthropic oferece uma visão útil dos problemas que o Opus 5 busca resolver.

Para engenharia de software, a Anthropic relata que o Opus 5 lidera sua execução interna do Frontier-Bench v0.1 e mais que dobra o desempenho reportado do Opus 4.8 com menor custo por tarefa. No CursorBench 3.2, a Anthropic diz que o modelo chega a apenas 0,5% do pico de pontuação do Claude Fable 5 no máximo esforço, custando metade por tarefa.

Para resolução de problemas mais ampla e trabalho de escritório, a empresa relata que o Opus 5:

  • obteve pontuação três vezes maior que o próximo melhor modelo no ARC-AGI 3, uma avaliação de resolução de problemas inéditos;
  • alcançou cerca de 1,5 vez a taxa de aprovação do próximo melhor modelo ao mesmo custo por tarefa no Zapier AutomationBench, que testa automação empresarial de ponta a ponta;
  • superou outros modelos a custo comparável no OSWorld 2.0, um benchmark de uso de computador; e
  • é seu melhor e mais eficiente modelo em custo nas avaliações relacionadas ARC-AGI 3, GDPval-AA v2, HLE, AutomationBench e DeepSearchQA.

Estes são resultados publicados pela Anthropic, incluindo execuções internas de avaliação e feedback selecionado de acesso antecipado, e não rankings independentes universais. O modo mais produtivo de lê-los é como um guia para onde testar o modelo você mesmo: tarefas com cadeias longas de dependências, requisitos ambíguos, uso de ferramentas, verificação e consequências reais se uma resposta superficial passar.

Recursos do Claude Opus 5: por que o “esforço” muda a experiência

O Opus 5 suporta diferentes configurações de esforço. Simplificando, o esforço permite trocar velocidade de resposta e uso de tokens por mais tempo de raciocínio. Os gráficos da Anthropic comparam o modelo em vários níveis de esforço, desde configurações de menor esforço para economizar tokens até alto, xalto e esforço máximo.

Isso é útil porque nem todo pedido merece o mesmo orçamento. Use uma configuração baixa para uma classificação rápida, um esboço ou uma revisão pontual. Aumente o esforço quando a tarefa tiver múltiplas restrições, quando o modelo precisar reconciliar fontes ou quando precisar diagnosticar por que uma tentativa anterior falhou. Para resultados de alto impacto, use o tempo economizado para uma etapa de revisão: peça ao modelo para identificar pressupostos, citar fontes, testar casos extremos ou explicar o que mudaria sua recomendação.

O lançamento também introduz um Modo Rápido opcional na própria plataforma da Anthropic. A Anthropic diz que ele opera cerca de 2,5 vezes mais rápido que o padrão e custa o dobro da tarifa base lá. Disponibilidade e controles podem variar conforme o produto, então no Felo você deve usar as configurações mostradas em seu workspace, sem assumir que toda opção da Anthropic aparece da mesma forma.

A diferença aparece em como o modelo se verifica

O tema mais interessante do lançamento é a verificação. A Anthropic descreve uma avaliação em que o Opus 5 recebeu um desenho de uma peça de máquina, mas não tinha como visualizá-la diretamente. Em vez de parar ali, o modelo supostamente escreveu um pipeline de visão computacional para recuperar a geometria dos pixels brutos e então reconstruiu a peça como um modelo 3D no FreeCAD. Em outro exemplo, a Anthropic diz que o modelo encontrou a causa raiz de um bug real em um gerenciador de pacotes e abordou um caso extremo ignorado por um patch da comunidade.

Exemplos como esses devem ser tratados como demonstrações do fabricante do modelo, não como promessas. Mas sugerem um padrão concreto de prompting para o Felo: não peça apenas a resposta. Peça o ciclo de trabalho.

Investigue o problema, depois proponha uma solução.
Antes de finalizar, verifique a solução em relação aos requisitos declarados,
liste quaisquer pressupostos e identifique testes ou evidências que possam refutá-la.
Retorne a recomendação final separadamente das notas de trabalho.

Para pesquisa, a mesma abordagem pode transformar um prompt amplo em um processo revisável: reúna fontes atuais, distinga fatos de inferências, busque contra-evidências e produza um resumo decisivo conciso. O fluxo de trabalho multilíngue do Felo é especialmente útil quando material relevante aparece em vários idiomas; peça para preservar o idioma de origem junto com uma síntese clara em inglês quando necessário.

Desempenho não é o único fator: segurança e limites

A Anthropic relata que sua auditoria comportamental pré-lançamento encontrou o Opus 5 como seu modelo recente mais alinhado. Diz que o modelo apresentou comportamento desalinhado geral mais baixo, comportamento enganoso reduzido e maior resistência a prompts de uso indevido do que outros modelos Claude recentes. A empresa também afirma que o Opus 5 não amplia o limite de capacidades de uso duplo arriscadas em seus testes de biologia e cibersegurança ofensiva.

O ponto prático importante é que as proteções continuam parte do produto. A Anthropic diz que o Opus 5 pode ajudar a encontrar vulnerabilidades em código-fonte, mas coloca barreiras mais fortes em certas atividades cibernéticas, incluindo varredura de vulnerabilidades baseada em binários, testes de penetração e geração de exploits. Pedidos que acionam essas proteções podem ser bloqueados ou, em alguns produtos da Anthropic, recorrer a outro modelo.

Para todo o restante, mantenha os mesmos bons hábitos que usaria com qualquer modelo capaz:

  • Revise afirmações factuais, cálculos, citações, código e ações finais antes de confiar neles.
  • Não trate fluência como evidência. Peça fontes primárias e as inspecione.
  • Mantenha uma pessoa responsável por decisões legais, financeiras, médicas, de segurança e outras de impacto.
  • Dê ao modelo uma condição clara de sucesso e os limites que não deve ultrapassar.

A Anthropic também observa que o Opus 5 ainda tem limitações importantes em tarefas autônomas de pesquisa de longa duração. Capacidade não é autonomia, e um ciclo de revisão humana bem projetado continua parte de um fluxo de trabalho forte.

Preços do Claude Opus 5 e teste gratuito no Felo

A Anthropic lista o Claude Opus 5 a $5 por milhão de tokens de entrada e $25 por milhão de tokens de saída via API Claude, as mesmas tarifas base do Opus 4.8. Preços em plataformas terceirizadas, assinaturas e recursos podem variar, então use as informações de preço e uso mostradas no produto onde você trabalha.

Para assinantes do Felo Pro, o ponto imediato é mais simples: Claude Opus 5 está gratuito para testar por sete dias a partir do lançamento. Isso permite avaliá-lo com tarefas reais antes de decidir onde ele se encaixa em seu mix regular de modelos. Uma comparação sensata não é apenas “Qual modelo escreveu o melhor rascunho inicial?” Experimente a mesma tarefa difícil com o modelo que usa hoje, depois compare completude, taxa de erro, necessidade de acompanhamento, qualidade no tratamento das fontes e quanto tempo de revisão cada resultado exige.

Como testar o Claude Opus 5 gratuitamente por 7 dias no Felo Pro

  1. Faça login em sua conta Felo Pro.
  2. Inicie uma nova tarefa no workspace do Felo que normalmente usa para pesquisa, redação, análise ou trabalho agentico.
  3. Selecione Claude Opus 5 no seletor de modelos.
  4. Dê a ele uma tarefa com um entregável claro, arquivos ou contexto relevantes e uma etapa explícita de verificação.
  5. Revise o resultado, refine a instrução quando necessário e compare com seu fluxo de trabalho atual durante a oferta de lançamento de sete dias.

Comece com trabalhos que revelem as forças do modelo: um plano de projeto que exige escolhas, uma planilha ou relatório complexo, uma revisão de código difícil, uma pergunta de pesquisa com múltiplas fontes ou uma análise que precisa sobreviver a perguntas de acompanhamento. O objetivo não é fazer o modelo parecer impressionante com um prompt esperto. É descobrir se ele torna seu trabalho real mais claro, confiável e fácil de finalizar.

Vale a pena testar o Claude Opus 5?

Claude Opus 5 traz uma nova opção ao Felo para tarefas que recompensam persistência, raciocínio cuidadoso e verificação. Seus resultados publicados apontam progresso significativo em codificação agentica, automação, uso de computador e análise profissional, enquanto suas restrições de segurança e limitações continuam contexto importante.

Nos próximos sete dias, assinantes do Felo Pro podem avaliá-lo sem cobrança adicional de modelo. Traga uma tarefa que realmente importa, peça para mostrar e verificar o trabalho, e decida pelo resultado se o Claude Opus 5 merece um lugar permanente em seu fluxo de trabalho.

Teste o Claude Opus 5 no Felo Pro ->


Fontes e leitura adicional


Este post também está disponível em English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, Italiano, ไทย, Español and বাংলা.