Anthropic lança Claude Opus 5 com foco em programação e pesquisa

Conheça o Claude Opus 5, o novo modelo de IA da Anthropic focado em programação e pesquisa, com custo reduzido e raciocínio adaptativo.

Claude Opus 5 oferece contexto de até 1 milhão de tokens e saída de 128 mil tokens, com preço pela metade do Fable 5.
Destaques
  • O Claude Opus 5 suporta contexto de até 1 milhão de tokens, permitindo tarefas longas com menos intervenção.
  • O modelo custa metade do preço do Claude Fable 5, mas oferece desempenho próximo em programação e pesquisa.
  • Apesar dos avanços, o modelo tende a respostas prolixas e requer supervisão humana em tarefas críticas.

A Anthropic lançou oficialmente o Claude Opus 5, seu novo modelo de inteligência artificial projetado para programação, pesquisa e tarefas profissionais complexas. Posicionado estrategicamente entre o Opus 4.8 e o topo de linha Claude Fable 5, o novo modelo promete desempenho de ponta por um custo significativamente menor — metade do preço do Fable 5, segundo a empresa. Nos primeiros testes externos, a IA demonstrou capacidade notável para organizar projetos longos, mas também revelou tendência a respostas prolixas e inconsistências na revisão de código, o que sugere que, apesar dos avanços, a supervisão humana continua sendo indispensável em cenários críticos.

Especificações técnicas e principais mudanças do Claude Opus 5

O grande salto do Opus 5 em relação ao seu antecessor está na capacidade de executar tarefas longas com muito menos intervenção do usuário. O modelo agora suporta um contexto de até 1 milhão de tokens — a unidade que mede pedaços de texto processados pela IA — e pode gerar respostas de até 128 mil tokens em uma única saída. Esse aumento de escala é complementado pelo “raciocínio adaptativo”, um mecanismo que permite ao modelo dedicar mais tempo de processamento para problemas complexos e tentar corrigir erros automaticamente durante a execução de uma tarefa.

CaracterísticaClaude Opus 5
Uso principalProgramação, pesquisa e tarefas profissionais
Contexto máximoAté 1 milhão de tokens
Saída máxima128 mil tokens
Raciocínio adaptativoAtivado por padrão e ajustável
Identificador na APIclaude-opus-5codecodecodecode

Para desenvolvedores, a documentação técnica da Anthropic traz um aviso relevante: o modelo tende a escrever respostas mais longas que o normal. Para compensar, é possível ajustar o nível de “esforço” dedicado a cada tarefa, permitindo um equilíbrio fino entre velocidade, custo operacional e profundidade das respostas. Essa flexibilidade é uma das principais novidades, permitindo que o modelo seja usado tanto para respostas rápidas quanto para análises profundas, conforme a necessidade.

Desempenho e benchmarks oficiais da Anthropic

Os dados divulgados pela Anthropic posicionam o Opus 5 como um modelo de alta performance, especialmente em tarefas de programação. Em seus testes internos, o modelo superou o Opus 4.8 e chegou muito perto dos resultados do Fable 5, mas com a vantagem de custar metade do preço por chamada de API. O desempenho foi igualmente forte no controle autônomo de computadores, análise de documentos complexos e automação de fluxos de trabalho empresariais.

No AutomationBench, um benchmark que simula tarefas empresariais do início ao fim, a Anthropic afirma que o Opus 5 aprovou cerca de 1,5 vez mais casos do que o concorrente mais próximo na mesma faixa de custo. É importante notar que esses números vêm diretamente da fabricante e, portanto, representam o potencial máximo do modelo, mas ainda aguardam confirmação por meio de testes independentes e mais abrangentes.

Primeiras análises externas: pontos fortes e limitações

Os testes realizados por veículos e empresas especializadas pintam um quadro mais matizado. O modelo impressiona pelo planejamento estratégico, mas recebe críticas por ser excessivamente cauteloso, prolixo e, em alguns cenários, inconsistente na revisão de código.

Lenny’s Newsletter: inteligente, mas detalhista demais

Claire Vo, em uma avaliação cega publicada na Lenny’s Newsletter, colocou o Opus 5 contra outros seis modelos em tarefas práticas. A conclusão foi que a IA é inteligente e cuidadosa, mas peca pelo excesso de detalhes. Em um caso emblemático, o modelo se recusou a resolver um conflito entre versões de código por considerar a ação muito arriscada — uma cautela que, em tarefas de análise profunda, pode ser uma qualidade, mas em outras situações se torna um obstáculo à produtividade.

CodeRabbit: bom coadjuvante, não revisor principal

A CodeRabbit, plataforma especializada em revisão de código, testou o Opus 5 e encontrou um desempenho misto. Por um lado, o modelo produziu comentários úteis com boa precisão técnica. Por outro, encontrou significativamente menos problemas do que o sistema proprietário da própria CodeRabbit e gerou cerca de quatro vezes mais observações consideradas de baixa importância. A conclusão prática é clara: o Opus 5 pode ser um excelente segundo par de olhos em uma revisão de código, mas ainda não está pronto para ser a única barreira de qualidade antes de uma mudança crítica. Para a construção de novos projetos, no entanto, a avaliação foi mais positiva.

ZDNET, CNET e CNBC: o custo como diferencial competitivo

O ZDNET vê o Opus 5 como um forte candidato a modelo principal para assinantes do Claude Max, destacando o ótimo custo-benefício. O CNET enfatizou a autonomia do modelo em tarefas diárias, enquanto a CNBC colocou o lançamento no contexto da crescente pressão do mercado por ferramentas de IA que entreguem alto desempenho sem elevar exponencialmente os custos operacionais das empresas.

Preço e disponibilidade no mercado

O Claude Opus 5 já está disponível em várias frentes: nos planos Claude Max e Claude Pro, na ferramenta Claude Code, no ambiente Cowork e, claro, na API. O preço da API é de US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída. Quem precisar de respostas ainda mais rápidas pode optar pelo modo expresso, que custa o dobro do valor padrão. No lançamento, o modelo não estava disponível nas plataformas de nuvem Amazon Bedrock, Google Cloud ou Microsoft Foundry.

Segurança, alinhamento e limitações práticas

A Anthropic afirma que o Opus 5 apresentou uma taxa significativamente menor de comportamentos “desalinhados” em suas auditorias internas, ou seja, foi menos suscetível a comandos maliciosos ou a gerar respostas indesejadas. Esse dado, porém, ainda precisa ser verificado por avaliações externas independentes.

O que significa isso no dia a dia?

Para o usuário comum, as limitações mais imediatas são práticas: o modelo tende a dar respostas longas, às vezes prolixas, e pode ser excessivamente cauteloso, recusando-se a executar ações que considera arriscadas. Na programação, o excesso de comentários secundários e a eventual falha em detectar problemas críticos reforçam que a revisão humana continua sendo a peça central de qualquer fluxo de trabalho profissional.

Vale a pena migrar para o Claude Opus 5?

O Opus 5 é uma escolha natural para quem já utiliza o Opus 4.8 e trabalha com projetos longos, pesquisa ou programação, já que o preço de tabela se manteve o mesmo. Ele também se apresenta como uma alternativa econômica interessante ao Fable 5 para tarefas diárias, especialmente quando a prioridade é reduzir custos sem abrir mão de um desempenho de alto nível.

No entanto, antes de substituir qualquer fluxo de trabalho consolidado, é prudente comparar o Opus 5 com o Fable 5 e com alternativas como o GPT-5.6, usando exatamente as mesmas tarefas do seu dia a dia. Em revisão de código ou em qualquer decisão crítica, o modelo deve ser tratado como uma ferramenta de apoio poderosa, mas não como um substituto para a checagem e o julgamento humano. O equilíbrio entre custo e capacidade é atraente, mas a maturidade da tecnologia ainda exige um olhar crítico do profissional.

Compartilhar este artigo
Canal oficial de conteúdo do portal Overcentral. A Equipe Central produz notícias, guias e análises com foco em credibilidade e relevância, garantindo que você receba o melhor conteúdo editorial diariamente.