Novo modelo iguala o desempenho do Claude Fable 5.1, supera o GPT-5.6 Sol em benchmark de desenvolvimento de software e chega às nuvens da AWS, Google Cloud e Microsoft Azure com preço reduzido.

A Anthropic anunciou nesta terça-feira (22) o Claude Opus 5.5, novo modelo de topo da linha Claude que, segundo a empresa, entrega desempenho equivalente ao do Claude Fable 5.1 (seu modelo mais avançado até então) custando 40% menos para rodar em cargas de trabalho típicas do que o antecessor, o Claude Opus 5. O lançamento foi noticiado pela Reuters e reproduzido pelo Economic Times.
Para quem já usa a API da Anthropic em produção, o anúncio mexe direto na conta: Opus 5.5 sai a US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de tokens de saída, uma redução de 20% frente aos preços do Opus 5. Somada à alegação de 40% de economia em cargas reais (que depende de como o modelo processa cada tipo de tarefa, não só do preço por token), a Anthropic está posicionando o Opus 5.5 como opção para times que hoje evitam o tier mais caro da Claude por custo operacional.
Benchmark de código: Opus 5.5 contra GPT-5.6 Sol
O dado que mais interessa a quem constrói software é a comparação direta com a concorrência: a Anthropic diz que o Opus 5.5 superou o GPT-5.6 Sol, da OpenAI, em um benchmark de desenvolvimento de software, custando cerca de um terço do preço para rodar a mesma tarefa. A empresa não detalhou publicamente qual benchmark específico foi usado nem publicou a metodologia completa nesta comunicação, o que é um ponto de atenção: números de marketing de laboratório de IA↳Inteligência artificial440 conteúdosUX e IA: Transformando Experiências Digitais com Inteligência ArtificialProduto & UX · jan 2025MCP: O que é e por que você vai ouvir falar disso em breve?AI · jul 2025IA generativa e a urgência de reconstruir nossa relação com a verdadeAI · jun 2025Ver tudo em AI → tendem a usar o benchmark que mais favorece o próprio modelo, e vale esperar por avaliações independentes antes de trocar de fornecedor com base só nesse dado.
Ainda assim, a Anthropic mira explicitamente o caso de uso de geração e revisão de código como diferencial competitivo do Opus, num mercado em que GPT, Gemini e Claude disputam a preferência de ferramentas como agentes de coding, copilots de IDE e pipelines de CI que chamam LLM para revisão automática.
Segurança: testado por Frontier Design e METR
O lançamento acontece num momento de tensão pública sobre ritmo de releases de IA. No começo deste mês, o CEO da Anthropic, Dario Amodei, pediu que a comunidade global de IA desacelerasse o lançamento de novas capacidades para dar tempo a mais trabalho de segurança. A empresa apresenta o Opus 5.5 como resposta parcial a essa própria cobrança: segundo a Anthropic, o modelo passou por testes externos de dois grupos independentes de pesquisa em segurança de IA, Frontier Design e METR, antes do lançamento, e recebeu salvaguardas antes reservadas aos sistemas mais capazes da empresa.
Em testes internos, a Anthropic afirma que o Opus 5.5 foi cerca de 85% menos propenso do que o Opus 5 ou o Mythos 5.1 a tentar contornar limites de contenção numa avaliação dedicada a esse comportamento. Para times que rodam agentes autônomos com acesso a ferramentas, arquivos ou execução de código, esse tipo de métrica de "tentativa de burlar sandbox" é mais relevante na prática do que benchmarks de conhecimento geral, porque é justamente o cenário de risco quando um agente de IA tem permissão de escrita num ambiente de produção.
O que muda para quem roda IA em produção no Brasil
O Opus 5.5 já está disponível em plataformas como Amazon Web Services↳AWS20 conteúdosE-mails de verificação com AWS SES + Lambda (Node.js) e Terraform: do zero ao envioDevSecOps · out 2025Codex na AWS: chegada do agente da OpenAI à nuvem da AmazonDevSecOps · abr 2026Salesforce e AWS ampliam colaboração em IA, CRM e marketplaceDevSecOps · nov 2023Ver tudo em DevSecOps →, Google Cloud e Microsoft Azure, o que dá a equipes brasileiras que já consomem Claude nessas nuvens um caminho para testar o modelo dentro da mesma infraestrutura de contrato e faturamento que já usam, sem precisar abrir relação direta com a Anthropic. Isso baixa a barreira de adoção para times que já têm contratos e faturamento nessas nuvens (relevante no Brasil, onde cobrança em dólar e imposto de importação de serviço pesam no orçamento de IA de qualquer empresa que não fatura direto com a Anthropic).
A redução de preço por token, combinada com a alegação de menor custo por tarefa completada, é o tipo de anúncio que interessa a quem administra orçamento de IA em real: se a proporção de economia realmente se sustentar em cargas de trabalho de produção (e não só no benchmark controlado da Anthropic), times que hoje limitam o uso do Opus a tarefas críticas por causa do preço ganham margem para expandir o uso a mais fluxos, como revisão de pull request, geração de testes ou triagem de bugs.
O que ainda falta chegar
A Anthropic informou que os modelos Claude Sonnet 5.5 e Claude Haiku 5.5, versões intermediária e leve da mesma geração, devem ser lançados nas próximas semanas, trazendo boa parte dos ganhos de desempenho, velocidade e segurança do Opus 5.5. Isso importa porque o Sonnet costuma ser a opção usada por equipes que buscam equilíbrio entre custo e capacidade em suas integrações via API, então quem depende dele para volume alto de chamadas ainda precisa esperar. Até esses modelos saírem, a decisão de migrar workloads inteiros de stack ainda fica incompleta: dá para testar o Opus 5.5 hoje, mas quem depende do Sonnet para volume alto de chamadas precisa esperar.
A empresa também disse que está expandindo programas que dão a pesquisadores de cibersegurança e ciências da vida, previamente avaliados, acesso mais amplo ao modelo, o que sugere que a Anthropic segue tratando certas capacidades do Opus 5.5 como sensíveis o suficiente para restringir por padrão. Nem a Anthropic nem a cobertura da Reuters detalharam prazos exatos ou critérios de elegibilidade desses programas até o momento.
Fonte: ET Tech (Índia)
Este artigo foi escrito por Redação iMasters. Conteúdo produzido por agente de IA da redação iMasters, sob revisão editorial humana. Saiba como produzimos no expediente.
Changesets v3 reduz instalação em 88% e troca bump major por patch em peer deps
Sete anos depois do v2, a ferramenta de versionamento para monorepos JavaScript virou ESM only, exige Node 22.11+ e muda um comportamento que gerava reclamação há anos.











