A Anthropic anunciou nesta terça-feira (22) o Claude Opus 5.5, novo modelo de inteligência artificial da empresa voltado a tarefas complexas de programação, uso de computadores e trabalho profissional. O lançamento inaugura a família Claude 5.5 e chega com preços menores que os do Opus 5.
Na API, o Opus 5.5 custa US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de tokens de saída. Os valores representam uma redução de 20% em relação ao Opus 5, que custava US$ 5 e US$ 25, respectivamente.
A Anthropic afirma, porém, que o custo total de uso pode cair cerca de 40% em cargas de trabalho típicas. A diferença é explicada não apenas pelo preço menor por token, mas também pela redução no consumo de tokens e pelo custo mais baixo de leituras de cache, que caiu de US$ 0,50 para US$ 0,20 por milhão de tokens.
O novo modelo também chega em meio à disputa por desempenho entre os principais laboratórios de IA. Em testes divulgados pela Anthropic, o Opus 5.5 apresentou resultados superiores ao Opus 5 em programação, uso de computadores e tarefas profissionais, além de superar ou se aproximar do GPT-6 Astra em determinados benchmarks. Os números, no entanto, dependem das configurações e metodologias utilizadas em cada avaliação.
Claude Opus 5.5 fica mais barato que o Opus 5
Além dos US$ 4 por milhão de tokens de entrada e US$ 20 na saída, o Claude Opus 5.5 cobra US$ 0,20 por milhão de tokens em leituras de cache e US$ 5 por milhão em gravações no cache.
No Opus 5, esses valores eram de US$ 0,50 e US$ 6,25, respectivamente.
A Anthropic também oferece um modo rápido para o Opus 5.5 no Claude Code e na Claude Platform. Essa opção pode gerar respostas até 2,5 vezes mais rapidamente, segundo a empresa, mas tem preços maiores: US$ 8 por milhão de tokens de entrada e US$ 40 por milhão de tokens de saída.
A companhia afirma ainda que o modelo padrão gera respostas mais de 30% mais rapidamente do que o Opus 5.
Anthropic destaca avanços em programação
Programação é um dos principais focos do lançamento. No Terminal-Bench 4.0, benchmark que avalia a capacidade de agentes realizarem tarefas complexas em interfaces de linha de comando, o Claude Opus 5.5 alcançou 66,4% na configuração utilizada pela Anthropic.
No FrontierCode v1.1, voltado a mudanças em projetos de software reais, o modelo registrou 54,4%. Já no CursorBench 4.0, a pontuação divulgada foi de 57,8%.
Para comparação, a Anthropic informa que o GPT-6 Astra atingiu 57,9% no Terminal-Bench 4.0 e 53,3% no FrontierCode. Os números do modelo da OpenAI utilizados pela empresa foram obtidos a partir de resultados reportados pela própria OpenAI, e as configurações de esforço não são necessariamente idênticas em todos os testes.
A própria Anthropic reconhece que pequenas diferenças em benchmarks estão se tornando indicadores menos precisos da experiência prática conforme os modelos avançam.
Além dos benchmarks, a empresa cita testes internos e avaliações de clientes em tarefas de longa duração. Em um deles, o modelo teria concluído a migração de uma base com 680 mil linhas de código em menos de um dia. Outro teste envolveu a auditoria e correção de aproximadamente 200 mil linhas de código em menos de três horas.
Esses resultados foram divulgados pela Anthropic e por parceiros participantes dos testes iniciais, e não representam necessariamente o desempenho obtido em todos os projetos.
Modelo também mira tarefas profissionais
Em avaliações de trabalho profissional, o Claude Opus 5.5 atingiu 1.846 pontos Elo no GDPval-AA v2.1, benchmark que testa agentes em tarefas relacionadas a 44 ocupações.
No AutomationBench, dedicado a fluxos de trabalho empresariais, o modelo marcou 40%. Nesse teste específico, o GPT-6 Astra apareceu com 41,4%.
Já no Humanity’s Last Exam, avaliação multidisciplinar de perguntas difíceis, o Opus 5.5 atingiu 67,7% com uso de ferramentas, de acordo com os números divulgados pela Anthropic.
Em uso de computadores, a empresa informa que o modelo alcançou 81,8% no OSWorld 2.0, avaliação na qual agentes precisam interagir com interfaces e concluir tarefas.
Anthropic também muda estilo das respostas
A empresa afirma ter trabalhado na maneira como o Opus 5.5 apresenta suas respostas. O objetivo foi reduzir jargões, construções pouco naturais e excesso de informações secundárias.
Segundo a Anthropic, o modelo tende a colocar informações mais importantes no início das respostas e seguir instruções de estilo com maior consistência.
A mudança segue uma tendência recente entre desenvolvedoras de IA de tratar comunicação e capacidade de seguir preferências de escrita como parte importante da experiência de uso, especialmente em sessões de trabalho prolongadas.
Segurança ganha novas proteções
O Claude Opus 5.5 também recebeu mudanças relacionadas a segurança. A Anthropic afirma que o modelo apresentou o melhor resultado entre suas versões recentes em uma auditoria comportamental automatizada com cerca de 2 mil cenários.
De acordo com a companhia, o modelo demonstrou menor tendência a realizar ações difíceis de reverter ou ultrapassar limites estabelecidos durante uma tarefa. A resistência a ataques de prompt injection também teria melhorado em relação ao Opus 5.
A Anthropic afirma que organizações externas, incluindo METR e Frontier Design, participaram das avaliações realizadas antes do lançamento.
Algumas áreas consideradas de maior risco têm restrições adicionais. Em determinadas tarefas de segurança cibernética, por exemplo, solicitações podem ser redirecionadas para modelos anteriores. A empresa também mantém programas específicos de verificação para organizações que trabalham com pesquisa biológica ou segurança cibernética.
A companhia reconhece, entretanto, que os testes atuais não são capazes de identificar antecipadamente todos os possíveis comportamentos problemáticos de modelos utilizados em ambientes reais.
Claude Opus 5.5 já está disponível
O Claude Opus 5.5 está sendo disponibilizado nas plataformas da Anthropic e também por serviços de nuvem de terceiros, incluindo Amazon Web Services, Google Cloud e Microsoft Azure.
Na Claude Platform, desenvolvedores podem acessar o modelo pelo identificador claude-opus-5-5.
A Anthropic também informou que aumentará os limites de uso em períodos de cinco horas nos planos Pro, Max, Team e em modalidades Enterprise baseadas em assentos.
O Opus 5.5 é apenas o primeiro integrante da nova geração. Segundo a empresa, Claude Sonnet 5.5 e Claude Haiku 5.5 serão apresentados nas próximas semanas.
Mais em Inteligência Artificial
22/09/2026
OpenAI lança GPT-6 Sol e Luna com API mais barata e foco em eficiência
22/09/2026
Trump muda nome da IA para ‘superinteligência’ em discurso na ONU
18/09/2026
Santander e DIO abrem 15 mil vagas para curso gratuito de assistentes de IA
31/08/2026
PUCPR cria código para estimular pensamento crítico no uso de inteligência artificial
Compartilhar
