Tecnologia

Claude Opus 5.5 chega 40% mais barato enquanto a Anthropic apela à prudência na IA

Susan Hill
Adicione-nos no Google

Claude Opus 5.5 faz algo que os modelos anteriores da Anthropic não fizeram: custa menos e funciona mais rápido, igualando ou superando um sistema maior e mais caro. O modelo lida com programação agêntica, utilização de computador, leitura de gráficos e raciocínio multidisciplinar a níveis que, de acordo com os próprios dados da Anthropic, excedem os do Claude Fable 5.1, o modelo anteriormente mais capaz da empresa, em várias medidas. Para pessoas e programadores que consideravam o Opus 5 útil mas caro, o fosso entre o que o modelo pode fazer e o que custa mudou significativamente.

A diferença de preço é específica. O Opus 5.5 cobra 4 dólares por milhão de tokens de entrada e 20 dólares por milhão de tokens de saída; o Opus 5 custava 5 e 25 dólares, respectivamente. As leituras em cache caem de 0,50 para 0,20 dólares por milhão de tokens. A Anthropic afirma que as cargas de trabalho típicas ficam cerca de 40% mais baratas no geral. A velocidade segue a mesma direção: o modelo padrão gera texto mais de 30% mais rápido que o Opus 5. Uma opção separada de modo rápido, com preço de 8 dólares de entrada e 40 dólares de saída por milhão de tokens, atinge até 2,5 vezes a velocidade do Opus 5 padrão — uma configuração útil para aplicações sensíveis à latência.

Os números de desempenho publicados pela Anthropic colocam o Opus 5.5 à frente do Fable 5.1, do Opus 5 e do GPT-6 Astra em quatro dos seis parâmetros de referência. No Terminal-Bench 4.0, que testa a execução de código num ambiente de terminal ao vivo, o Opus 5.5 alcança 66,4% contra os 55,8% do Fable 5.1. No Humanity’s Last Exam, um teste que abrange conhecimento académico e profissional entre disciplinas, o resultado é 67,7% contra 65,6%. O OSWorld 2.0, que mede a operação da interface do computador, mostra 81,8% contra 80,7%. Um teste da Deloitte concluiu que o Opus 5.5, no seu nível de esforço mais baixo, detetou 72% dos erros de programação conhecidos numa revisão, contra 56% do Opus 5 com esforço elevado. Estes números provêm da Anthropic e dos seus parceiros selecionados; as margens de erro declaradas variam entre ±1,6 e ±5 pontos percentuais, e nenhuma verificação independente por terceiros foi publicada no lançamento.

Duas áreas quebram o padrão. No AutomationBench, o GPT-6 Astra regista 41,4% contra 40,0% do Opus 5.5. No Terminal-Bench-Science, o fosso é maior: a Astra atinge 64,6% enquanto o Opus 5.5 fica nos 58,7%. Ambas as diferenças estão dentro das margens de erro declaradas — podem ser ruído — mas podem não ser. A Anthropic inclui estas linhas na sua própria tabela publicada, o que é mais do que a maioria das empresas de IA faz no lançamento. Os números ainda precisam de escrutínio independente antes de poderem ser considerados definitivos.

Em termos de segurança, a Anthropic afirma que o Opus 5.5 foi avaliado antes do lançamento por equipas externas, incluindo a METR. Na sua própria auditoria comportamental interna, com quase 2.000 cenários concebidos para testar se o modelo tenta contornar as restrições que lhe são impostas, o Opus 5.5 é descrito como 85% menos propenso do que o Opus 5 a tentar essa evasão. Modelos mais fortes tendem a ser mais capazes de encontrar soluções alternativas, o que torna a melhoria significativa se se mantiver. A experiência da implementação será o verdadeiro teste.

O que torna este lançamento invulgar é a sua oportunidade. No início deste mês, o presidente executivo da Anthropic, Dario Amodei, publicou um ensaio no qual escreveu que se tinha convencido de que abordar totalmente os riscos da IA requer “ritmar o ritmo do avanço das capacidades para que a prevenção de riscos tenha tempo de acompanhar”. Sam Altman, da OpenAI, e Elon Musk expressaram concordância com a preocupação geral. Jensen Huang, da Nvidia, disse que a ciência subjacente não o apoia. E depois a Anthropic lançou um modelo mais rápido, mais barato e mais capaz do que o seu predecessor. Uma leitura: um modelo com melhores avaliações de segurança e acesso mais alargado é precisamente o que Amodei tinha em mente. Outra: o ensaio nomeou o avanço das capacidades como a preocupação, e as capacidades avançaram. Ambas as leituras residem no mesmo conjunto de factos, e os parâmetros de referência da Anthropic, por si só, não conseguem resolver qual é a correta.

O Claude Opus 5.5 está disponível desde 22 de setembro de 2026 sob o ID de modelo API claude-opus-5-5. Funciona dentro do Claude nos planos Pro, Max, Team e Enterprise, e está acessível através da AWS, Google Cloud e Microsoft Azure. A Anthropic está a aumentar os limites de utilização nos níveis de subscrição de cinco horas. O Sonnet 5.5 e o Haiku 5.5, os restantes membros da família 5.5, deverão seguir-se nas próximas semanas, sem preço ou data de lançamento específica anunciada para nenhum deles.

Etiquetas: , , , , ,

Adicione-nos no Google

Discussão

Existem 0 comentários.