A Anthropic lançou o Claude Opus 5.5, um novo modelo de inteligência artificial que, segundo a empresa, oferece desempenho próximo do Claude Fable 5.1 na maioria das tarefas, com custos de utilização inferiores aos do anterior Opus 5.

Claude opus 5. 5 reduz custos e reforça salvaguardas

Continua após a publicidade


O preço da API foi fixado em 4 dólares por milhão de tokens de entrada e 20 dólares por milhão de tokens de saída, menos 20% do que no Opus 5. A Anthropic estima, contudo, que o custo total possa ser cerca de 40% inferior em cargas de trabalho típicas, uma diferença que não resulta apenas do preço por token.

A empresa posiciona o novo modelo sobretudo para programação, utilização de ferramentas e agentes de IA capazes de executar tarefas complexas durante períodos prolongados. O lançamento sucede ao Opus 5, apresentado em julho, e inaugura a nova família Claude 5.5.

Segundo a Reuters, o novo modelo mantém desempenho próximo dos sistemas mais avançados da empresa em várias tarefas, ao mesmo tempo que reduz os custos operacionais.

Continua após a publicidade


Claude Opus 5.5 recebe novas salvaguardas

Uma das principais alterações está nas medidas de segurança. A Anthropic afirma que o Claude Opus 5.5 incorpora salvaguardas desenvolvidas para os seus modelos mais avançados e foi submetido, antes do lançamento, a avaliações externas conduzidas por organizações que incluem a METR e a Frontier Design.

Nos testes comportamentais automatizados da própria Anthropic, o modelo registou menos tentativas de ultrapassar barreiras de contenção. A empresa afirma que a frequência deste comportamento foi cerca de 85% inferior à observada no Opus 5 e no Mythos 5.1.

O resultado necessita, porém, de contexto. A redução de 85% provém de avaliações internas da Anthropic e não dos testes realizados pela METR ou pela Frontier Design. A participação de organizações externas acrescenta uma camada de avaliação independente, mas não transforma as métricas internas da empresa em validação externa.

A própria Anthropic reconhece as limitações das avaliações de segurança e refere que o modelo pode, em determinadas circunstâncias, perceber que está a ser testado. Esta capacidade pode influenciar o comportamento observado durante uma avaliação e dificulta a criação de testes que reproduzam todas as situações encontradas numa utilização real.

Agentes de IA aumentam a importância da segurança

As salvaguardas ganham particular relevância à medida que os modelos deixam de responder apenas a perguntas e passam a executar sequências de ações através de ferramentas, aplicações e sistemas externos.

As novas medidas de segurança abrangem sobretudo tarefas relacionadas com cibersegurança e utilização de agentes. O The Verge destaca que a Anthropic reforçou os mecanismos destinados a limitar utilizações de maior risco nestes domínios.

Esta evolução já é visível na cibersegurança. Um relatório publicado pela própria Anthropic em setembro identificou uma maior autonomia dos agentes de IA em ciberataques, com sistemas capazes de executar tarefas de reconhecimento, exploração e recolha de dados durante horas ou dias com menor supervisão humana, como o TecheNet noticiou no artigo Anthropic alerta para maior autonomia da IA em ciberataques.

Os casos documentados não demonstram que os ataques se tenham tornado totalmente autónomos. Os operadores humanos continuam a escolher alvos, definir objetivos e avaliar resultados. A mudança está na quantidade de trabalho operacional que pode ser delegada aos agentes.

É precisamente neste tipo de utilização que uma redução dos custos pode ter maior impacto. Uma tarefa executada por um agente pode exigir múltiplas chamadas ao modelo, utilização prolongada de ferramentas e processamento de grandes volumes de contexto. Pequenas diferenças no preço e na eficiência acumulam-se à medida que cresce o número de operações.

Preço desce 20%, mas Anthropic aponta para economia de 40%

A distinção entre estas duas percentagens é importante. O preço anunciado para a API representa uma redução de 20% por milhão de tokens em relação ao Opus 5. Os 40% referidos pela Anthropic correspondem ao custo estimado para executar cargas de trabalho típicas e incluem outros ganhos de eficiência do modelo.

Segundo a Reuters, o Claude Opus 5.5 oferece desempenho semelhante ao Fable 5.1 em várias tarefas, apesar do custo inferior. A agência refere também que o modelo foi avaliado externamente antes do lançamento e que as novas salvaguardas fazem parte da tentativa da Anthropic de equilibrar o aumento das capacidades com mecanismos adicionais de controlo.

Os resultados apresentados pela empresa e os benchmarks ajudam a enquadrar a evolução face à geração anterior, mas não substituem testes independentes em aplicações reais. O custo efetivo dependerá igualmente do número de tokens utilizado, da duração das tarefas e da arquitetura de cada aplicação.

Disponível nas principais plataformas cloud

O Claude Opus 5.5 já está disponível através da Anthropic e das principais plataformas cloud utilizadas por empresas e programadores, incluindo Amazon Web Services, Google Cloud e Microsoft Azure.

O lançamento é o primeiro da família Claude 5.5. A Anthropic prevê alargar posteriormente esta geração a outros modelos da sua gama, numa estratégia que procura levar parte dos ganhos de desempenho, eficiência e segurança a opções com diferentes níveis de capacidade e custo.

Outros artigos interessantes:

Inteligência Artificial

Publicidade