Anthropic apresenta Claude Opus 5.5, novo modelo que mira programação, uso de computador e trabalhos complexos

O Claude Opus 5.5 chegou mais rápido, 40% mais barato e com novas travas para impedir que a IA burle testes de segurança

A Anthropic apresentou nesta terça-feira (22) o Claude Opus 5.5, primeiro modelo integrante da linha Claude 5.5. Segundo a empresa, a nova geração traz melhorias em programação, interação com computadores e atividades que exigem conhecimento, além de oferecer menor custo e maior rapidez.

A nova versão também incorpora mecanismos de segurança mais avançados. Entre as medidas estão proteções voltadas à cibersegurança e à biologia, sistemas de defesa contra ataques de prompt injection e recursos destinados a dificultar tentativas de burlar as restrições impostas aos ambientes de teste.

Mais desempenho por menos
Nos testes realizados pela Anthropic, o Opus 5.5 alcançou o melhor desempenho da empresa até o momento em seu principal teste automatizado de alinhamento. A companhia também identificou melhorias em áreas como programação, interação com computadores e atividades que exigem conhecimento.

Em uma das primeiras avaliações, um testador conseguiu concluir a migração de um código com 680 mil linhas em menos de 24 horas. Em outro experimento, o modelo reduziu o tempo de carregamento das páginas de um aplicativo em 39 das 40 tentativas.

O modelo também apresenta uma redução nos custos. De acordo com a Anthropic, o Opus 5.5 é 40% mais barato de operar que o Opus 5 em cargas de trabalho comuns, além de produzir respostas mais de 30% mais rapidamente.

Os preços por 1 milhão de tokens são:

  • US$ 4 (cerca de R$ 20,36) para tokens de entrada;
  • US$ 20 (cerca de R$ 101,80) para tokens de saída;
  • US$ 0,20 (cerca de R$ 1,02) para leituras de cache;
  • US$ 5 (cerca de R$ 25,45) para gravações de cache

Segurança entra no centro do lançamento
O Opus 5.5 representa o primeiro lançamento da Anthropic após a empresa defender a proposta de “desacelerar a fronteira” do desenvolvimento de IA, buscando manter as medidas de segurança acompanhando de perto a evolução das capacidades dos modelos.

Nos experimentos conduzidos pela companhia, o novo sistema tentou ultrapassar as restrições de ambientes controlados aproximadamente 85% menos vezes do que o Opus 5 ou o Claude Mythos 5.1. Segundo a Anthropic, todas as ocorrências identificadas foram classificadas como de baixa gravidade e comunicadas pelo próprio modelo.

A empresa também afirma que o Opus 5.5 apresenta maior resistência a ataques de prompt injection. Em tarefas de cibersegurança que acionarem os mecanismos de proteção, as solicitações serão encaminhadas para o Claude Opus 4.8. Já solicitações relacionadas à biologia poderão ser direcionadas ao Opus 5.

O que dizem os primeiros avaliadores
As primeiras avaliações também apontaram avanços do Opus 5.5 em tarefas de programação. Mario Rodriguez, diretor de produto do GitHub, afirmou que o modelo apresentou alguns dos menores volumes de tokens e etapas já registrados pela empresa. No VS Code, o sistema também solucionou mais tarefas de terminal que o Opus 5, utilizando menos da metade das etapas.

Em testes realizados pela Deloitte Consulting, o modelo também obteve desempenho superior ao Opus 5 em determinadas atividades. Carl Bennett, CIO da companhia, afirmou: “Mesmo em sua configuração de menor esforço, o Claude Opus 5.5 capturou 72% dos erros conhecidos em nossas revisões de código, contra 56% do Opus 5 em alto esforço, com menos falsos alarmes e uma fração da quantidade de saída.”

Comunicação e próximos lançamentos
A Anthropic também realizou mudanças no estilo de escrita do modelo. O Opus 5.5 passou a priorizar as informações mais relevantes logo no início das respostas, reduziu o uso de termos técnicos desnecessários e demonstrou maior capacidade de seguir as orientações de escrita fornecidas pelos usuários.

Um dos primeiros avaliadores resumiu essa mudança com a frase: “ele escreve como eu escrevo”.

O Claude Opus 5.5 já pode ser utilizado nas plataformas da Anthropic e também está disponível pela Amazon Web Services, Google Cloud e Microsoft Azure. Para desenvolvedores, o acesso pode ser feito pela Claude Platform usando o identificador claude-opus-5-5.

A Anthropic também confirmou que os modelos Claude Sonnet 5.5 e Claude Haiku 5.5 devem chegar nas próximas semanas.

Fonte: Olhar Digital

Deixe um comentário

O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *