A Anthropic lançou nesta terça-feira (22) o Claude Opus 5. 5, primeiro modelo da família Claude 5. 5. A empresa afirma que a nova versão melhora o desempenho em programação, uso de computadores e tarefas de conhecimento, com custo menor e maior velocidade.
- US$ 4 (cerca de R$ 20,40) para tokens de entrada.
- US$ 20 (cerca de R$ 102,20) para tokens de saída.
- US$ 0,20 (cerca de R$ 1,02) para leituras de cache.
- US$ 5 (cerca de R$ 25,55) para gravações de cache.
- Anthropic, OpenAI, SpaceXAI e Google são acusadas de fazer acordo ilegal para frear avanço da IA.
- Anthropic coloca avaliadores externos dentro da empresa para testar a segurança dos seus modelos de IA.
- IA fazendo IA: Anthropic revela que Claude já lidera parte do trabalho para criar tecnologias do futuro.
O modelo também chega com mecanismos de segurança mais rígidos. Entre eles estão proteções para cibersegurança e biologia, defesas contra ataques de prompt injection e medidas para reduzir tentativas de contornar limites de ambientes de teste.
Nos testes da Anthropic, o Opus 5. 5 apresentou o melhor resultado da empresa até agora em seu principal teste automatizado de alinhamento. A companhia também registrou avanços em programação, uso de computadores e tarefas de conhecimento.
Um dos primeiros avaliadores concluiu uma migração de código com 680 mil linhas em menos de um dia. Em outro teste, o modelo conseguiu reduzir o tempo de carregamento de páginas de um aplicativo em 39 de 40 tentativas.
O custo também caiu. Segundo a Anthropic, o Opus 5. 5 custa 40% menos para operar que o Opus 5 em cargas de trabalho típicas e gera respostas mais de 30% mais rápido.
Os preços por 1 milhão de tokens são.
Segurança entra no centro do lançamento.
O Opus 5. 5 é o primeiro lançamento da Anthropic depois de a empresa defender a ideia de “desacelerar a fronteira” do desenvolvimento de IA, mantendo as práticas de segurança próximas do avanço das capacidades dos modelos.
Nos testes da companhia, o novo modelo tentou contornar limites de ambientes controlados cerca de 85% menos vezes que o Opus 5 ou o Claude Mythos 5. 1. Todas as tentativas registradas foram consideradas de baixa gravidade e relatadas pelo próprio modelo.
A Anthropic também afirma que o Opus 5. 5 é mais resistente a ataques de prompt injection. Para tarefas de cibersegurança que acionarem as proteções, as solicitações serão encaminhadas ao Claude Opus 4.
8. Já pedidos relacionados à biologia poderão ser direcionados ao Opus 5.
O que dizem os primeiros avaliadores.
Os primeiros testes também destacaram o desempenho em programação. Mario Rodriguez, diretor de produto do GitHub, afirmou que o modelo usou alguns dos menores números de tokens e etapas registrados pela empresa e resolveu mais tarefas de terminal que o Opus 5 no VS Code usando menos da metade das etapas.
Na avaliação da Deloitte Consulting, o modelo também apresentou resultados superiores ao Opus 5 em determinadas tarefas. Carl Bennett, CIO da empresa, afirmou: “Mesmo em sua configuração de menor esforço, o Claude Opus 5.
5 capturou 72% dos erros conhecidos em nossas revisões de código, contra 56% do Opus 5 em alto esforço, com menos falsos alarmes e uma fração da quantidade de saída.”.
A Anthropic também modificou a forma como o modelo escreve. O Opus 5. 5 coloca as informações mais importantes no início das respostas, usa menos jargões e segue melhor as regras de escrita fornecidas pelo usuário.
Um dos primeiros avaliadores resumiu a mudança dizendo: “ele escreve como eu escrevo”.
O Claude Opus 5. 5 já está disponível nas plataformas da Anthropic, além de Amazon Web Services, Google Cloud e Microsoft Azure. Desenvolvedores podem acessá-lo na Claude Platform pelo identificador claude-opus-5-5.
Claude Sonnet 5. 5 e Claude Haiku 5. 5 serão lançados nas próximas semanas.
Valdir Antonelli é jornalista com especialização em marketing digital e consumo.
Em números
- Um dos primeiros avaliadores concluiu uma migração de código com 680 mil linhas em menos de um dia
- Os preços por 1 milhão de tokens são
Comentários
Participe da conversa. Comentários passam por moderação antes de aparecer.
Carregando comentários…