Anthropic lançou o Claude Sonnet 5.5, modelo que, segundo a empresa, é mais de 30% mais rápido e pode reduzir o custo por tarefa em até 30% frente ao Sonnet 5.
Desempenho em benchmarks
Segundo o Digit, o Sonnet 5.5 gera respostas mais de 30% mais rápidas que o predecessor e consome menos tokens, o que pode reduzir o custo total em até 30% em diversas tarefas.
No benchmark Terminal‑Bench 4.0, que mede codificação agente, o Impress Watch confirma que o Sonnet 5.5 acertou 70,6% das questões, enquanto o Sonnet 5 chegou a 10,3%. O mesmo dado foi citado pelo Olhar Digital.
Em outros testes de programação, o Digit e o Olhar Digital apontam que o modelo alcançou 46,2% no FrontierCode 1.1 (contra 42,4% do Sonnet 5) e 55,5% no CursorBench 4.0 (contra 34,1% do Sonnet 5).
No benchmark GDPval‑AA v2.1, o Olhar Digital registrou 1.844 pontos para o Sonnet 5.5, ante 1.449 do Sonnet 5, enquanto o Impress Watch informa que, no mesmo benchmark, o modelo ficou dois pontos abaixo do Opus 5.5.
No OSWorld 2.1, o Sonnet 5.5 atingiu 80,1% de acerto, comparado a 57% do Sonnet 5, segundo o Olhar Digital.
Além disso, o Impress Watch destaca que, em operações de computador e reconhecimento de gráficos, o desempenho do Sonnet 5.5 se aproxima do Opus 5.5 e, em trabalho de conhecimento de longo prazo, supera tanto o Sonnet 5 quanto o GPT‑6 Sol da OpenAI.
Com base em uma captura de tela, o Impress Watch observa que o Sonnet 5.5 foi o primeiro modelo da família Sonnet a completar o jogo Pokémon Red, indicando capacidade de compreensão de imagem e planejamento de longo prazo.
Disponibilidade e preço
De acordo com o Digit e confirmado pelo Olhar Digital, o Claude Sonnet 5.5 já está disponível nas plataformas da Anthropic e pode ser acessado pela Amazon Web Services, Google Cloud e Microsoft Azure usando o nome de modelo claude-sonnet-5-5.

A Anthropic mantém a mesma tabela de preços do Sonnet 5: US$ 2 por milhão de tokens de entrada, US$ 10 por milhão de tokens de saída e US$ 0,20 por milhão de tokens de leitura de cache, valores que o Olhar Digital converteu para aproximadamente R$ 10,42, R$ 52,10 e R$ 1,04 respectivamente.
Como o modelo costuma exigir menos tokens para concluir uma tarefa, tanto o Digit quanto o Olhar Digital estimam uma redução de até 30% no custo efetivo por trabalho.
Posicionamento, uso e segurança
Segundo o Impress Watch, o Sonnet 5.5 é posicionado como um complemento rápido e de baixo custo ao Opus 5.5, indicado para tarefas do dia a dia com escopo bem definido, como correção de bugs, criação de documentos, planilhas e apresentações, além de atividades que exigem bom senso de design.
O mesmo veículo destaca que o modelo possui um "olho aguçado para design" e foi elogiado por testadores iniciais por gerar textos mais claros e facilitar iterações rápidas em tarefas de baixa complexidade.
Em termos de segurança, o Impress Watch relata que, nas auditorias automatizadas da Anthropic, o Sonnet 5.5 apresenta indicadores de alinhamento com a intenção humana iguais ou superiores aos do Sonnet 5.
O Impress Watch acrescenta que a capacidade de cibersegurança foi aprimorada em relação ao Sonnet 5, alcançando níveis comparáveis aos do Opus 5 e que, pela primeira vez na série Sonnet, o modelo inclui salvaguardas semelhantes às do Opus 5.5 e aos modelos de alto desempenho como o Fable, bem como mecanismos de fallback.
As salvaguardas biológicas permanecem as mesmas do Sonnet 5 e se aplicam apenas a solicitações de alinhamento, conforme informado pelo Impress Watch.


