A 30 de junho de 2026, a Anthropic lançou o Claude Sonnet 5, a versão mais recente do seu modelo intermédio equilibrado e o Sonnet mais agente que a empresa já lançou. É o sucessor direto do Sonnet 4.6 e chegou com uma proposta clara: qualidade próxima da do Opus 4.8 por uma fração do custo.

A grande notícia não é um benchmark. É o preço. O Sonnet 5 foi lançado a $2 por milhão de tokens de entrada e $10 por milhão de tokens de saída, uma taxa que a Anthropic tornou mais tarde permanente, mais barata do que o Opus 4.8, mais barata do que o GPT-5.5 da OpenAI e mais barata do que o Gemini 3.1 Pro da Google. Para equipas que executam agentes em grande escala, onde a mesma tarefa pode consumir milhões de tokens ao longo de centenas de passos, esse preço muda as contas.

Atualização, 27 de julho de 2026. A Anthropic lançou um novo modelo de topo desde este lançamento. O Claude Opus 5 chegou a 24 de julho de 2026 a $5 e $25 por milhão de tokens, a mesma taxa que o Opus 4.8 cobrava, pelo que todas as comparações de preço abaixo continuam válidas face ao atual modelo de topo. A Anthropic chama ao Opus 5 «o novo modelo predefinido no Claude Max, e o modelo mais forte no Claude Pro», o que deixa o Sonnet 5 como o nível de volume para o qual foi concebido. No Claude Code, Pro, Team Standard e Enterprise, o modelo predefinido continua a ser o Sonnet 5.

Atualização, 2 de setembro de 2026. A Anthropic lançou o Claude Fable 5.1 a 1 de setembro de 2026 a $10 e $50 por milhão de tokens. Lidera o Artificial Analysis Intelligence Index com 66 pontos, à frente do Opus 5 com 63 e do Sonnet 5 com 53, o que torna o Opus 5 o modelo de topo com melhor relação qualidade/preço em vez do teto máximo. O Fable 5.1 chega aos lugares premium do Max e do Team dentro de 50% dos seus limites semanais, e ao Pro apenas através de créditos de utilização, pelo que nada muda quanto ao lugar do Sonnet 5 na hierarquia.

Atualização, 24 de setembro de 2026. A Anthropic lançou o Claude Opus 5.5 a 22 de setembro de 2026 a $4 e $20 por milhão de tokens e, no mesmo dia, passou o Opus 5 para a sua lista Legacy. É a primeira vez que o nível Opus fica abaixo da sua própria taxa anterior, e reduz a diferença para o Sonnet 5 de 2,5x para 2x, tanto na entrada como na saída. No Artificial Analysis Intelligence Index v4.3.2, o Opus 5.5 lidera com 57,6 contra os 38 do Sonnet 5. A Anthropic prometeu um Claude Sonnet 5.5 sem indicar data.

A Anthropic enquadra o lançamento numa mudança do mercado. O trabalho agente, ou seja, um modelo que planeia, chama ferramentas e funciona de forma autónoma sem um humano no processo, costumava exigir os modelos de fronteira maiores e mais caros. Com o Sonnet 5, a empresa defende que essa capacidade é agora «o mínimo esperado» em todos os níveis de preço, e a concorrência passou da capacidade bruta para o custo e a fiabilidade.

Neste artigo abordamos o que é o Sonnet 5, o panorama completo de benchmarks face ao Sonnet 4.6 e ao Opus 4.8, como se compara ao GPT-5.5 e ao Gemini 3.1 Pro, os preços e o aumento cancelado, o novo tokenizador, o comportamento de pensamento e esforço, as alterações de segurança e o lugar que ocupa na gama da Anthropic.

Os Pontos Essenciais

  • O Claude Sonnet 5 foi lançado a 30 de junho de 2026 com um preço de lançamento de $2 e $10 por milhão de tokens. A taxa padrão de $3 e $15 prevista para 1 de setembro foi cancelada a 10 de agosto de 2026, pelo que $2 e $10 é agora o preço permanente.
  • Supera o Sonnet 4.6 em todos os benchmarks publicados e fica ligeiramente à frente do Opus 4.8 em trabalho de conhecimento, obtendo 1.618 contra 1.615 no GDPval-AA v2.
  • A diferença que permanece é na programação agente mais difícil, onde os 69,2% do Opus 4.8 no SWE-bench Pro ficam seis pontos acima dos 63,2% do Sonnet 5.
  • A Artificial Analysis mediu o Sonnet 5 em $2.29 por tarefa ao preço padrão, cerca de 15% mais do que o Opus 4.8, porque o modelo gasta muito mais tokens por tarefa.
  • Um novo tokenizador converte o mesmo texto em 1,0 a 1,35x mais tokens, pelo que deve reavaliar a sua utilização real antes de assumir que o desconto por token se reflete na sua fatura.

O Que É Realmente o Claude Sonnet 5

Do editor

Todos os modelos de IA numa só aplicação

Fello AI reúne GPT-6, Claude 5, Gemini 3.8, Grok 4.7 e mais numa só aplicação nativa para Mac e iPhone.

Descarregue já!

O Claude Sonnet 5 é um modelo de raciocínio de uso geral que ocupa o meio da hierarquia da Anthropic, acima do Haiku e abaixo do Opus. Foi concebido para ser o cavalo de batalha do dia a dia: suficientemente rápido para uso interativo, suficientemente barato para produção em grande volume e agora suficientemente capaz para executar cargas de trabalho agentes reais. Eis o essencial num relance.

  • Identificador de API: claude-sonnet-5
  • Janela de contexto: 1 milhão de tokens
  • Pensamento adaptativo: sempre ativo, com o esforço predefinido em alto na API e no Claude Code
  • Novo modelo predefinido para utilizadores Free e Pro no claude.ai
  • Concebido para agentes, com forte utilização de ferramentas em navegadores e terminais

A característica definidora é a autonomia. A Anthropic afirma que o modelo «consegue fazer planos, usar ferramentas como navegadores e terminais, e funcionar de forma autónoma a um nível que, há apenas alguns meses, exigia modelos maiores e mais caros». Os parceiros de acesso antecipado descreveram-no como muito mais agente do que os seus antecessores, o que significa que é melhor a levar uma tarefa de vários passos do início ao fim, em vez de precisar que um humano o incentive a cada etapa.

A outra grande mudança está por baixo do capô. O Sonnet 5 é lançado com um tokenizador atualizado, o que afeta a forma como conta e orça os tokens. Mais sobre isto abaixo.

A Grande Notícia É o Custo

Na maioria dos lançamentos anteriores do Claude, a história era um novo teto de capacidade. Para o Sonnet 5, a história é o piso de custo. A Anthropic posicionou o modelo como uma forma mais barata de executar agentes, e o preço é a peça central.

A $2 e $10, o Sonnet 5 fica abaixo de todos os modelos de topo com que compete. O Opus 4.8 custa $5 e $25, pelo que o Sonnet 5 fica bem abaixo de metade do preço do nível de fronteira da Anthropic, ao mesmo tempo que se aproxima dele em qualidade. Essa comparação sobreviveu à chegada do Opus 5 a 24 de julho, que cobra os mesmos $5 e $25, e sobreviveu ao Opus 5.5 a 22 de setembro, a $4 e $20, onde o Sonnet 5 continua a custar exatamente metade. O GPT-5.5 situa-se em $5 e $30. O Gemini 3.1 Pro custa $2 e $12, e no lançamento apenas o Gemini 3.5 Flash, mais pequeno e mais rápido da Google, ficava mais barato.

O momento não é um acaso. A Anthropic está a correr rumo a uma IPO amplamente noticiada, e as cargas de trabalho de agentes são onde a despesa empresarial se está a concentrar. Um modelo que entrega desempenho agente de classe Opus a preços de Sonnet visa diretamente as equipas que estão a decidir que parte do seu orçamento de automação comprometer, e com que fornecedor.

Há uma armadilha que só aparece quando se olha para além do preço por token, e é importante. O Sonnet 5 trabalha mais do que o seu antecessor, usando muito mais tokens por tarefa, o que significa que o custo por tarefa pode, na prática, ficar acima do Opus 4.8 aos preços padrão. Os dados independentes abaixo detalham isto.

Resultados dos Benchmarks

A Anthropic publicou uma tabela de benchmarks com o lançamento, comparando o Sonnet 5 com o Sonnet 4.6 e o Opus 4.8. A conclusão principal é que o Sonnet 5 supera o Sonnet 4.6 em todos os benchmarks publicados e fecha a maior parte da diferença face ao Opus 4.8.

Benchmark Sonnet 5 Sonnet 4.6 Opus 4.8
Programação agente (SWE-bench Pro) 63,2% 58,1% 69,2%
Programação agente (Terminal-Bench 2.1) 80,4% 67,0% não reportado
Utilização do computador (OSWorld-Verified) 81,2% 78,5% não reportado
Raciocínio multidisciplinar (Humanity’s Last Exam, com ferramentas) 57,4% 46,8% 57,9%
Trabalho de conhecimento (GDPval-AA v2) 1.618 não reportado 1.615

Alguns destes números destacam-se. O salto no Terminal-Bench 2.1, de 67,0% para 80,4%, é mais de 13 pontos e aponta diretamente para um melhor comportamento real em linha de comandos e em agentes. No Humanity’s Last Exam com ferramentas, o Sonnet 5 salta de 46,8% para 57,4%, ficando a meio ponto do Opus 4.8. E no benchmark de trabalho de conhecimento GDPval-AA v2, o Sonnet 5 supera mesmo o Opus 4.8, 1.618 a 1.615, o que é o sinal mais claro de como a diferença entre os dois níveis se tornou estreita.

O único ponto em que o Opus 4.8 ainda mantém uma vantagem clara é na vertente mais difícil de programação agente. No SWE-bench Pro, os 69,2% do Opus 4.8 ficam seis pontos acima dos 63,2% do Sonnet 5. Para as tarefas de programação mais complexas e de horizonte longo, o Opus continua a ser a escolha mais forte. Para quase tudo o resto, a diferença é suficientemente pequena para que o preço se torne o fator decisivo.

Como o Sonnet 5 se Compara ao Sonnet 4.6 e ao Opus 4.8

Reduzindo os benchmarks ao posicionamento, os três modelos da Anthropic alinham-se assim.

Atributo Claude Sonnet 5 Claude Sonnet 4.6 Claude Opus 4.8
Nível nível intermédio (equilibrado) nível intermédio (equilibrado) fronteira
Preço de entrada por milhão de tokens $2 introdutório, $3 padrão $3 $5
Preço de saída por milhão de tokens $10 introdutório, $15 padrão $15 $25
Janela de contexto 1M de tokens 1M de tokens 1M de tokens
Posição em programação agente forte boa melhor
Posição em trabalho de conhecimento iguala o Opus fica atrás topo

O padrão é simples. O Sonnet 5 substitui o Sonnet 4.6 por completo, superando-o em todas as métricas e custando menos um terço. Face ao Opus 4.8, troca um pequeno défice nas tarefas de programação mais difíceis por uma grande vantagem em custo, e iguala ou supera o Opus em trabalho de conhecimento. Para uma grande parte das cargas de trabalho de produção, a questão já não é se precisa do Opus, mas sim se a diferença de seis pontos no SWE-bench Pro vale o dobro do preço.

Como o Sonnet 5 se Compara ao GPT-5.5 e ao Gemini 3.1 Pro

A própria tabela da Anthropic centra-se na sua gama interna. Colocado ao lado dos outros modelos de topo, o panorama é competitivo em vez de dominante, e depende muito do eixo que se privilegia.

No SWE-bench Pro, o Sonnet 5 lidera com 63,2% contra os 58,6% do GPT-5.5 e os 55,1% do Gemini 3.5 Flash. No Terminal-Bench 2.1, porém, o GPT-5.5 fica ligeiramente à frente com 83,4% (executado através do seu Codex CLI) contra os 80,4% do Sonnet 5. Por isso, «melhor programador agente» não é uma vitória clara. O Sonnet 5 leva um benchmark de programação, o GPT-5.5 leva o outro.

O Gemini 3.1 Pro joga um jogo diferente. Na própria ficha do modelo da Google, apresenta pontuações fortes como 94,3% no GPQA Diamond e 80,6% no SWE-bench Verified, e iguala a janela de contexto de 1 milhão de tokens. O seu preço, a $2 e $12, está próximo da taxa do Sonnet 5.

O resumo honesto é que os três modelos de topo estão agora muito próximos em programação agente, e nenhum deles vence em todas as categorias. O panorama ficou ainda mais concorrido quando a Meta lançou o Muse Spark 1.3, que bate o Opus 5 nos três benchmarks de programação do gráfico da própria Meta e perde quatro das seis linhas de tarefas agênticas. O que distingue o Sonnet 5 é a combinação de um preço baixo com uma qualidade próxima da do Opus dentro do ecossistema Claude, o que importa mais às equipas que já constroem sobre as ferramentas da Anthropic.

Preços e o Aumento Cancelado

O preço foi anunciado em duas fases, e a segunda acabou por ser cancelada.

  • No lançamento (30 de junho de 2026): $2 por milhão de tokens de entrada, $10 por milhão de tokens de saída, descrito como introdutório
  • Agora: os mesmos $2 e $10, de forma permanente. A taxa padrão de $3 e $15 que devia entrar em vigor a 1 de setembro de 2026 foi cancelada a 10 de agosto de 2026

A Anthropic registou a alteração no changelog do seu próprio anúncio do Sonnet 5, afirmando que o preço padrão anteriormente previsto para entrar em vigor a 1 de setembro deixou de se aplicar. As suas páginas de preços listam agora o Sonnet 5 a $2 e $10, sem qualquer nota de rodapé introdutória. Repare no que aconteceu e no que não aconteceu aqui: a própria taxa nunca mudou, pelo que isto não é um corte de preço. O que a Anthropic retirou foi o aumento, o que deixa o Sonnet 5 de forma permanente a um terço abaixo dos $3 e $15 que o Sonnet 4.6 cobrava, e um dos modelos de agentes capazes mais baratos disponíveis.

Taxas de Cache de Prompts

O preço da cache de prompts mantém-se inalterado face ao Sonnet 4.6. As escritas na cache têm um agravamento de 25% a $3.75 por milhão de tokens, com um tempo de vida de 5 minutos, e os acertos na cache têm um desconto de 90% a $0.30 por milhão de tokens. Para cargas de trabalho de agentes que reutilizam um grande contexto fixo ao longo de muitas chamadas, é na cache que reside grande parte da poupança real.

Um aviso importante para quem está a fazer projeções de custo cuidadosas é o novo tokenizador, que pode alterar quantos tokens o seu texto gera.

O Novo Tokenizador

O Sonnet 5 usa um tokenizador atualizado que converte o mesmo texto em cerca de 1,0 a 1,35 vezes mais tokens do que os modelos Claude anteriores. Em termos simples, um prompt idêntico pode custar mais tokens no Sonnet 5 do que custava no Sonnet 4.6, dependendo do conteúdo.

Isto tem um efeito prático nas comparações de custo. O preço de destaque por token é mais baixo, mas se a sua carga de trabalho se situar perto do extremo superior desse intervalo, parte da poupança é anulada pela maior contagem de tokens. Quem estiver a migrar de um modelo mais antigo deve reavaliar a utilização real de tokens em prompts representativos, em vez de assumir que o desconto por token se traduz diretamente numa redução proporcional da fatura. Código e texto que não esteja em inglês tendem a sentir mais as alterações do tokenizador do que a prosa simples em inglês.

Benchmarks Independentes da Artificial Analysis

Os números da Anthropic são os seus próprios, pelo que a leitura externa mais útil vem da Artificial Analysis, que apoiou a Anthropic na avaliação do modelo antes do lançamento. O seu veredicto é mais comedido do que o enquadramento do lançamento, e expõe diretamente a ressalva do custo.

No Artificial Analysis Intelligence Index, o Sonnet 5 obteve 53 pontos com esforço máximo no lançamento, um ganho de 6 pontos face ao Sonnet 4.6 que o colocou ao nível do GPT-5.5 em raciocínio alto. Desde então mudaram tanto a tabela como o próprio índice. A Artificial Analysis reescalou o índice duas vezes e, na leitura atual v4.3.2, o Sonnet 5 obtém 38 pontos com esforço máximo, enquanto o Claude Opus 5.5 da Anthropic lidera a tabela com 57,6, à frente do Claude Fable 5.1 com 53,4 e do Opus 5 com 50,8. A maior parte da queda face aos 53 é a reescala e não uma regressão, e a ordem é a esperada para um modelo de nível intermédio. É a razão para ler o Sonnet 5 como uma jogada de custo em vez de uma jogada de capacidade.

A Armadilha do Custo por Tarefa

A descoberta sobre o custo é a que reformula todo o lançamento. A Artificial Analysis mediu o Sonnet 5 em $2.29 por tarefa no Intelligence Index, usando a taxa de tabela de $3 e $15 que estava então prevista para entrar em vigor, e não os $2 e $10 realmente cobrados. Como esse aumento foi depois cancelado, o número agora sobrestima o que o modelo custa na realidade. Isso é cerca do dobro do Sonnet 4.6 e cerca de 15% mais do que o Opus 4.8. O aumento é impulsionado inteiramente pela utilização de tokens, não pelo preço. Com esforço máximo, o Sonnet 5 usou cerca de 40% mais tokens de saída por tarefa do que o Sonnet 4.6, e aproximadamente o triplo dos turnos agentes nos benchmarks de trabalho de conhecimento AA-Briefcase e GDPval-AA. Esse comportamento escala fortemente com a definição de esforço, com o esforço máximo a usar cerca de seis vezes mais turnos do que o esforço baixo no GDPval-AA.

Assim, a narrativa de que é «mais barato do que o Opus» só se mantém durante a janela promocional e apenas numa base por token. Depois de ter em conta quantos tokens o Sonnet 5 gasta para fazer a mesma tarefa com esforço alto, e depois de o desconto terminar, pode custar mais por tarefa do que o Opus 4.8. A alavanca que controla isto é o esforço: reduza-o e tanto o custo como a latência descem, ao preço de alguma inteligência.

Onde o Sonnet 5 Supera o Seu Próprio Nível

Onde o Sonnet 5 claramente justifica o seu lugar é no trabalho de conhecimento agente. Tanto no AA-Briefcase como no GDPval-AA, executados através do arnês de agentes de código aberto Stirrup da Artificial Analysis, o Sonnet 5 fica ligeiramente à frente do Opus 4.8 e só fica atrás do Claude Fable 5, que não está geralmente disponível. Estes benchmarks testam se um modelo consegue produzir resultados profissionais precisos e bem apresentados, e o Sonnet 5 supera as expectativas do seu nível nestes casos.

Em raciocínio pesado e conhecimento, porém, os modelos maiores da família continuam a liderar. No CritPt, um benchmark de raciocínio de física de fronteira de investigadores de Argonne e da UIUC, o Sonnet 5 obtém 17%. Isso é 14 pontos acima do Sonnet 4.6, um salto real, mas fica atrás do GLM-5.2, do Claude Opus e Fable, e do GPT-5.5 em xhigh e Pro. A Artificial Analysis também mediu ganhos fortes face ao Sonnet 4.6 no Terminal-Bench v2.1 (mais 9 pontos), no Humanity’s Last Exam (mais 10 pontos) e no SciCode (mais 7 pontos), com pontuações relativamente estáveis noutras avaliações.

Pensamento e Esforço

O Sonnet 5 usa pensamento adaptativo, que está sempre ativo. Em vez de um orçamento de pensamento fixo, o modelo decide por si próprio quanto deve raciocinar antes de responder, ajustando o esforço à dificuldade da tarefa. Na API e no Claude Code, o nível de esforço é predefinido como alto, o que favorece o rigor em detrimento da velocidade pura.

O esforço é a forma recomendada de configurar o compromisso entre desempenho, custo e latência. O Sonnet 5 acrescenta uma definição xhigh que o Sonnet 4.6 não tinha, dando-lhe os mesmos cinco níveis de esforço que o Opus 4.8: max, xhigh, high, medium e low. Como os dados da Artificial Analysis mostram, esse controlo tem um efeito grande, com o esforço máximo a gastar várias vezes mais turnos agentes do que o esforço baixo na mesma tarefa.

Esta é a mesma abordagem de raciocínio que a Anthropic usa no seu nível Opus, e é uma grande parte da razão pela qual o Sonnet 5 fecha tanto a diferença agente. O modelo consegue parar para planear uma tarefa de vários passos, chamar uma ferramenta, ler o resultado e corrigir o rumo, tudo sem que um humano indique cada passo. Para cargas de trabalho sensíveis à latência ou ao custo, o nível de esforço pode ser reduzido, trocando alguma inteligência por respostas mais rápidas e mais baratas.

Concebido para Agentes

O tema mais claro em todo o lançamento é que o Sonnet 5 foi concebido para executar agentes, não apenas para responder a perguntas. Os ganhos no Terminal-Bench 2.1 e no OSWorld-Verified são benchmarks de agentes, que medem quão bem o modelo opera um terminal e um computador, e ambos subiram de forma significativa face ao Sonnet 4.6.

Os parceiros de lançamento reforçaram o ponto. Daniel Shepard, da Zapier, afirmou que tarefas que «costumavam ficar paradas a meio» agora são concluídas, chamando ao modelo «uma escolha óbvia» para a automação do dia a dia. O valor de um modelo de agentes de nível intermédio fiável é que pode ser implementado de forma alargada, em muitos fluxos de trabalho simultâneos, sem o custo de um modelo de fronteira em cada chamada.

Isto está alinhado com a direção que a Anthropic tem dado ao seu produto. A empresa tem estado a construir rumo a uma funcionalidade ao estilo de agente e colega de trabalho, em que se confia a um modelo a execução de uma tarefa de ponta a ponta. O Sonnet 5 é a versão dessa visão com um preço pensado para o volume.

Desempenho no Mundo Real dos Parceiros de Lançamento

Para além dos benchmarks, os relatórios dos parceiros centraram-se na fiabilidade e no julgamento, em vez da velocidade pura.

A Zapier destacou as taxas de conclusão em automações de vários passos, a medida prática de se um agente pode ser confiado com um fluxo de trabalho inteiro. A Lovable, uma plataforma de construção de aplicações de IA, sublinhou o lado da segurança. Fabian Hedin, da Lovable, afirmou que «um modelo que sabe quando dizer não é tão importante como um que sabe como construir», apontando para a capacidade melhorada do Sonnet 5 de recusar pedidos maus ou maliciosos.

Esse julgamento importa mais para agentes do que para conversas. Quando um modelo está a funcionar de forma autónoma e a chamar ferramentas, uma ação errada pode ter consequências reais, pelo que um modelo que recusa de forma fiável fazer algo prejudicial é mais seguro de implementar sem um humano a vigiar cada passo.

Segurança e Alinhamento

A Anthropic relata que o Sonnet 5 é mais seguro do que o Sonnet 4.6 em vários eixos. Apresenta taxas mais baixas de comportamento desalinhado, menos cooperação com tentativas de utilização indevida, menos engano e menos alucinações. É também melhor a recusar pedidos genuinamente maliciosos.

Do lado da segurança informática, as salvaguardas de ciberssegurança estão ativadas por predefinição. É notável que a Anthropic afirma que o Sonnet 5 tem capacidades de desenvolvimento de exploits substancialmente piores do que o Opus 4.8, ou seja, é menos capaz de escrever código de segurança ofensivo, algo que a empresa enquadra como uma propriedade de segurança deliberada para um modelo destinado a ser implementado à escala massiva. Um modelo de nível intermédio amplamente implementado é uma superfície de ataque maior do que um modelo de fronteira premium, pelo que manter as suas capacidades perigosas mais baixas faz parte da conceção.

Disponibilidade e Acesso

A Anthropic lançou o Sonnet 5 de forma ampla no dia do lançamento.

  • claude.ai, onde a Anthropic o tornou o predefinido no dia do lançamento para utilizadores Free e Pro, e disponível no Max, Team e Enterprise
  • Claude Code, disponível desde o lançamento
  • Claude API e Claude Platform, sob o identificador claude-sonnet-5
  • Ferramentas de programadores de terceiros, incluindo o Cursor, o VS Code e o GitHub Copilot

Torná-lo o predefinido no dia do lançamento para utilizadores Free e Pro foi um movimento significativo. Colocou um modelo capaz de agentes diante de toda a base de consumidores de imediato, em vez de reservar a capacidade mais recente para os níveis pagos ou empresariais. Desde então, a Anthropic nomeou o Opus 5 como predefinido no Claude Max e, a 22 de setembro de 2026, substituiu-o no topo pelo Opus 5.5, com o Fable 5.1 ainda reservado aos lugares premium do Max e do Team, pelo que o Sonnet 5 ancora agora a extremidade de volume da hierarquia, em vez do topo.

Porque É Que Este Lançamento Importa

Há três coisas que fazem valer a pena prestar atenção ao Sonnet 5 para além dos números dos benchmarks.

A capacidade de agente desceu de nível. O desempenho que exigia o Opus há poucos meses corre agora a um preço por token de nível intermédio, e isso manteve-se mesmo depois de a Anthropic empurrar a fronteira novamente para cima com o Opus 5 e depois com o Opus 5.5. A poupança é real durante a janela promocional e com esforço mais baixo, embora os dados independentes sejam um lembrete de que o custo por tarefa depende de quantos tokens o modelo gasta, não apenas da taxa anunciada.

A diferença entre níveis está a encurtar. Em trabalho de conhecimento, o Sonnet 5 já iguala o Opus 4.8, e em raciocínio com ferramentas está a meio ponto. A diferença que justifica pagar pelo nível de topo está a reduzir-se a um conjunto específico das tarefas de programação mais difíceis, o que muda a forma como as equipas escolhem os modelos.

O preço é agora o campo de batalha. Com a capacidade a concentrar-se entre os modelos de topo, a Anthropic está a competir em custo e fiabilidade, em vez de num único benchmark de destaque. A taxa permanente de $2 e $10 e as melhorias de segurança visam todas ganhar a decisão de implementação de agentes, e não a tabela de classificação.

Para quem quer usar o Claude Sonnet junto com o ChatGPT, o Gemini, o DeepSeek e o Perplexity, a forma mais rápida é usar o Fello AI. Uma aplicação que reúne todos os modelos de fronteira numa única aplicação nativa para Mac, iPhone e iPad, para que possa executar a mesma tarefa em vários modelos e escolher o certo para cada tarefa, sem gerir uma pilha de subscrições.

Perguntas Frequentes

Quanto custa o Claude Sonnet 5?

O Sonnet 5 custa $2 por milhão de tokens de entrada e $10 por milhão de tokens de saída. Essa taxa foi lançada como introdutória, com uma taxa padrão de $3 e $15 prevista para 1 de setembro de 2026, mas a Anthropic cancelou o aumento a 10 de agosto de 2026 e $2 e $10 é agora permanente. Fica um terço abaixo dos $3 e $15 que o Sonnet 4.6 cobrava.

O Claude Sonnet 5 é melhor do que o Opus 4.8?

Depende da tarefa. O Sonnet 5 iguala ou supera ligeiramente o Opus 4.8 em trabalho de conhecimento e fica a meio ponto em raciocínio com ferramentas, mas fica cerca de seis pontos atrás do Opus no benchmark de programação agente mais difícil, o SWE-bench Pro. O modelo de topo atual da Anthropic é o Claude Opus 5.5, que custa $4 e $20 e obtém 57,6 no Artificial Analysis Intelligence Index v4.3.2 contra os 38 do Sonnet 5. O Opus 5 está na lista Legacy da Anthropic desde 22 de setembro de 2026 e continua a responder a $5 e $25, e o Claude Fable 5.1 custa $10 e $50.

O Claude Sonnet 5 é gratuito?

Sim. O Sonnet 5 é o novo modelo predefinido para utilizadores Free e Pro no claude.ai, pelo que qualquer pessoa com uma conta gratuita da Anthropic o pode usar. Também está disponível nos planos Max, Team e Enterprise, além da API e do Claude Code. Para um resumo completo do que o nível gratuito inclui e dos seus limites, veja o nosso guia sobre o plano gratuito do Claude.

O que é o novo tokenizador e isso muda a minha fatura?

O Sonnet 5 vem com um tokenizador atualizado que converte o mesmo texto em cerca de 1,0 a 1,35 vezes mais tokens do que os modelos Claude anteriores. Isso significa que um prompt idêntico pode consumir mais tokens, pelo que parte do preço por token mais baixo é compensada pela maior contagem de tokens. Reavalie a sua utilização real em prompts representativos antes de assumir que o desconto se traduz diretamente em poupança.

O Claude Sonnet 5 consegue mesmo executar agentes sozinho?

O Sonnet 5 foi concebido para isso. O pensamento adaptativo está sempre ativo e é predefinido para esforço alto na API e no Claude Code, e o modelo consegue planear uma tarefa de vários passos, chamar ferramentas como navegadores e terminais, ler os resultados e corrigir o rumo sem que um humano indique cada passo. Os parceiros de lançamento relataram que tarefas que costumavam ficar paradas a meio agora chegam à conclusão.