O Claude Sonnet 5 saiu em 30 de junho de 2026 com preço promocional de US$ 2 por milhão de tokens de entrada e US$ 10 na saída. Essa promoção acaba em 31 de agosto de 2026, quando o preço vai para US$ 3 e US$ 15. Se você tem carga rodando nele, tem pouco mais de um mês para refazer a conta.
Este post existe por um motivo simples: nós deixamos passar. O Sonnet 5 nasceu entre dois lançamentos maiores e ficou sem cobertura aqui no blog, enquanto o Fable 5 e o GPT-5.6 levaram a atenção. Só que ele é o modelo padrão dos planos Free e Pro do Claude, ou seja, é o que a maioria das pessoas usa sem escolher. E tem um prazo colado nele.
O prazo que muda o orçamento
O preço padrão do Sonnet 5 é US$ 3 na entrada e US$ 15 na saída, exatamente o mesmo do Sonnet 4.6 que ele substituiu. A Anthropic está rodando um preço de entrada mais baixo para acelerar adoção, e ele tem data de validade.

| Data | O que acontece | Preço |
|---|---|---|
| 30/06/2026 | Lançamento | US$ 2 / US$ 10 |
| 31/08/2026 | Último dia da promoção | US$ 2 / US$ 10 |
| 01/09/2026 | Preço padrão | US$ 3 / US$ 15 |
O aumento é de 50%. Se você dimensionou um projeto usando a tabela de julho, refaça a conta com a de setembro antes de assinar contrato anual com cliente. Já vimos margem de projeto evaporar por menos que isso.
O dado que contraria o marketing
Agora a parte incômoda, e ela vale para muito mais do que o Sonnet 5.
A promessa do lançamento foi "desempenho perto do Opus 4.8 por bem menos". A Artificial Analysis mediu outra coisa: o custo médio de uma tarefa do índice de inteligência, com o Sonnet 5 a preço padrão, ficou em US$ 2,29. O Sonnet 4.6, que cobra exatamente o mesmo por token, custava US$ 1,20. E o Opus 4.8, que cobra quase o dobro por token, custava US$ 1,97.

| Modelo | Preço por token | Custo por tarefa |
|---|---|---|
| Claude Sonnet 5 | US$ 3 / US$ 15 | US$ 2,29 |
| Claude Opus 4.8 | US$ 5 / US$ 25 | US$ 1,97 |
| Claude Sonnet 4.6 | US$ 3 / US$ 15 | US$ 1,20 |
Leia de novo: um modelo com preço idêntico ao antecessor saiu quase duas vezes mais caro na prática, e mais caro que um modelo de topo com preço por token quase dobrado.
O motivo é que ele fala mais. Modelos agênticos pensam mais alto, geram mais tokens de raciocínio e fazem mais chamadas de ferramenta. Cada uma dessas coisas é boa para a qualidade e cara na fatura.
Duas ressalvas honestas. Essa medição é do lançamento, com o modelo a preço padrão, e no preço promocional a conta é mais favorável. E o índice atual da Artificial Analysis mostra o Sonnet 5 em US$ 1,53 por tarefa, número mais recente e mais baixo, provavelmente refletindo ajustes de eficiência posteriores. As duas medições existem e apontam a mesma lição.
A lição é essa: preço por token é a etiqueta, não o preço. É o mesmo raciocínio que aplicamos no comparativo de IA para programar e no post do Claude Opus 5.
O que o Sonnet 5 faz bem
Tirando a conta, o modelo é bom no que se propõe.
Ele foi construído para agente: manter plano ao longo de muitos passos, seguir convenção de repositório, chamar ferramenta com precisão e entregar mudança de várias etapas sem se perder. Janela de contexto de 1 milhão de tokens. Ficou disponível no dia do lançamento na AWS, no GitHub Copilot e no Snowflake Cortex, o que reduz atrito de adoção.
É o modelo padrão dos planos Free e Pro do Claude, e está em Max, Team e Enterprise. Na prática, a maior parte do uso cotidiano do Claude passa por ele.
Vale calibrar a expectativa sobre a janela de 1 milhão de tokens, porque ela virou argumento de venda genérico. Ela permite carregar um repositório inteiro de porte médio sem fatiar em pedaços, o que elimina boa parte da engenharia de recuperação que antes era obrigatória. Some isso ao fato de que o modelo mantém coerência entre etapas distantes de uma mesma sequência, e tarefas de refatoração ampla ficam viáveis.
O que a janela grande não resolve é atenção. Enfiar tudo lá dentro por preguiça de selecionar o que importa piora o resultado e infla a fatura, já que a entrada é cobrada por token independentemente de o modelo aproveitar aquele conteúdo. Continua valendo escolher o material relevante antes de enviar. Janela ampla é rede de proteção para quando a seleção falha, não substituto dela.
Onde ele encaixa na linha da Anthropic
Com o Opus 5 lançado em 24 de julho, a linha ficou clara.

| Modelo | Entrada / Saída | Trabalho que paga |
|---|---|---|
| Claude Sonnet 5 | US$ 3 / US$ 15 | Agente em laço o dia todo |
| Claude Opus 5 | US$ 5 / US$ 25 | Depuração difícil, causa raiz |
| Claude Fable 5 | US$ 10 / US$ 50 | Tarefa autônoma muito longa |
O detalhe que muda a decisão: o Opus 5 saiu pelo mesmo preço do Opus 4.8 e com desempenho bem maior. A distância entre o degrau do meio e o de cima diminuiu em valor entregue, mesmo com a diferença de preço intacta. Se o seu volume não for enorme, subir para o Opus 5 pode sair mais barato por tarefa concluída do que insistir no Sonnet.
Como sempre, isso depende da sua carga. Meça.
Como estimar a fatura antes de assinar contrato
Muita proposta de automação nasce errada porque ninguém simulou o consumo. Segue a conta que fazemos antes de comprometer preço com cliente.
Imagine um atendimento que responde 4 mil chamados por mês. Cada chamado envia um contexto de aproximadamente 3 mil tokens, somando instrução, histórico da conversa e trecho de base de conhecimento. A resposta média sai com 500 tokens.
A entrada mensal fica em 12 milhões de tokens e a saída em 2 milhões. Na tabela promocional, isso dá US$ 24 de entrada e US$ 20 de saída, algo perto de US$ 44 por mês. Convertendo a US$ 1 = R$ 5,15, são cerca de R$ 227. Na tabela de setembro, os mesmos volumes viram US$ 36 e US$ 30, ou seja, US$ 66 e aproximadamente R$ 340.
Parece pouco, e é onde o orçamento costuma se perder. Essa simulação assume uma tentativa por chamado. Um agente de verdade reformula pergunta, consulta ferramenta, relê resultado e às vezes recomeça. Se a média real for de três ciclos por atendimento, multiplique tudo por três. E se o volume dobrar em campanha sazonal, dobre de novo.
Por isso instrumentamos consumo desde o primeiro dia da implantação, registrando tokens de entrada, tokens de saída e número de ciclos por atendimento concluído. Sem essa medição, qualquer previsão vira chute, e quem paga o chute errado costuma ser a margem do projeto.
Duas recomendações para contrato: evite fechar valor fixo anual sem cláusula de revisão atrelada ao preço do fornecedor, e provisione uma folga de pelo menos 40% sobre a estimativa inicial. Reajuste de tabela como este, de 50% em dois meses, é rotina no setor e não exceção.
O que fazer antes de 31 de agosto
Se você já tem carga em produção rodando no Sonnet 5, três providências valem o esforço agora.
Primeiro, meça o consumo atual por semana e projete o gasto com a tabela nova. O número que interessa não é o percentual de aumento, é o valor absoluto que entra na despesa mensal a partir de setembro.
Segundo, teste a mesma carga no Opus 5 e no Gemini 3.6 Flash. O objetivo não é trocar por trocar, é descobrir se alguma parte do fluxo aceita um degrau mais barato ou resolve em menos ciclos num degrau mais caro. Fluxos híbridos, com modelo barato triando e modelo caro tratando exceção, costumam vencer a padronização num modelo só.
Terceiro, revise o uso de cache. Se o seu agente reenvia a mesma instrução extensa a cada chamada, ativar cache de contexto derruba a parcela de entrada de forma expressiva, e a entrada é justamente onde o volume se concentra em atendimento.
Quando não usar o Sonnet 5
Não use para tarefa trivial de alto volume. Classificar mensagem e extrair campo de formulário não precisa de modelo agêntico de US$ 15 na saída, e o Gemini 3.6 Flash ou o Flash-Lite fazem o serviço por uma fração.
Não use para trabalho difícil de depuração se você tem orçamento para o Opus 5. A diferença de capacidade aparece justamente onde o problema é feio.
E não padronize nele sem medir tokens de saída. Se a sua aplicação é sensível a custo e o modelo é verboso por natureza, você precisa saber disso antes de escalar, não depois da primeira fatura grande.
Perguntas frequentes
Quanto custa o Claude Sonnet 5?
O preço padrão é US$ 3 por milhão de tokens de entrada e US$ 15 por milhão na saída. Até 31 de agosto de 2026 vale o preço promocional de lançamento, de US$ 2 e US$ 10. A partir de 1º de setembro, todos pagam a tabela padrão.
O Claude Sonnet 5 é mais barato que o Opus?
Por token, sim: US$ 3 e US$ 15 contra US$ 5 e US$ 25 do Opus 5. Por tarefa concluída, nem sempre. A Artificial Analysis mediu no lançamento US$ 2,29 por tarefa no Sonnet 5 contra US$ 1,97 no Opus 4.8, porque o Sonnet 5 gera mais tokens para chegar ao resultado. Meça na sua carga.
Qual a diferença entre Sonnet 5 e Sonnet 4.6?
O preço padrão é idêntico. O Sonnet 5 é bem mais capaz em tarefas agênticas: mantém plano ao longo de muitos passos, chama ferramentas com mais precisão e trabalha com janela de 1 milhão de tokens. Em troca, gera mais tokens, o que eleva o custo real por tarefa.
O Sonnet 5 é o modelo padrão do Claude?
Sim, ele é o padrão dos planos Free e Pro desde 30 de junho de 2026, e está disponível também em Max, Team e Enterprise. Quem usa o Claude sem escolher modelo está usando o Sonnet 5.
Devo migrar do Sonnet 5 para o Opus 5?
Depende do seu volume e do seu tipo de tarefa. Para agente repetitivo de alto volume, o Sonnet 5 continua fazendo sentido. Para depuração difícil e refatoração grande, o Opus 5 costuma resolver em menos tentativas, o que pode sair mais barato apesar do preço maior por token.
Próximo passo
Se você está escolhendo modelo agora, o comparativo de IA para programar coloca Sonnet 5, Opus 5, GPT-5.6 e os demais lado a lado com custo por tarefa. Se quer entender o lançamento que mudou a régua da linha Claude, leia o Claude Opus 5.
Quer ajuda para dimensionar o custo de IA de um projeto antes de fechar preço com seu cliente? Fale com a gente pelo WhatsApp.
Atualizado em julho de 2026. Preços conferidos no anúncio oficial da Anthropic de 30/06/2026. Custo por tarefa da Artificial Analysis, com as duas medições citadas no texto. Autor: Guilherme Fernandes, fundador da Huios Web (Pelotas/RS), +250 projetos entregues desde 2023 em 83 cidades.
Publicado em 27 de julho de 2026 · Por Equipe Huios



