A Anthropic publicou o lançamento do Claude Sonnet 5 em 30 de junho de 2026, e a AWS anunciou a disponibilidade no Amazon Bedrock e no Claude Platform on AWS. Para times AWS, a decisão de adoção depende de o Sonnet 5 atender aos requisitos de qualidade, latência e custo da carga e de quais tarefas ainda justificam Opus 5.
A resposta curta: comece testando o Sonnet 5 em cargas de trabalho de alto volume, repetíveis e revisáveis. Roteie para Opus 5 quando uma resposta correta a mais muda materialmente o resultado ou quando a falha é cara de corrigir. Não troque produção com base em benchmark público: use seus prompts, ferramentas, dados, latência, revisão humana e custo real.
Claude Sonnet 5 em resumo
| Pergunta | Resposta prática |
|---|---|
| O que é? | O modelo Sonnet mais capaz da Anthropic até agora, voltado a código, agentes e trabalho profissional em escala. |
| Anúncio público | O anúncio da Anthropic e o model card atual do AWS Bedrock indicam 30 de junho de 2026. |
| Disponibilidade na AWS | Amazon Bedrock e Claude Platform on AWS. No Bedrock, há caminhos por bedrock-runtime e bedrock-mantle. |
| Principais IDs Bedrock | Runtime: us.anthropic.claude-sonnet-5, eu.anthropic.claude-sonnet-5, au.anthropic.claude-sonnet-5 ou global.anthropic.claude-sonnet-5. Mantle: anthropic.claude-sonnet-5. |
| Contexto e saída | O model card da AWS lista janela de contexto de 1M tokens e saída máxima de 128K tokens. A documentação da Anthropic informa que a janela de 1M é o padrão e também o máximo. |
| Preço | Standard global: US$2 de entrada / US$10 de saída por milhão de tokens. Roteamento geográfico comercial ou na Região compatível: US$2,20 / US$11. GovCloud: US$2,40 / US$12. |
| Primeiro workload para testar | Agentes de código em alto volume, revisão, documentação, suporte, análise e automação em que o Sonnet 4.6 quase resolvia, mas o Opus era caro demais. |
Fontes para os fatos que mudam rápido: model card da AWS no Bedrock, preços do Amazon Bedrock e notas da Anthropic sobre o Sonnet 5.
O que os benchmarks devem mudar, e o que não devem
A Anthropic posiciona o Sonnet 5 como uma melhora forte sobre o Sonnet 4.6 e próximo do Opus 4.8 em várias avaliações de agentes e trabalho profissional. Isso é um bom sinal, mas não é um plano de implantação. Curvas de benchmark comprimem preocupações diferentes em uma pontuação: taxa de sucesso, latência, esforço de raciocínio, uso de tokens, estabilidade do prompt e recuperação de erro.
Use os benchmarks desta forma:
- Para escolher o modelo padrão: o Sonnet 5 agora é um primeiro candidato real para muitos workloads de produção no Bedrock que antes exigiam um teste com Opus.
- Para justificar um modelo premium: reserve o Opus para tarefas ambíguas, críticas ou caras de corrigir, nas quais um ganho pequeno de precisão muda o resultado.
- Para controles de esforço: não compare apenas configurações máximas de benchmark. Mais esforço de raciocínio pode melhorar qualidade, mas muda latência e custo.
- Para migração: execute novamente seu conjunto real de avaliação. Um benchmark público não revela falhas de chamada de ferramenta, quebra de schema, drift de recuperação ou carga de revisão humana.
É o mesmo motivo pelo qual nosso guia de benchmark do Opus 4.8 alerta contra transformar rankings públicos em decisões de compra. O ranking mostra onde investigar. Ele não decide o que colocar em produção.
O que a Artificial Analysis encontrou sobre custo por tarefa
A Artificial Analysis publicou em 30 de junho de 2026 uma avaliação do Claude Sonnet 5 que torna a história de custo mais complexa do que o preço de tabela sugere. Na metodologia deles, o Sonnet 5 marcou 53 no Intelligence Index, mas nas premissas de preço padrão daquela avaliação custou US$2,29 por tarefa do Intelligence Index: cerca de 2x o Sonnet 4.6 e cerca de 15% a mais que o Opus 4.8.
A avaliação de junho usou a tarifa prevista de US$3/US$15. A Anthropic manteve US$2/US$10 como preço global padrão do Sonnet 5, portanto os valores por tarefa precisam desse contexto de preço. A diferença veio do uso: em esforço máximo, a Artificial Analysis encontrou cerca de 40% mais tokens de saída do que o Sonnet 4.6 por tarefa do Intelligence Index e cerca de 3x mais turnos agentic no AA-Briefcase e no GDPval-AA. No GDPval-AA, o esforço máximo usou cerca de 6x mais turnos que o esforço baixo.
Isso não torna o Sonnet 5 uma escolha ruim. A Artificial Analysis encontrou desempenho igual ou superior ao Opus 4.8 em AA-Briefcase e GDPval-AA, enquanto o Opus 4.8 continuou mais forte em benchmarks pesados de raciocínio e conhecimento. A lição operacional continua válida com os preços padrão atuais: preço por token e custo por tarefa concluída podem apontar em direções opostas. Recalcule com os preços atuais e o uso medido na sua carga de trabalho.
Sonnet 5 ou Opus 5 no Bedrock?
| Requisito | Comece testando Sonnet 5 quando... | Roteie para Opus 5 quando... |
|---|---|---|
| Agentes de produção em alto volume | Custo, velocidade e uso repetível de ferramentas importam mais do que os últimos pontos de precisão. | O agente toma decisões relevantes e uma resolução correta a mais justifica o prêmio. |
| Fluxos de engenharia | O trabalho é revisável: refatorações, testes, documentação, triagem, busca no código e correções apoiadas por CI. | O trabalho é ambíguo, cruza sistemas e é caro de corrigir depois. |
| Documentos e conhecimento | A saída pode ser checada contra documentos-fonte, citações ou critérios estruturados de aceite. | A tarefa exige julgamento profundo sobre evidências conflitantes e fontes fracas. |
| Fluxos sensíveis a latência | O usuário espera dentro de um produto ou fluxo operacional, e latência afeta a experiência. | Precisão pesa mais que tempo de resposta, ou o fluxo é assíncrono. |
| Postura de FinOps | Você precisa de um padrão sustentável que escale além do piloto. | Existe uma faixa premium estreita, aprovada pelo responsável, com vantagem medida em custo por sucesso. |
Promova o Sonnet 5 a modelo padrão apenas se as avaliações da carga de trabalho atenderem aos critérios de qualidade, latência e custo. Roteie casos selecionados para Opus 5 quando os resultados medidos justificarem essa escolha, com regras explícitas de escalonamento e revisão humana.
Como calcular custo por resultado aceito
Os preços AWS Standard variam por roteamento. A tabela mostra o preço por milhão de tokens de entrada/saída para cada modelo.
| Roteamento | Sonnet 5 | Opus 5 |
|---|---|---|
| Global | US$2 / US$10 | US$5 / US$25 |
| Regional comercial | US$2,20 / US$11 | US$5,50 / US$27,50 |
| GovCloud | US$2,40 / US$12 | US$6 / US$30 |
Os model cards AWS listam Priority, Flex e Reserved como indisponíveis nos dois modelos. Batch consta como N/A para Sonnet 5; Opus 5 aceita Batch. Uma configuração genérica de nível de serviço não comprova suporte pelo modelo.
O cálculo útil não é apenas tokens de entrada e saída. Meça custo por resultado aceito: tokens, latência, nível de esforço, turnos do agente, retries, tempo de revisão, falhas de chamada de ferramenta, escalonamentos para Opus, rejeições por schema e intervenção humana. Um modelo mais barato pode sair caro se gerar mais loops. Um modelo mais caro pode sair mais barato se concluir o trabalho com menos revisão.
É por isso que preço por token e custo por tarefa concluída podem apontar em direções opostas. Em cargas com agentes, número de turnos e volume de saída podem pesar tanto quanto o preço publicado de tokens de entrada e saída.
O tokenizer do Sonnet 5 usa aproximadamente 30% mais tokens que o Sonnet 4.6 para texto equivalente. Meça o uso real de tokens no nível de esforço escolhido antes de comparar custos.
O que muda para times AWS
1. Roteamento regional precisa de aprovação explícita
Para Sonnet 5 e Opus 5, Canadá Central e Calgary são Regiões de origem Runtime geo/global, sem inferência na própria Região; São Paulo aceita roteamento Runtime global. A geografia US inclui destinos nos EUA e no Canadá, sem garantir residência apenas no Canadá. O Mantle lista acesso na Região em us-east-1, us-gov-west-1, eu-north-1, eu-west-1 e ap-southeast-4. Confira a tabela por endpoint e os destinos aprovados.
2. A escolha do endpoint afeta controles
Runtime aceita Invoke, Converse e Messages para esses modelos; Mantle aceita Messages. O Claude Code usa Invoke ou sua integração Mantle separada, não Converse. Runtime oferece Bedrock Guardrails e logs de invocação; Mantle não. Escolha o endpoint pelos controles necessários à carga.
3. IDs de modelo devem usar lista de permissões
Em produção, não trate permissões amplas como foundation-model/* ou inference-profile/* como postura final. Restrinja os IDs aprovados para Sonnet 5 e o modelo de escalonamento, inclua os modelos de base roteados pelo inference profile quando necessário e aplicar restrições de Região com exceções para perfis cross-region aprovados. Marketplace, acesso a modelos e configuração de logging não devem ficar em roles de runtime de engenharia.
4. Atualize os parâmetros antes de migrar
O Sonnet 5 habilita pensamento adaptativo por padrão. Requisições com thinking.type="enabled"/budget_tokens manuais ou parâmetros de amostragem fora do padrão retornam erro 400. Atualize esses campos e teste o cliente ou gateway antes de mudar o tráfego de produção. Consulte os detalhes de migração para Sonnet 5.
Um rollout prático do Sonnet 5 no Bedrock
- Escolha uma carga de trabalho. Use um fluxo real, com volume suficiente para expor custo e revisão suficiente para capturar falhas.
- Congele a linha de base. Registre modelo atual, prompt, taxa de sucesso, tokens, latência, retries, tempo de revisão e classes de falha.
- Execute o Sonnet 5 no mesmo conjunto de avaliação. Use o mesmo ID de modelo, região, endpoint e esforço que seriam usados em produção.
- Compare com Opus 5 apenas onde a decisão importa. Não mande toda requisição para Opus só porque o score público é maior.
- Defina regras de roteamento. Decida o que fica no Sonnet 5, o que escala para Opus, o que exige aprovação humana e o que ainda não deve rodar em LLM.
- Valide os controles AWS. Listas de permissões em IAM, restrições regionais, registro de invocações onde suportado, budgets, anomalias e revisão de responsável antes da expansão.
- Recalcule com os preços atuais. Atualize o modelo de custo com os preços padrão atuais, o uso medido e o roteamento aprovado antes de ampliar a produção.
Onde o Sonnet 5 entra em arquiteturas com agentes
O Sonnet 5 não é apenas uma melhoria de chat. Ele muda a faixa de custo viável para sandboxes governados de agentes de IA na AWS, assistentes de código no Bedrock e automações internas que eram caras ou frágeis demais com modelos anteriores.
Isso não elimina arquitetura. Agentes ainda precisam de ferramentas com escopo, credenciais restritas, memória delimitada, trilha de auditoria, comportamento de fallback e controle de custo. O modelo ficou mais forte; o modelo operacional ainda decide se o fluxo pode escalar com segurança.
Se o agente opera dentro do Slack ou em canais compartilhados, leia também o guia de fronteira de controle do Claude Tag: Claude Tag no Slack: como funciona, o que pode acessar e como adotar com segurança na AWS. O princípio é o mesmo: entenda identidade, dados, runtime e custo antes de expandir acesso.
Perguntas frequentes
O Sonnet 5 é mais barato que o Opus 5?
Seus preços Standard por token são menores. Compare também o custo por resultado aceito: novas tentativas, turnos, cache, ferramentas, escalonamentos e revisão podem mudar o resultado.
O Sonnet 5 substitui o Opus para código?
Teste ambos na sua carga. Promova Sonnet 5 onde qualidade, latência e custo atendam aos critérios de aceite; mantenha Opus 5 onde os resultados medidos justificarem.
Como o Sonnet 5 é cobrado?
A inferência Standard global custa US$2 por milhão de tokens de entrada e US$10 por milhão de tokens de saída. O roteamento regional comercial compatível custa US$2,20/US$11, e GovCloud custa US$2,40/US$12. Inclua cache e ferramentas ao estimar uma tarefa completa.
O Sonnet 5 está disponível no Canadá ou no Brasil?
Sim, pelos caminhos Runtime cross-region compatíveis descritos acima. Disponibilidade na origem não significa inferência local nem residência garantida em um único país.
Até quando essas versões ficarão disponíveis?
A AWS lista ambas como Active: Sonnet 5 foi lançado em 30 de junho de 2026, com EOL não antes de 30 de junho de 2027; Opus 5 foi lançado em 24 de julho de 2026, com EOL não antes de 24 de julho de 2027. São compromissos mínimos de ciclo de vida, não datas de desligamento.
O contexto de 1M exige configuração?
Sonnet 5 sempre usa 1M no Claude Code e não tem variante [1m]. Para contexto estendido do Opus no Invoke, selecione a variante [1m]. Ambos os model cards AWS listam saída máxima de 128K tokens.
Como a Elevata pode ajudar
Traga uma carga de trabalho real, o caminho de modelo atual e suas restrições AWS. A Elevata ajuda a comparar o Sonnet 5 contra seu fluxo, medir Opus 5 onde fizer sentido, modelar os custos atuais e revisar os controles Bedrock necessários para produção.
Próximas leituras úteis: consultoria Amazon Bedrock, otimização de custos AWS e o guia de benchmark do Opus 4.8.
Fale com a Elevata sobre uma revisão de workload com Sonnet 5.





