Anthropic

Claude Sonnet 4.5

Tipo
modelo de linguagem
Contexto
1.000K tokens
Saída máxima
64K
Lançado em
29 setembro 2025
Conhecimento até
julho 2025
String para a API
claude-sonnet-4-5-20250929

Preços por fornecedor

Fornecedor Entrada, $ por 1M Saída, $ por 1M Nos nossos dados desde
qihang-ai $0,43 $2,14 31 jul 2026
Jiekou.AI $2,7 $13,5 31 jul 2026
NanoGPT $2,992 $14,994 31 jul 2026
302.AI $3 $15 31 jul 2026
Abacus.AI $3 $15 31 jul 2026
Amazon Bedrock anthropic.claude-sonnet-4-5-20250929-v1:0 $3 $15 2 ago 2026
Anthropic $3 $15 31 jul 2026
Helicone $3 $15 31 jul 2026
LLM Gateway $3 $15 31 jul 2026
Merge Gateway $3 $15 31 jul 2026
Amazon Bedrock eu.anthropic.claude-sonnet-4-5-20250929-v1:0 $3,3 $16,5 2 ago 2026
Amazon Bedrock bedrock/us-gov-east-1/anthropic.claude-sonnet-4-5-20250929-v1:0 $3,6 $18 2 ago 2026

É mostrada apenas a tarifa base e apenas preços por token. Tarifas em lote, reduzidas ou em cache, bem como preços por imagem ou por segundo de vídeo, não entram nesta tabela: não podem ficar na mesma coluna que um preço por milhão de tokens.

Um mesmo fornecedor aparece várias vezes se vende este modelo com identificadores diferentes e a preços diferentes — por exemplo, com precisão de pesos diferente. O identificador é indicado ao lado do nome. As ofertas idênticas vindas de duas fontes com grafias diferentes são reunidas numa única linha.

A data da última coluna é o dia em que este preço entrou pela primeira vez na nossa recolha. O preço pode ser mais antigo: antes desse dia simplesmente não o registávamos. Desde então não mudou — caso contrário, no seu lugar estaria uma linha nova com uma data nova.

Resultados das medições

Conjunto de tarefas Resultado Condições da execução Medido por
Arena Score, programação 1.485,37 1.480–1.490
Arena Score, pedidos longos 1.476,02 1.471–1.481
Arena Score, perguntas de especialista 1.472,22 1.464–1.481
Arena Score, diálogo de vários turnos 1.464,84 1.459–1.471
Arena Score, pedidos difíceis 1.461,7 1.458–1.465
Arena Score, seguimento de instruções 1.458,64 1.454–1.463
Arena Score em francês 1.457,25 1.441–1.473
Arena Score em espanhol 1.455,76 1.442–1.470
Arena Score em inglês 1.451,19 1.447–1.455
Arena Score, escrita criativa 1.440,99 1.435–1.447
Arena Score, geral 1.437,78 1.435–1.441
Arena Score em russo 1.435,09 1.428–1.442
Arena Score, matemática 1.421,66 1.413–1.430
Arena Score, desenvolvimento web 1.385,13 1.378–1.392
MATH, nível de dificuldade cinco 97,73 % orçamento de raciocínio: 32K · com estrutura ajustada Epoch evaluations
Mock AIME 2024–2025 — problemas de olimpíada 77,76 % orçamento de raciocínio: 59K · com estrutura ajustada Epoch evaluations
GPQA Diamond — perguntas de nível de pós-graduação 76,43 % orçamento de raciocínio: 16K · com estrutura ajustada Epoch evaluations
SWE-bench Verified — correção de erros em repositórios 71,28 % · com estrutura ajustada Epoch evaluations
ARC-AGI — generalização para padrões novos 63,67 % orçamento de raciocínio: 32K · com estrutura ajustada
OSWorld — trabalho num sistema operativo, primeira versão 62,9 % · com estrutura ajustada OS World Website
Cybench — tarefas de cibersegurança 60 % · com estrutura ajustada Opus 4.5 System Card autorrelatado
DeepResearch Bench — pesquisa aprofundada 52,6 % orçamento de raciocínio: 2K DeepResearchBench Leaderboard
WeirdML — tarefas incomuns de aprendizagem automática 47,71 % orçamento de raciocínio: 16K WeirdML Leaderboard
Terminal-Bench — trabalho na linha de comandos 46,5 % · com estrutura ajustada Terminal-Bench v2 Leaderboard
SimpleBench — perguntas capciosas 45,16 % orçamento de raciocínio: 12K SimpleBench Leaderboard
GDPval — tarefas de profissões reais 42,5 %
FrontierMath, níveis 1–3 23,86 % orçamento de raciocínio: 32K Epoch evaluations
SimpleQA Verified — exatidão factual 23,6 % orçamento de raciocínio: 59K Epoch evaluations
GSO-Bench — otimização de código 14,71 % GSO Leaderboard
ARC-AGI-2 13,61 % orçamento de raciocínio: 32K
Humanity’s Last Exam — perguntas de nível especialista 9,37 %
Problemas de xadrez 7,41 % orçamento de raciocínio: 32K Epoch evaluations
FrontierMath, nível 4 — problemas de investigação 2,44 % orçamento de raciocínio: 32K Epoch evaluations
Remote Labor Index — trabalhos de uma plataforma de freelance 2,08 %
CritPt — problemas de física 1,14 %