Anthropic

Claude Sonnet 3.7

Tipo
modelo de linguagem
Contexto
200K tokens
Saída máxima
64K
Lançado em
19 fevereiro 2025
Conhecimento até
outubro 2024
String para a API
claude-3-7-sonnet-20250219

Preços por fornecedor

Fornecedor Entrada, $ por 1M Saída, $ por 1M Nos nossos dados desde
Abacus.AI $3 $15 1 ago 2026
Amazon Bedrock anthropic.claude-3-7-sonnet-20250219-v1:0 $3 $15 2 ago 2026
Anthropic $3 $15 1 ago 2026
Merge Gateway $3 $15 1 ago 2026
Amazon Bedrock bedrock/us-gov-west-1/anthropic.claude-3-7-sonnet-20250219-v1:0 $3,6 $18 2 ago 2026

É mostrada apenas a tarifa base e apenas preços por token. Tarifas em lote, reduzidas ou em cache, bem como preços por imagem ou por segundo de vídeo, não entram nesta tabela: não podem ficar na mesma coluna que um preço por milhão de tokens.

Um mesmo fornecedor aparece várias vezes se vende este modelo com identificadores diferentes e a preços diferentes — por exemplo, com precisão de pesos diferente. O identificador é indicado ao lado do nome. As ofertas idênticas vindas de duas fontes com grafias diferentes são reunidas numa única linha.

A data da última coluna é o dia em que este preço entrou pela primeira vez na nossa recolha. O preço pode ser mais antigo: antes desse dia simplesmente não o registávamos. Desde então não mudou — caso contrário, no seu lugar estaria uma linha nova com uma data nova.

Resultados das medições

Conjunto de tarefas Resultado Condições da execução Medido por
Arena Score, pedidos longos 1.354,73 1.347–1.362
Arena Score, programação 1.338,88 1.331–1.346
Arena Score, diálogo de vários turnos 1.338,32 1.331–1.346
Arena Score, seguimento de instruções 1.325,19 1.319–1.331
Arena Score, matemática 1.318,41 1.308–1.328
Arena Score, escrita criativa 1.316,76 1.309–1.325
Arena Score, pedidos difíceis 1.315,07 1.309–1.321
Arena Score em inglês 1.311,02 1.306–1.316
Arena Score em russo 1.309,67 1.299–1.320
Arena Score em francês 1.302,75 1.275–1.330
Arena Score, perguntas de especialista 1.300,32 1.287–1.313
Arena Score, geral 1.299,32 1.295–1.303
Arena Score em espanhol 1.289,11 1.263–1.315
Arena Score, reconhecimento de texto em imagem 1.158,07 1.139–1.177
Arena Score, compreensão de esquemas 1.151,01 1.119–1.183
Arena Score, trabalho com imagens 1.151 1.142–1.160
MATH, nível de dificuldade cinco 91,16 % orçamento de raciocínio: 64K · com estrutura ajustada Epoch evaluations
Fiction.LiveBench — retenção de contexto longo 83,3 % Fiction.live leaderboard
Escrita criativa (avaliação de Lech Mazur) 81,1 % orçamento de raciocínio: 16K lechmazur/writing Github repository
GPQA Diamond — perguntas de nível de pós-graduação 72,98 % orçamento de raciocínio: 64K · com estrutura ajustada Epoch evaluations
GeoBench — localização de um lugar a partir de uma foto 68 % orçamento de raciocínio: 15K GeoBench leaderboard
Aider Polyglot — edições de código em seis linguagens 64,9 % · com estrutura ajustada Aider LLM Leaderboards
SWE-bench Verified — correção de erros em repositórios 60,95 % · com estrutura ajustada Epoch evaluations
Mock AIME 2024–2025 — problemas de olimpíada 57,74 % orçamento de raciocínio: 64K · com estrutura ajustada Epoch evaluations
CadEval — construção de modelos CAD por código 54 % CadEval Dashboard
DeepResearch Bench — pesquisa aprofundada 43,6 % orçamento de raciocínio: 2K DeepResearchBench Leaderboard
OSWorld — trabalho num sistema operativo, primeira versão 35,8 % · com estrutura ajustada OS World Website
SimpleBench — perguntas capciosas 35,68 % orçamento de raciocínio: 12K SimpleBench Leaderboard
The Agent Company — tarefas de trabalho num ambiente de escritório 30,9 % TheAgentCompany leaderboard
ARC-AGI — generalização para padrões novos 28,6 % orçamento de raciocínio: 16K · com estrutura ajustada ARC Prize Leaderboard
Cybench — tarefas de cibersegurança 20 % · com estrutura ajustada Cybench leaderboard
GSO-Bench — otimização de código 3,8 % GSO Leaderboard
Humanity’s Last Exam — perguntas de nível especialista 3,4 %
ARC-AGI-2 0,9 % orçamento de raciocínio: 8K