Anthropic

Claude 4.5 Opus

Tipo
modelo de linguagem
Contexto
200K tokens
Saída máxima
32K
Lançado em
1 novembro 2025
Conhecimento até
março 2025
String para a API
claude-opus-4-5-20251101

Preços por fornecedor

Fornecedor Entrada, $ por 1M Saída, $ por 1M Nos nossos dados desde
qihang-ai $0,71 $3,57 31 jul 2026
Jiekou.AI $4,5 $22,5 31 jul 2026
NanoGPT $4,998 $25,007 31 jul 2026
302.AI $5 $25 31 jul 2026
Abacus.AI $5 $25 31 jul 2026
Amazon Bedrock anthropic.claude-opus-4-5-20251101-v1:0 $5 $25 2 ago 2026
Anthropic $5 $25 31 jul 2026
LLM Gateway $5 $25 31 jul 2026
Merge Gateway $5 $25 31 jul 2026
Amazon Bedrock eu.anthropic.claude-opus-4-5-20251101-v1:0 $5,5 $27,5 2 ago 2026

É mostrada apenas a tarifa base e apenas preços por token. Tarifas em lote, reduzidas ou em cache, bem como preços por imagem ou por segundo de vídeo, não entram nesta tabela: não podem ficar na mesma coluna que um preço por milhão de tokens.

Um mesmo fornecedor aparece várias vezes se vende este modelo com identificadores diferentes e a preços diferentes — por exemplo, com precisão de pesos diferente. O identificador é indicado ao lado do nome. As ofertas idênticas vindas de duas fontes com grafias diferentes são reunidas numa única linha.

A data da última coluna é o dia em que este preço entrou pela primeira vez na nossa recolha. O preço pode ser mais antigo: antes desse dia simplesmente não o registávamos. Desde então não mudou — caso contrário, no seu lugar estaria uma linha nova com uma data nova.

Resultados das medições

Conjunto de tarefas Resultado Condições da execução Medido por
Arena Score, programação 1.498,02 1.493–1.503
Arena Score, perguntas de especialista 1.486,32 1.477–1.495
Arena Score, pedidos longos 1.478,41 1.473–1.483
Arena Score em francês 1.477,28 1.461–1.493
Arena Score, pedidos difíceis 1.474,98 1.471–1.479
Arena Score, seguimento de instruções 1.471,36 1.466–1.476
Arena Score, desenvolvimento web 1.466,99 1.460–1.474
Arena Score, diálogo de vários turnos 1.464,55 1.458–1.471
Arena Score em inglês 1.460,01 1.456–1.464
Arena Score, matemática 1.459,45 1.450–1.469
Arena Score em espanhol 1.453,21 1.438–1.468
Arena Score, geral 1.449,24 1.446–1.452
Arena Score em russo 1.446,81 1.439–1.454
Arena Score, escrita criativa 1.440,86 1.434–1.447
Mock AIME 2024–2025 — problemas de olimpíada 86,1 % · com estrutura ajustada Epoch evaluations
Cybench — tarefas de cibersegurança 82 % · com estrutura ajustada Opus 4.5 System Card autorrelatado
GPQA Diamond — perguntas de nível de pós-graduação 81,4 % orçamento de raciocínio: 16K · com estrutura ajustada Epoch evaluations
ARC-AGI — generalização para padrões novos 80 % orçamento de raciocínio: 64K · com estrutura ajustada ARC Prize Leaderboard
SWE-bench Verified — correção de erros em repositórios 76,65 % · com estrutura ajustada Epoch evaluations
GeoBench — localização de um lugar a partir de uma foto 75 % GeoBench leaderboard
OSWorld — trabalho num sistema operativo, primeira versão 66,3 % · com estrutura ajustada Anthropic annoucement autorrelatado
WeirdML — tarefas incomuns de aprendizagem automática 63,7 % orçamento de raciocínio: 16K WeirdML Leaderboard
Terminal-Bench — trabalho na linha de comandos 63,1 % · com estrutura ajustada Terminal-Bench v2 Leaderboard
SimpleBench — perguntas capciosas 54,4 % SimpleBench Leaderboard
GDPval — tarefas de profissões reais 45,5 %
BALROG — ambientes de jogo 43,5 % Balrog Leaderboard
SimpleQA Verified — exatidão factual 41,8 % orçamento de raciocínio: 32K Epoch evaluations
ARC-AGI-2 37,64 % orçamento de raciocínio: 64K
FrontierMath, níveis 1–3 34,39 % orçamento de raciocínio: 32K Epoch evaluations
GSO-Bench — otimização de código 26,5 % GSO Leaderboard
Humanity’s Last Exam — perguntas de nível especialista 21,43 %
APEX-Agents 20,7 %
Problemas de xadrez 7,41 % orçamento de raciocínio: 32K Epoch evaluations
FrontierMath, nível 4 — problemas de investigação 4,88 % orçamento de raciocínio: 32K Epoch evaluations
Remote Labor Index — trabalhos de uma plataforma de freelance 3,75 %