Anthropic

Claude 3 Opus 2024-02-29

Tipo
modelo de linguagem
Contexto
200K tokens
Saída máxima
4K
String para a API
claude-3-opus-20240229

O fornecedor declarou este modelo obsoleto. Ainda responde, mas é melhor não iniciar projetos novos com ele.

Preços por fornecedor

Fornecedor Entrada, $ por 1M Saída, $ por 1M Nos nossos dados desde
Amazon Bedrock $15 $75 2 ago 2026
Anthropic $15 $75 1 ago 2026

É mostrada apenas a tarifa base e apenas preços por token. Tarifas em lote, reduzidas ou em cache, bem como preços por imagem ou por segundo de vídeo, não entram nesta tabela: não podem ficar na mesma coluna que um preço por milhão de tokens.

A data da última coluna é o dia em que este preço entrou pela primeira vez na nossa recolha. O preço pode ser mais antigo: antes desse dia simplesmente não o registávamos. Desde então não mudou — caso contrário, no seu lugar estaria uma linha nova com uma data nova.

Resultados das medições

Conjunto de tarefas Resultado Condições da execução Medido por
Arena Score em russo 1.279,06 1.272–1.286
Arena Score, diálogo de vários turnos 1.275,39 1.269–1.281
Arena Score em francês 1.273,88 1.255–1.293
Arena Score, matemática 1.272,58 1.266–1.279
Arena Score, programação 1.264,67 1.259–1.271
Arena Score em inglês 1.262,98 1.259–1.267
Arena Score, geral 1.262,17 1.259–1.265
Arena Score, pedidos longos 1.259,32 1.253–1.266
Arena Score, seguimento de instruções 1.248,74 1.244–1.253
Arena Score, pedidos difíceis 1.245,74 1.241–1.251
Arena Score em espanhol 1.245,51 1.227–1.264
Arena Score, escrita criativa 1.235,21 1.229–1.242
Arena Score, perguntas de especialista 1.222,21 1.213–1.232
Arena Score, trabalho com imagens 1.023,06 1.013–1.033
MATH, nível de dificuldade cinco 37,48 % · com estrutura ajustada Epoch evaluations
GPQA Diamond — perguntas de nível de pós-graduação 29,55 % · com estrutura ajustada Epoch evaluations
WeirdML — tarefas incomuns de aprendizagem automática 23,18 % WeirdML Leaderboard
Cybench — tarefas de cibersegurança 10 % · com estrutura ajustada Cybench leaderboard
SimpleBench — perguntas capciosas 8,2 % SimpleBench Leaderboard
Mock AIME 2024–2025 — problemas de olimpíada 4,63 % · com estrutura ajustada Epoch evaluations
Problemas de xadrez 0,04 % Epoch evaluations