Anthropic

Claude 3.5 Haiku

Tipo
modelo de linguagem
Contexto
200K tokens
Saída máxima
8K
Lançado em
22 outubro 2024
Conhecimento até
julho 2024
String para a API
claude-3-5-haiku-20241022

Preços por fornecedor

Fornecedor Entrada, $ por 1M Saída, $ por 1M Nos nossos dados desde
Amazon Bedrock eu.anthropic.claude-3-5-haiku-20241022-v1:0 $0,25 $1,25 2 ago 2026
302.AI $0,8 $4 1 ago 2026
Amazon Bedrock anthropic.claude-3-5-haiku-20241022-v1:0 $0,8 $4 2 ago 2026
NanoGPT $0,8 $4 1 ago 2026

É mostrada apenas a tarifa base e apenas preços por token. Tarifas em lote, reduzidas ou em cache, bem como preços por imagem ou por segundo de vídeo, não entram nesta tabela: não podem ficar na mesma coluna que um preço por milhão de tokens.

Um mesmo fornecedor aparece várias vezes se vende este modelo com identificadores diferentes e a preços diferentes — por exemplo, com precisão de pesos diferente. O identificador é indicado ao lado do nome. As ofertas idênticas vindas de duas fontes com grafias diferentes são reunidas numa única linha.

A data da última coluna é o dia em que este preço entrou pela primeira vez na nossa recolha. O preço pode ser mais antigo: antes desse dia simplesmente não o registávamos. Desde então não mudou — caso contrário, no seu lugar estaria uma linha nova com uma data nova.

Resultados das medições

Conjunto de tarefas Resultado Condições da execução Medido por
Arena Score, programação 1.286,65 1.281–1.293
Arena Score em inglês 1.268,85 1.265–1.273
Arena Score, diálogo de vários turnos 1.264,76 1.259–1.271
Arena Score em francês 1.261,9 1.239–1.285
Arena Score, pedidos longos 1.260,29 1.254–1.266
Arena Score, geral 1.255,44 1.252–1.259
Arena Score em russo 1.252,79 1.245–1.260
Arena Score em espanhol 1.251,6 1.231–1.272
Arena Score, pedidos difíceis 1.251 1.246–1.256
Arena Score, matemática 1.244,48 1.237–1.252
Arena Score, seguimento de instruções 1.240,64 1.236–1.245
Arena Score, escrita criativa 1.232,59 1.226–1.239
Arena Score, perguntas de especialista 1.207,2 1.197–1.218
Arena Score, trabalho com imagens 1.092,78 1.077–1.109
Arena Score, reconhecimento de texto em imagem 1.089,62 1.070–1.109
Arena Score, compreensão de esquemas 1.079,26 1.047–1.112
Escrita criativa (avaliação de Lech Mazur) 73,5 % lechmazur/writing Github repository
MATH, nível de dificuldade cinco 46,36 % · com estrutura ajustada Epoch evaluations
GeoBench — localização de um lugar a partir de uma foto 34 % GeoBench leaderboard
CadEval — construção de modelos CAD por código 32 % CadEval Dashboard
WeirdML — tarefas incomuns de aprendizagem automática 30,73 % WeirdML Leaderboard
Aider Polyglot — edições de código em seis linguagens 28 % · com estrutura ajustada Aider LLM Leaderboards
BALROG — ambientes de jogo 19,3 % Balrog Leaderboard
GPQA Diamond — perguntas de nível de pós-graduação 17,51 % · com estrutura ajustada Epoch evaluations
SimpleQA Verified — exatidão factual 6,7 % Epoch evaluations
Mock AIME 2024–2025 — problemas de olimpíada 4,21 % · com estrutura ajustada Epoch evaluations
CritPt — problemas de física 0 %