llama-3.1-405b-instruct| Fornecedor | Entrada, $ por 1M | Saída, $ por 1M | Nos nossos dados desde |
|---|---|---|---|
| Hyperbolic | $0,12 | $0,3 | 1 ago 2026 |
| Nebius Token Factory | $1 | $3 | 1 ago 2026 |
| Google Vertex AI | $5 | $16 | 31 jul 2026 |
| SambaNova | $5 | $10 | 1 ago 2026 |
| Databricks | $5 | $15 | 1 ago 2026 |
| Amazon Bedrock | $5,32 | $16 | 2 ago 2026 |
| Microsoft Foundry | $5,33 | $16 | 1 ago 2026 |
| OCI Generative AI | $10,68 | $10,68 | 31 jul 2026 |
É mostrada apenas a tarifa base e apenas preços por token. Tarifas em lote, reduzidas ou em cache, bem como preços por imagem ou por segundo de vídeo, não entram nesta tabela: não podem ficar na mesma coluna que um preço por milhão de tokens.
A data da última coluna é o dia em que este preço entrou pela primeira vez na nossa recolha. O preço pode ser mais antigo: antes desse dia simplesmente não o registávamos. Desde então não mudou — caso contrário, no seu lugar estaria uma linha nova com uma data nova.
| Conjunto de tarefas | Resultado | Condições da execução | Medido por |
|---|---|---|---|
| Arena Score em inglês | 1.308,06 1.303–1.313 | — | — |
| Arena Score, diálogo de vários turnos | 1.287,34 1.280–1.295 | — | — |
| Arena Score, programação | 1.284 1.277–1.291 | — | — |
| Arena Score, geral | 1.281,97 1.278–1.286 | — | — |
| Arena Score, matemática | 1.278,23 1.270–1.286 | — | — |
| Arena Score em francês | 1.269,69 1.242–1.297 | — | — |
| Arena Score, pedidos difíceis | 1.263,75 1.258–1.270 | — | — |
| Arena Score, escrita criativa | 1.260,14 1.253–1.268 | — | — |
| Arena Score, pedidos longos | 1.259,79 1.252–1.267 | — | — |
| Arena Score, seguimento de instruções | 1.259,06 1.254–1.264 | — | — |
| Arena Score em russo | 1.255,23 1.247–1.264 | — | — |
| Arena Score em espanhol | 1.252,29 1.227–1.277 | — | — |
| Arena Score, perguntas de especialista | 1.228,55 1.216–1.241 | — | — |
| MATH, nível de dificuldade cinco | 49,77 % | · com estrutura ajustada | Epoch evaluations |
| GPQA Diamond — perguntas de nível de pós-graduação | 34,55 % | · com estrutura ajustada | Epoch evaluations |
| WeirdML — tarefas incomuns de aprendizagem automática | 21,38 % | — | WeirdML Leaderboard |
| Mock AIME 2024–2025 — problemas de olimpíada | 9,63 % | · com estrutura ajustada | Epoch evaluations |
| SimpleBench — perguntas capciosas | 7,6 % | — | SimpleBench Leaderboard |
| Cybench — tarefas de cibersegurança | 7,5 % | · com estrutura ajustada | Cybench leaderboard |
| The Agent Company — tarefas de trabalho num ambiente de escritório | 7,4 % | — | TheAgentCompany experiment results github |