xai/grok-3-mini| Fornecedor | Entrada, $ por 1M | Saída, $ por 1M | Nos nossos dados desde |
|---|---|---|---|
| Microsoft Foundry | $0,25 | $1,27 | 31 jul 2026 |
| vercel_ai_gateway | $0,3 | $0,5 | 31 jul 2026 |
| Helicone | $0,3 | $0,5 | 31 jul 2026 |
| OCI Generative AI | $0,3 | $0,5 | 31 jul 2026 |
| Poe | $0,3 | $0,5 | 31 jul 2026 |
| xAI | $0,3 | $0,5 | 31 jul 2026 |
É mostrada apenas a tarifa base e apenas preços por token. Tarifas em lote, reduzidas ou em cache, bem como preços por imagem ou por segundo de vídeo, não entram nesta tabela: não podem ficar na mesma coluna que um preço por milhão de tokens.
A data da última coluna é o dia em que este preço entrou pela primeira vez na nossa recolha. O preço pode ser mais antigo: antes desse dia simplesmente não o registávamos. Desde então não mudou — caso contrário, no seu lugar estaria uma linha nova com uma data nova.
| Conjunto de tarefas | Resultado | Condições da execução | Medido por |
|---|---|---|---|
| Arena Score em inglês | 1.373,29 1.367–1.380 | — | — |
| Arena Score, matemática | 1.370,22 1.356–1.384 | — | — |
| Arena Score, programação | 1.366,03 1.357–1.375 | — | — |
| Arena Score, pedidos difíceis | 1.363,32 1.357–1.370 | — | — |
| Arena Score, geral | 1.362,74 1.358–1.368 | — | — |
| Arena Score, perguntas de especialista | 1.360,62 1.344–1.378 | — | — |
| Arena Score, pedidos longos | 1.356,9 1.348–1.366 | — | — |
| Arena Score em espanhol | 1.355,7 1.322–1.390 | esforço: high | — |
| Arena Score em francês | 1.352,74 1.308–1.398 | esforço: high | — |
| Arena Score em russo | 1.350,69 1.335–1.366 | — | — |
| Arena Score, diálogo de vários turnos | 1.349,13 1.340–1.359 | — | — |
| Arena Score, seguimento de instruções | 1.345,63 1.338–1.354 | — | — |
| Arena Score, escrita criativa | 1.330,28 1.317–1.343 | esforço: high | — |
| MATH, nível de dificuldade cinco | 90,94 % | esforço: low · com estrutura ajustada | Epoch evaluations |
| Mock AIME 2024–2025 — problemas de olimpíada | 77,76 % | esforço: low · com estrutura ajustada | Epoch evaluations |
| Escrita criativa (avaliação de Lech Mazur) | 73,5 % | esforço: low | lechmazur/writing Github repository |
| GPQA Diamond — perguntas de nível de pós-graduação | 68,35 % | esforço: high · com estrutura ajustada | Epoch evaluations |
| Fiction.LiveBench — retenção de contexto longo | 66,7 % | esforço: medium | Fiction.live leaderboard |
| Aider Polyglot — edições de código em seis linguagens | 49,3 % | esforço: low · com estrutura ajustada | Aider LLM Leaderboards |
| WeirdML — tarefas incomuns de aprendizagem automática | 42,58 % | esforço: high | WeirdML Leaderboard |
| SimpleQA Verified — exatidão factual | 21,1 % | esforço: high | Epoch evaluations |
| ARC-AGI — generalização para padrões novos | 16,5 % | esforço: low · com estrutura ajustada | ARC Prize Leaderboard |
| ARC-AGI-2 | 0,42 % | esforço: low | — |