gemini/gemini-3.1-pro-preview| Fornecedor | Entrada, $ por 1M | Saída, $ por 1M | Nos nossos dados desde |
|---|---|---|---|
| vivgrid | $2 | $12 | 31 jul 2026 |
| daoxe | $2 | $12 | 31 jul 2026 |
| frogbot | $2 | $12 | 31 jul 2026 |
| auriko | $2 | $12 | 31 jul 2026 |
| ofox | $2 | $12 | 31 jul 2026 |
| perplexity-agent | $2 | $12 | 31 jul 2026 |
| AIHubMix | $2 | $12 | 31 jul 2026 |
| Abacus.AI | $2 | $12 | 31 jul 2026 |
| CrossModel | $2 | $12 | 31 jul 2026 |
| FastRouter | $2 | $12 | 31 jul 2026 |
| GitHub Copilot | $2 | $12 | 31 jul 2026 |
| Google DeepMind | $2 | $12 | 31 jul 2026 |
| Google Vertex AI | $2 | $12 | 31 jul 2026 |
| Kilo Code | $2 | $12 | 31 jul 2026 |
| LLM Gateway | $2 | $12 | 31 jul 2026 |
| Merge Gateway | $2 | $12 | 31 jul 2026 |
| NanoGPT | $2 | $12 | 31 jul 2026 |
| OpenRouter | $2 | $12 | 31 jul 2026 |
| Vercel | $2 | $12 | 31 jul 2026 |
| ZenMux | $2 | $12 | 31 jul 2026 |
| Venice AI | $2,5 | $15 | 31 jul 2026 |
| OrcaRouter | $4 | $18 | 31 jul 2026 |
É mostrada apenas a tarifa base e apenas preços por token. Tarifas em lote, reduzidas ou em cache, bem como preços por imagem ou por segundo de vídeo, não entram nesta tabela: não podem ficar na mesma coluna que um preço por milhão de tokens.
A data da última coluna é o dia em que este preço entrou pela primeira vez na nossa recolha. O preço pode ser mais antigo: antes desse dia simplesmente não o registávamos. Desde então não mudou — caso contrário, no seu lugar estaria uma linha nova com uma data nova.
| Conjunto de tarefas | Resultado | Condições da execução | Medido por |
|---|---|---|---|
| Arena Score em russo | 1.495,77 1.488–1.503 | — | — |
| Arena Score, matemática | 1.489,07 1.480–1.498 | — | — |
| Arena Score em francês | 1.488,01 1.474–1.502 | — | — |
| Arena Score, perguntas de especialista | 1.486,42 1.479–1.494 | — | — |
| Arena Score, pedidos difíceis | 1.484,41 1.480–1.489 | — | — |
| Arena Score, programação | 1.483,89 1.479–1.489 | — | — |
| Arena Score, diálogo de vários turnos | 1.482,41 1.476–1.489 | — | — |
| Arena Score, pedidos longos | 1.482,3 1.477–1.487 | — | — |
| Arena Score, escrita criativa | 1.481,61 1.475–1.488 | — | — |
| Arena Score em espanhol | 1.479,93 1.467–1.493 | — | — |
| Arena Score, geral | 1.479,46 1.476–1.483 | — | — |
| Arena Score em inglês | 1.478,03 1.474–1.483 | — | — |
| Arena Score, seguimento de instruções | 1.467,43 1.462–1.473 | — | — |
| Arena Score, desenvolvimento web | 1.446,83 1.441–1.452 | — | — |
| Arena Score, compreensão de esquemas | 1.312,53 1.305–1.320 | — | — |
| Arena Score, reconhecimento de texto em imagem | 1.305,79 1.300–1.311 | — | — |
| Arena Score, trabalho com imagens | 1.295,15 1.289–1.301 | — | — |
| ARC-AGI — generalização para padrões novos | 98 % | · com estrutura ajustada | ARC Prize Leaderboard |
| Mock AIME 2024–2025 — problemas de olimpíada | 95,6 % | · com estrutura ajustada | Epoch evaluations |
| GPQA Diamond — perguntas de nível de pós-graduação | 92,13 % | · com estrutura ajustada | Epoch evaluations |
| Terminal-Bench — trabalho na linha de comandos | 80,2 % | · com estrutura ajustada | https://www.tbench.ai/leaderboard/terminal-bench/2.0 |
| SimpleQA Verified — exatidão factual | 77,3 % | — | Epoch evaluations |
| ARC-AGI-2 | 77,1 % | — | — |
| SimpleBench — perguntas capciosas | 75,52 % | — | SimpleBench Leaderboard |
| WeirdML — tarefas incomuns de aprendizagem automática | 72,1 % | — | WeirdML Leaderboard |
| FrontierMath, níveis 1–3 | 59,65 % | — | Epoch evaluations |
| BALROG — ambientes de jogo | 57 % | — | Balrog Leaderboard |
| Problemas de xadrez | 52,65 % | — | Epoch evaluations |
| Humanity’s Last Exam — perguntas de nível especialista | 43,74 % | — | — |
| APEX-Agents | 33,5 % | — | — |
| FrontierMath, nível 4 — problemas de investigação | 26,83 % | — | Epoch evaluations |
| GSO-Bench — otimização de código | 22,55 % | — | https://gso-bench.github.io/index.html |
| CritPt — problemas de física | 17,71 % | — | — |
| Arena Score, tarefas de agente | -0,01 0–0 | — | — |