google/gemini-3-pro-preview| Fornecedor | Entrada, $ por 1M | Saída, $ por 1M | Nos nossos dados desde |
|---|---|---|---|
| qihang-ai | $0,57 | $3,43 | 31 jul 2026 |
| Jiekou.AI | $1,8 | $10,8 | 31 jul 2026 |
| gmi | $2 | $12 | 31 jul 2026 |
| 302.AI | $2 | $12 | 31 jul 2026 |
| Google DeepMind | $2 | $12 | 31 jul 2026 |
| Google Vertex AI | $2 | $12 | 31 jul 2026 |
| Helicone | $2 | $12 | 31 jul 2026 |
| Merge Gateway | $2 | $12 | 31 jul 2026 |
| OpenRouter | $2 | $12 | 31 jul 2026 |
| Requesty | $2 | $12 | 31 jul 2026 |
| OrcaRouter | $4 | $18 | 31 jul 2026 |
É mostrada apenas a tarifa base e apenas preços por token. Tarifas em lote, reduzidas ou em cache, bem como preços por imagem ou por segundo de vídeo, não entram nesta tabela: não podem ficar na mesma coluna que um preço por milhão de tokens.
A data da última coluna é o dia em que este preço entrou pela primeira vez na nossa recolha. O preço pode ser mais antigo: antes desse dia simplesmente não o registávamos. Desde então não mudou — caso contrário, no seu lugar estaria uma linha nova com uma data nova.
| Conjunto de tarefas | Resultado | Condições da execução | Medido por |
|---|---|---|---|
| Mock AIME 2024–2025 — problemas de olimpíada | 91,38 % | · com estrutura ajustada | Epoch evaluations |
| GPQA Diamond — perguntas de nível de pós-graduação | 90,15 % | · com estrutura ajustada | Epoch evaluations |
| GeoBench — localização de um lugar a partir de uma foto | 84 % | — | GeoBench leaderboard |
| ARC-AGI — generalização para padrões novos | 75 % | · com estrutura ajustada | ARC Prize Leaderboard |
| SWE-bench Verified — correção de erros em repositórios | 72,93 % | · com estrutura ajustada | Epoch evaluations |
| SimpleQA Verified — exatidão factual | 72,9 % | — | Epoch evaluations |
| SimpleBench — perguntas capciosas | 71,68 % | — | SimpleBench Leaderboard |
| WeirdML — tarefas incomuns de aprendizagem automática | 69,93 % | — | WeirdML Leaderboard |
| Terminal-Bench — trabalho na linha de comandos | 69,4 % | · com estrutura ajustada | https://www.tbench.ai/leaderboard/terminal-bench/2.0 |
| BALROG — ambientes de jogo | 58,1 % | — | Balrog Leaderboard |
| GDPval — tarefas de profissões reais | 40,3 % | — | — |
| Humanity’s Last Exam — perguntas de nível especialista | 34,37 % | — | — |
| APEX-Agents | 31,5 % | — | — |
| ARC-AGI-2 | 31,11 % | — | — |
| Problemas de xadrez | 27,4 % | — | Epoch evaluations |
| GSO-Bench — otimização de código | 18,6 % | — | GSO Leaderboard |
| CritPt — problemas de física | 6,9 % | — | — |
| Remote Labor Index — trabalhos de uma plataforma de freelance | 1,25 % | — | — |