Google DeepMind

Gemini 3.1 Pro Preview

Tipo
modelo de linguagem
Contexto
1.049K tokens
Saída máxima
66K
Lançado em
19 fevereiro 2026
Conhecimento até
fevereiro 2026
String para a API
gemini/gemini-3.1-pro-preview

Preços por fornecedor

Fornecedor Entrada, $ por 1M Saída, $ por 1M Nos nossos dados desde
vivgrid $2 $12 31 jul 2026
daoxe $2 $12 31 jul 2026
frogbot $2 $12 31 jul 2026
auriko $2 $12 31 jul 2026
ofox $2 $12 31 jul 2026
perplexity-agent $2 $12 31 jul 2026
AIHubMix $2 $12 31 jul 2026
Abacus.AI $2 $12 31 jul 2026
CrossModel $2 $12 31 jul 2026
FastRouter $2 $12 31 jul 2026
GitHub Copilot $2 $12 31 jul 2026
Google DeepMind $2 $12 31 jul 2026
Google Vertex AI $2 $12 31 jul 2026
Kilo Code $2 $12 31 jul 2026
LLM Gateway $2 $12 31 jul 2026
Merge Gateway $2 $12 31 jul 2026
NanoGPT $2 $12 31 jul 2026
OpenRouter $2 $12 31 jul 2026
Vercel $2 $12 31 jul 2026
ZenMux $2 $12 31 jul 2026
Venice AI $2,5 $15 31 jul 2026
OrcaRouter $4 $18 31 jul 2026

É mostrada apenas a tarifa base e apenas preços por token. Tarifas em lote, reduzidas ou em cache, bem como preços por imagem ou por segundo de vídeo, não entram nesta tabela: não podem ficar na mesma coluna que um preço por milhão de tokens.

A data da última coluna é o dia em que este preço entrou pela primeira vez na nossa recolha. O preço pode ser mais antigo: antes desse dia simplesmente não o registávamos. Desde então não mudou — caso contrário, no seu lugar estaria uma linha nova com uma data nova.

Resultados das medições

Conjunto de tarefas Resultado Condições da execução Medido por
Arena Score em russo 1.495,77 1.488–1.503
Arena Score, matemática 1.489,07 1.480–1.498
Arena Score em francês 1.488,01 1.474–1.502
Arena Score, perguntas de especialista 1.486,42 1.479–1.494
Arena Score, pedidos difíceis 1.484,41 1.480–1.489
Arena Score, programação 1.483,89 1.479–1.489
Arena Score, diálogo de vários turnos 1.482,41 1.476–1.489
Arena Score, pedidos longos 1.482,3 1.477–1.487
Arena Score, escrita criativa 1.481,61 1.475–1.488
Arena Score em espanhol 1.479,93 1.467–1.493
Arena Score, geral 1.479,46 1.476–1.483
Arena Score em inglês 1.478,03 1.474–1.483
Arena Score, seguimento de instruções 1.467,43 1.462–1.473
Arena Score, desenvolvimento web 1.446,83 1.441–1.452
Arena Score, compreensão de esquemas 1.312,53 1.305–1.320
Arena Score, reconhecimento de texto em imagem 1.305,79 1.300–1.311
Arena Score, trabalho com imagens 1.295,15 1.289–1.301
ARC-AGI — generalização para padrões novos 98 % · com estrutura ajustada ARC Prize Leaderboard
Mock AIME 2024–2025 — problemas de olimpíada 95,6 % · com estrutura ajustada Epoch evaluations
GPQA Diamond — perguntas de nível de pós-graduação 92,13 % · com estrutura ajustada Epoch evaluations
Terminal-Bench — trabalho na linha de comandos 80,2 % · com estrutura ajustada https://www.tbench.ai/leaderboard/terminal-bench/2.0
SimpleQA Verified — exatidão factual 77,3 % Epoch evaluations
ARC-AGI-2 77,1 %
SimpleBench — perguntas capciosas 75,52 % SimpleBench Leaderboard
WeirdML — tarefas incomuns de aprendizagem automática 72,1 % WeirdML Leaderboard
FrontierMath, níveis 1–3 59,65 % Epoch evaluations
BALROG — ambientes de jogo 57 % Balrog Leaderboard
Problemas de xadrez 52,65 % Epoch evaluations
Humanity’s Last Exam — perguntas de nível especialista 43,74 %
APEX-Agents 33,5 %
FrontierMath, nível 4 — problemas de investigação 26,83 % Epoch evaluations
GSO-Bench — otimização de código 22,55 % https://gso-bench.github.io/index.html
CritPt — problemas de física 17,71 %
Arena Score, tarefas de agente -0,01 0–0