Google DeepMind

Gemini 3 Flash Preview

Tipo
modelo de linguagem
Contexto
1.049K tokens
Saída máxima
66K
Lançado em
17 dezembro 2025
Conhecimento até
janeiro 2025
String para a API
google/gemini-3-flash-preview

Preços por fornecedor

Fornecedor Entrada, $ por 1M Saída, $ por 1M Nos nossos dados desde
qihang-ai $0,07 $0,43 31 jul 2026
frogbot $0,5 $3 31 jul 2026
perplexity-agent $0,5 $3 31 jul 2026
gmi $0,5 $3 31 jul 2026
302.AI $0,5 $3 31 jul 2026
AIHubMix $0,5 $3 31 jul 2026
Abacus.AI $0,5 $3 31 jul 2026
CrossModel $0,5 $3 31 jul 2026
GitHub Copilot $0,5 $3 31 jul 2026
Google DeepMind $0,5 $3 31 jul 2026
Google Vertex AI $0,5 $3 31 jul 2026
Jiekou.AI $0,5 $3 31 jul 2026
Kilo Code $0,5 $3 31 jul 2026
LLM Gateway $0,5 $3 31 jul 2026
Merge Gateway $0,5 $3 31 jul 2026
NanoGPT $0,5 $3 31 jul 2026
OpenRouter $0,5 $3 31 jul 2026
OrcaRouter $0,5 $3 31 jul 2026
Requesty $0,5 $3 31 jul 2026
ZenMux $0,5 $3 31 jul 2026
Venice AI $0,7 $3,75 31 jul 2026

É mostrada apenas a tarifa base e apenas preços por token. Tarifas em lote, reduzidas ou em cache, bem como preços por imagem ou por segundo de vídeo, não entram nesta tabela: não podem ficar na mesma coluna que um preço por milhão de tokens.

A data da última coluna é o dia em que este preço entrou pela primeira vez na nossa recolha. O preço pode ser mais antigo: antes desse dia simplesmente não o registávamos. Desde então não mudou — caso contrário, no seu lugar estaria uma linha nova com uma data nova.

Resultados das medições

Conjunto de tarefas Resultado Condições da execução Medido por
Mock AIME 2024–2025 — problemas de olimpíada 92,77 % · com estrutura ajustada Epoch evaluations
GeoBench — localização de um lugar a partir de uma foto 88 % GeoBench leaderboard
GPQA Diamond — perguntas de nível de pós-graduação 77,61 % · com estrutura ajustada Epoch evaluations
SWE-bench Verified — correção de erros em repositórios 75,41 % · com estrutura ajustada Epoch evaluations
SimpleQA Verified — exatidão factual 67,4 % Epoch evaluations
Terminal-Bench — trabalho na linha de comandos 64,3 % · com estrutura ajustada Terminal-Bench v2 Leaderboard
WeirdML — tarefas incomuns de aprendizagem automática 61,6 % WeirdML Leaderboard
SimpleBench — perguntas capciosas 53,32 % SimpleBench Leaderboard
FrontierMath, níveis 1–3 51,23 % Epoch evaluations
BALROG — ambientes de jogo 48,1 % Balrog Leaderboard
Problemas de xadrez 34,76 % Epoch evaluations
ARC-AGI-2 33,61 %
APEX-Agents 24 %
ARC-AGI — generalização para padrões novos 21,5 % · com estrutura ajustada
FrontierMath, nível 4 — problemas de investigação 17,07 % Epoch evaluations
GSO-Bench — otimização de código 9,8 % GSO Leaderboard