Google DeepMind

Gemini 2.0 Flash

Tipo
geração de imagens
Contexto
1.049K tokens
Saída máxima
8K
Lançado em
11 dezembro 2024
String para a API
gemini-2.0-flash-001

Preços por fornecedor

Fornecedor Entrada, $ por 1M Saída, $ por 1M Nos nossos dados desde
DeepInfra $0,1 $0,4 31 jul 2026
Google DeepMind $0,1 $0,4 31 jul 2026
Kilo Code $0,1 $0,4 31 jul 2026
OpenRouter $0,1 $0,4 31 jul 2026
NanoGPT $0,1 $0,408 31 jul 2026
Google Vertex AI $0,15 $0,6 31 jul 2026

É mostrada apenas a tarifa base e apenas preços por token. Tarifas em lote, reduzidas ou em cache, bem como preços por imagem ou por segundo de vídeo, não entram nesta tabela: não podem ficar na mesma coluna que um preço por milhão de tokens.

A data da última coluna é o dia em que este preço entrou pela primeira vez na nossa recolha. O preço pode ser mais antigo: antes desse dia simplesmente não o registávamos. Desde então não mudou — caso contrário, no seu lugar estaria uma linha nova com uma data nova.

Resultados das medições

Conjunto de tarefas Resultado Condições da execução Medido por
Arena Score em francês 1.389,86 1.363–1.416
Arena Score em inglês 1.365,36 1.361–1.370
Arena Score em espanhol 1.360,8 1.335–1.386
Arena Score, geral 1.354,17 1.350–1.358
Arena Score em russo 1.352,75 1.343–1.363
Arena Score, programação 1.351,72 1.345–1.359
Arena Score, matemática 1.351,68 1.343–1.361
Arena Score, diálogo de vários turnos 1.349,91 1.343–1.357
Arena Score, pedidos difíceis 1.346,49 1.341–1.352
Arena Score, pedidos longos 1.344,97 1.338–1.352
Arena Score, escrita criativa 1.340,21 1.333–1.348
Arena Score, perguntas de especialista 1.339,49 1.327–1.352
Arena Score, seguimento de instruções 1.336,06 1.331–1.342
Arena Score, trabalho com imagens 1.158,46 1.151–1.166
Arena Score, compreensão de esquemas 1.148,95 1.131–1.167
Arena Score, reconhecimento de texto em imagem 1.148,81 1.137–1.160
MATH, nível de dificuldade cinco 82,17 % · com estrutura ajustada Epoch evaluations
GeoBench — localização de um lugar a partir de uma foto 77 % GeoBench leaderboard
Fiction.LiveBench — retenção de contexto longo 61,1 % Fiction.live leaderboard
GPQA Diamond — perguntas de nível de pós-graduação 52,19 % · com estrutura ajustada Epoch evaluations
Mock AIME 2024–2025 — problemas de olimpíada 31,04 % · com estrutura ajustada Epoch evaluations
CadEval — construção de modelos CAD por código 30 % CadEval Dashboard
WeirdML — tarefas incomuns de aprendizagem automática 25,77 % WeirdML Leaderboard
The Agent Company — tarefas de trabalho num ambiente de escritório 11,4 % TheAgentCompany experiment results github
ARC-AGI-2 1,3 %