gemini-2.0-flash-001| Fornecedor | Entrada, $ por 1M | Saída, $ por 1M | Nos nossos dados desde |
|---|---|---|---|
| DeepInfra | $0,1 | $0,4 | 31 jul 2026 |
| Google DeepMind | $0,1 | $0,4 | 31 jul 2026 |
| Kilo Code | $0,1 | $0,4 | 31 jul 2026 |
| OpenRouter | $0,1 | $0,4 | 31 jul 2026 |
| NanoGPT | $0,1 | $0,408 | 31 jul 2026 |
| Google Vertex AI | $0,15 | $0,6 | 31 jul 2026 |
É mostrada apenas a tarifa base e apenas preços por token. Tarifas em lote, reduzidas ou em cache, bem como preços por imagem ou por segundo de vídeo, não entram nesta tabela: não podem ficar na mesma coluna que um preço por milhão de tokens.
A data da última coluna é o dia em que este preço entrou pela primeira vez na nossa recolha. O preço pode ser mais antigo: antes desse dia simplesmente não o registávamos. Desde então não mudou — caso contrário, no seu lugar estaria uma linha nova com uma data nova.
| Conjunto de tarefas | Resultado | Condições da execução | Medido por |
|---|---|---|---|
| Arena Score em francês | 1.389,86 1.363–1.416 | — | — |
| Arena Score em inglês | 1.365,36 1.361–1.370 | — | — |
| Arena Score em espanhol | 1.360,8 1.335–1.386 | — | — |
| Arena Score, geral | 1.354,17 1.350–1.358 | — | — |
| Arena Score em russo | 1.352,75 1.343–1.363 | — | — |
| Arena Score, programação | 1.351,72 1.345–1.359 | — | — |
| Arena Score, matemática | 1.351,68 1.343–1.361 | — | — |
| Arena Score, diálogo de vários turnos | 1.349,91 1.343–1.357 | — | — |
| Arena Score, pedidos difíceis | 1.346,49 1.341–1.352 | — | — |
| Arena Score, pedidos longos | 1.344,97 1.338–1.352 | — | — |
| Arena Score, escrita criativa | 1.340,21 1.333–1.348 | — | — |
| Arena Score, perguntas de especialista | 1.339,49 1.327–1.352 | — | — |
| Arena Score, seguimento de instruções | 1.336,06 1.331–1.342 | — | — |
| Arena Score, trabalho com imagens | 1.158,46 1.151–1.166 | — | — |
| Arena Score, compreensão de esquemas | 1.148,95 1.131–1.167 | — | — |
| Arena Score, reconhecimento de texto em imagem | 1.148,81 1.137–1.160 | — | — |
| MATH, nível de dificuldade cinco | 82,17 % | · com estrutura ajustada | Epoch evaluations |
| GeoBench — localização de um lugar a partir de uma foto | 77 % | — | GeoBench leaderboard |
| Fiction.LiveBench — retenção de contexto longo | 61,1 % | — | Fiction.live leaderboard |
| GPQA Diamond — perguntas de nível de pós-graduação | 52,19 % | · com estrutura ajustada | Epoch evaluations |
| Mock AIME 2024–2025 — problemas de olimpíada | 31,04 % | · com estrutura ajustada | Epoch evaluations |
| CadEval — construção de modelos CAD por código | 30 % | — | CadEval Dashboard |
| WeirdML — tarefas incomuns de aprendizagem automática | 25,77 % | — | WeirdML Leaderboard |
| The Agent Company — tarefas de trabalho num ambiente de escritório | 11,4 % | — | TheAgentCompany experiment results github |
| ARC-AGI-2 | 1,3 % | — | — |