openai/gpt-4o-mini-2024-07-18| Fornecedor | Entrada, $ por 1M | Saída, $ por 1M | Nos nossos dados desde |
|---|---|---|---|
| Kilo Code | $0,15 | $0,6 | 31 jul 2026 |
| OpenAI | $0,15 | $0,6 | 31 jul 2026 |
| OpenRouter | $0,15 | $0,6 | 31 jul 2026 |
| Microsoft Foundry | $0,165 | $0,66 | 31 jul 2026 |
| Venice AI | $0,188 | $0,75 | 1 ago 2026 |
É mostrada apenas a tarifa base e apenas preços por token. Tarifas em lote, reduzidas ou em cache, bem como preços por imagem ou por segundo de vídeo, não entram nesta tabela: não podem ficar na mesma coluna que um preço por milhão de tokens.
A data da última coluna é o dia em que este preço entrou pela primeira vez na nossa recolha. O preço pode ser mais antigo: antes desse dia simplesmente não o registávamos. Desde então não mudou — caso contrário, no seu lugar estaria uma linha nova com uma data nova.
| Conjunto de tarefas | Resultado | Condições da execução | Medido por |
|---|---|---|---|
| Arena Score em inglês | 1.300,59 1.296–1.305 | — | — |
| Arena Score em francês | 1.295,68 1.271–1.320 | — | — |
| Arena Score, programação | 1.290,12 1.284–1.297 | — | — |
| Arena Score, pedidos longos | 1.288,94 1.282–1.296 | — | — |
| Arena Score, geral | 1.286,57 1.283–1.290 | — | — |
| Arena Score, diálogo de vários turnos | 1.285,04 1.278–1.292 | — | — |
| Arena Score em espanhol | 1.278,34 1.255–1.302 | — | — |
| Arena Score em russo | 1.274,29 1.267–1.282 | — | — |
| Arena Score, escrita criativa | 1.268,26 1.261–1.275 | — | — |
| Arena Score, matemática | 1.267,33 1.260–1.274 | — | — |
| Arena Score, pedidos difíceis | 1.267,19 1.262–1.272 | — | — |
| Arena Score, seguimento de instruções | 1.258,81 1.254–1.264 | — | — |
| Arena Score, perguntas de especialista | 1.233,87 1.223–1.245 | — | — |
| Arena Score, trabalho com imagens | 1.065,76 1.058–1.074 | — | — |
| Escrita criativa (avaliação de Lech Mazur) | 67,2 % | — | lechmazur/writing Github repository |
| GeoBench — localização de um lugar a partir de uma foto | 64 % | — | GeoBench leaderboard |
| MATH, nível de dificuldade cinco | 52,63 % | · com estrutura ajustada | Epoch evaluations |
| BALROG — ambientes de jogo | 17,4 % | — | Balrog Leaderboard |
| GPQA Diamond — perguntas de nível de pós-graduação | 16,96 % | · com estrutura ajustada | Epoch evaluations |
| WeirdML — tarefas incomuns de aprendizagem automática | 11,76 % | — | WeirdML Leaderboard |
| Mock AIME 2024–2025 — problemas de olimpíada | 6,85 % | · com estrutura ajustada | Epoch evaluations |
| Aider Polyglot — edições de código em seis linguagens | 3,6 % | · com estrutura ajustada | Aider LLM Leaderboards |
| ARC-AGI-2 | 0 % | — | — |
| SimpleBench — perguntas capciosas | 0 % | — | SimpleBench Leaderboard |
| Problemas de xadrez | 0 % | — | Epoch evaluations |