OpenAI

OpenAI: GPT-4o-mini (2024-07-18)

Tipo
modelo de linguagem
Contexto
128K tokens
Saída máxima
16K
Lançado em
18 julho 2024
Conhecimento até
outubro 2023
String para a API
openai/gpt-4o-mini-2024-07-18

Preços por fornecedor

Fornecedor Entrada, $ por 1M Saída, $ por 1M Nos nossos dados desde
Kilo Code $0,15 $0,6 31 jul 2026
OpenAI $0,15 $0,6 31 jul 2026
OpenRouter $0,15 $0,6 31 jul 2026
Microsoft Foundry $0,165 $0,66 31 jul 2026
Venice AI $0,188 $0,75 1 ago 2026

É mostrada apenas a tarifa base e apenas preços por token. Tarifas em lote, reduzidas ou em cache, bem como preços por imagem ou por segundo de vídeo, não entram nesta tabela: não podem ficar na mesma coluna que um preço por milhão de tokens.

A data da última coluna é o dia em que este preço entrou pela primeira vez na nossa recolha. O preço pode ser mais antigo: antes desse dia simplesmente não o registávamos. Desde então não mudou — caso contrário, no seu lugar estaria uma linha nova com uma data nova.

Resultados das medições

Conjunto de tarefas Resultado Condições da execução Medido por
Arena Score em inglês 1.300,59 1.296–1.305
Arena Score em francês 1.295,68 1.271–1.320
Arena Score, programação 1.290,12 1.284–1.297
Arena Score, pedidos longos 1.288,94 1.282–1.296
Arena Score, geral 1.286,57 1.283–1.290
Arena Score, diálogo de vários turnos 1.285,04 1.278–1.292
Arena Score em espanhol 1.278,34 1.255–1.302
Arena Score em russo 1.274,29 1.267–1.282
Arena Score, escrita criativa 1.268,26 1.261–1.275
Arena Score, matemática 1.267,33 1.260–1.274
Arena Score, pedidos difíceis 1.267,19 1.262–1.272
Arena Score, seguimento de instruções 1.258,81 1.254–1.264
Arena Score, perguntas de especialista 1.233,87 1.223–1.245
Arena Score, trabalho com imagens 1.065,76 1.058–1.074
Escrita criativa (avaliação de Lech Mazur) 67,2 % lechmazur/writing Github repository
GeoBench — localização de um lugar a partir de uma foto 64 % GeoBench leaderboard
MATH, nível de dificuldade cinco 52,63 % · com estrutura ajustada Epoch evaluations
BALROG — ambientes de jogo 17,4 % Balrog Leaderboard
GPQA Diamond — perguntas de nível de pós-graduação 16,96 % · com estrutura ajustada Epoch evaluations
WeirdML — tarefas incomuns de aprendizagem automática 11,76 % WeirdML Leaderboard
Mock AIME 2024–2025 — problemas de olimpíada 6,85 % · com estrutura ajustada Epoch evaluations
Aider Polyglot — edições de código em seis linguagens 3,6 % · com estrutura ajustada Aider LLM Leaderboards
ARC-AGI-2 0 %
SimpleBench — perguntas capciosas 0 % SimpleBench Leaderboard
Problemas de xadrez 0 % Epoch evaluations