azure/gpt-4.1-2025-04-14O fornecedor declarou este modelo obsoleto. Ainda responde, mas é melhor não iniciar projetos novos com ele.
| Fornecedor | Entrada, $ por 1M | Saída, $ por 1M | Nos nossos dados desde |
|---|---|---|---|
Microsoft Foundry
azure/gpt-4.1-2025-04-14
|
$2 | $8 | 31 jul 2026 |
| OpenAI | $2 | $8 | 31 jul 2026 |
Microsoft Foundry
azure/us/gpt-4.1-2025-04-14
|
$2,2 | $8,8 | 31 jul 2026 |
É mostrada apenas a tarifa base e apenas preços por token. Tarifas em lote, reduzidas ou em cache, bem como preços por imagem ou por segundo de vídeo, não entram nesta tabela: não podem ficar na mesma coluna que um preço por milhão de tokens.
Um mesmo fornecedor aparece várias vezes se vende este modelo com identificadores diferentes e a preços diferentes — por exemplo, com precisão de pesos diferente. O identificador é indicado ao lado do nome. As ofertas idênticas vindas de duas fontes com grafias diferentes são reunidas numa única linha.
A data da última coluna é o dia em que este preço entrou pela primeira vez na nossa recolha. O preço pode ser mais antigo: antes desse dia simplesmente não o registávamos. Desde então não mudou — caso contrário, no seu lugar estaria uma linha nova com uma data nova.
| Conjunto de tarefas | Resultado | Condições da execução | Medido por |
|---|---|---|---|
| Arena Score, diálogo de vários turnos | 1.396,99 1.390–1.404 | — | — |
| Arena Score em inglês | 1.390,3 1.386–1.395 | — | — |
| Arena Score, programação | 1.390,24 1.384–1.397 | — | — |
| Arena Score, pedidos longos | 1.382,97 1.377–1.389 | — | — |
| Arena Score, pedidos difíceis | 1.382,46 1.378–1.387 | — | — |
| Arena Score, geral | 1.382,06 1.378–1.386 | — | — |
| Arena Score em francês | 1.381,97 1.359–1.405 | — | — |
| Arena Score em russo | 1.373,25 1.363–1.384 | — | — |
| Arena Score em espanhol | 1.368,54 1.349–1.388 | — | — |
| Arena Score, matemática | 1.367,35 1.357–1.378 | — | — |
| Arena Score, seguimento de instruções | 1.366,42 1.361–1.372 | — | — |
| Arena Score, escrita criativa | 1.363,66 1.356–1.371 | — | — |
| Arena Score, perguntas de especialista | 1.363,58 1.352–1.375 | — | — |
| Arena Score, reconhecimento de texto em imagem | 1.217,28 1.209–1.226 | — | — |
| Arena Score, compreensão de esquemas | 1.214,97 1.202–1.228 | — | — |
| Arena Score, trabalho com imagens | 1.209,86 1.203–1.217 | — | — |
| MATH, nível de dificuldade cinco | 83,01 % | · com estrutura ajustada | Epoch evaluations |
| GeoBench — localização de um lugar a partir de uma foto | 72 % | — | GeoBench leaderboard |
| Fiction.LiveBench — retenção de contexto longo | 63,9 % | — | Fiction.live leaderboard |
| GPQA Diamond — perguntas de nível de pós-graduação | 55,89 % | · com estrutura ajustada | Epoch evaluations |
| Aider Polyglot — edições de código em seis linguagens | 52,4 % | · com estrutura ajustada | Aider LLM Leaderboards |
| SWE-bench Verified — correção de erros em repositórios | 48,54 % | · com estrutura ajustada | Epoch evaluations |
| CadEval — construção de modelos CAD por código | 42 % | — | CadEval Dashboard |
| WeirdML — tarefas incomuns de aprendizagem automática | 39,04 % | — | WeirdML Leaderboard |
| Mock AIME 2024–2025 — problemas de olimpíada | 38,27 % | · com estrutura ajustada | Epoch evaluations |
| DeepResearch Bench — pesquisa aprofundada | 29,31 % | — | — |
| SimpleBench — perguntas capciosas | 12,4 % | — | SimpleBench Leaderboard |
| ARC-AGI — generalização para padrões novos | 5,5 % | · com estrutura ajustada | ARC Prize Leaderboard |
| Humanity’s Last Exam — perguntas de nível especialista | 0,63 % | — | — |
| ARC-AGI-2 | 0,42 % | — | — |