azure_ai/gpt-5.4-2026-03-05| Fornecedor | Entrada, $ por 1M | Saída, $ por 1M | Nos nossos dados desde |
|---|---|---|---|
Microsoft Foundry
azure_ai/gpt-5.4-2026-03-05
|
$2,5 | $15 | 31 jul 2026 |
| OpenAI | $2,5 | $15 | 31 jul 2026 |
Microsoft Foundry
azure/eu/gpt-5.4-2026-03-05
|
$2,75 | $16,5 | 31 jul 2026 |
É mostrada apenas a tarifa base e apenas preços por token. Tarifas em lote, reduzidas ou em cache, bem como preços por imagem ou por segundo de vídeo, não entram nesta tabela: não podem ficar na mesma coluna que um preço por milhão de tokens.
Um mesmo fornecedor aparece várias vezes se vende este modelo com identificadores diferentes e a preços diferentes — por exemplo, com precisão de pesos diferente. O identificador é indicado ao lado do nome. As ofertas idênticas vindas de duas fontes com grafias diferentes são reunidas numa única linha.
A data da última coluna é o dia em que este preço entrou pela primeira vez na nossa recolha. O preço pode ser mais antigo: antes desse dia simplesmente não o registávamos. Desde então não mudou — caso contrário, no seu lugar estaria uma linha nova com uma data nova.
| Conjunto de tarefas | Resultado | Condições da execução | Medido por |
|---|---|---|---|
| Mock AIME 2024–2025 — problemas de olimpíada | 97,78 % | esforço: medium · com estrutura ajustada | Epoch evaluations |
| ARC-AGI — generalização para padrões novos | 93,67 % | esforço: xhigh · com estrutura ajustada | — |
| GPQA Diamond — perguntas de nível de pós-graduação | 91,07 % | esforço: medium · com estrutura ajustada | Epoch evaluations |
| Terminal-Bench — trabalho na linha de comandos | 81,8 % | · com estrutura ajustada | https://www.tbench.ai/leaderboard/terminal-bench/2.0 |
| FrontierMath, níveis 1–3 | 78,6 % | esforço: xhigh | Epoch evaluations |
| WeirdML — tarefas incomuns de aprendizagem automática | 77,7 % | esforço: xhigh | WeirdML Leaderboard |
| SWE-bench Verified — correção de erros em repositórios | 76,86 % | esforço: high · com estrutura ajustada | Epoch evaluations |
| ARC-AGI-2 | 73,95 % | esforço: xhigh | — |
| FrontierMath, nível 4 — problemas de investigação | 49 % | esforço: xhigh | Epoch evaluations |
| SimpleQA Verified — exatidão factual | 44,84 % | esforço: xhigh | Epoch evaluations |
| Problemas de xadrez | 41,08 % | esforço: medium | Epoch evaluations |
| APEX-Agents | 36 % | esforço: xhigh | — |
| DeepResearch Bench — pesquisa aprofundada | 35,09 % | esforço: low | https://drb.futuresearch.ai/#drb autorrelatado |
| Humanity’s Last Exam — perguntas de nível especialista | 33,03 % | esforço: xhigh | — |
| GSO-Bench — otimização de código | 31,37 % | esforço: xhigh | https://gso-bench.github.io/index.html |
| CritPt — problemas de física | 23,43 % | esforço: xhigh | — |