azure_ai/gpt-5.4-pro-2026-03-05| Fornecedor | Entrada, $ por 1M | Saída, $ por 1M | Nos nossos dados desde |
|---|---|---|---|
| Microsoft Foundry | $30 | $180 | 31 jul 2026 |
| OpenAI | $30 | $180 | 31 jul 2026 |
É mostrada apenas a tarifa base e apenas preços por token. Tarifas em lote, reduzidas ou em cache, bem como preços por imagem ou por segundo de vídeo, não entram nesta tabela: não podem ficar na mesma coluna que um preço por milhão de tokens.
A data da última coluna é o dia em que este preço entrou pela primeira vez na nossa recolha. O preço pode ser mais antigo: antes desse dia simplesmente não o registávamos. Desde então não mudou — caso contrário, no seu lugar estaria uma linha nova com uma data nova.
| Conjunto de tarefas | Resultado | Condições da execução | Medido por |
|---|---|---|---|
| ARC-AGI — generalização para padrões novos | 94,5 % | esforço: xhigh · com estrutura ajustada | — |
| GPQA Diamond — perguntas de nível de pós-graduação | 92,8 % | esforço: xhigh · com estrutura ajustada | Epoch evaluations |
| ARC-AGI-2 | 83,33 % | esforço: xhigh | — |
| FrontierMath, níveis 1–3 | 82,46 % | esforço: xhigh | Epoch evaluations |
| SimpleBench — perguntas capciosas | 68,92 % | — | SimpleBench Leaderboard |
| FrontierMath, nível 4 — problemas de investigação | 58,54 % | esforço: xhigh | Epoch evaluations |
| WeirdML — tarefas incomuns de aprendizagem automática | 57,44 % | esforço: none | https://htihle.github.io/weirdml.html |
| Problemas de xadrez | 56,44 % | esforço: xhigh | Epoch evaluations |
| SimpleQA Verified — exatidão factual | 47,8 % | esforço: xhigh | Epoch evaluations |
| Humanity’s Last Exam — perguntas de nível especialista | 41,51 % | — | — |
| CritPt — problemas de física | 30 % | esforço: xhigh | — |