OpenAI

GPT 5.4 2026-03-05

Tipo
modelo de linguagem
Contexto
1.050K tokens
Saída máxima
128K
String para a API
azure_ai/gpt-5.4-2026-03-05

Preços por fornecedor

Fornecedor Entrada, $ por 1M Saída, $ por 1M Nos nossos dados desde
Microsoft Foundry azure_ai/gpt-5.4-2026-03-05 $2,5 $15 31 jul 2026
OpenAI $2,5 $15 31 jul 2026
Microsoft Foundry azure/eu/gpt-5.4-2026-03-05 $2,75 $16,5 31 jul 2026

É mostrada apenas a tarifa base e apenas preços por token. Tarifas em lote, reduzidas ou em cache, bem como preços por imagem ou por segundo de vídeo, não entram nesta tabela: não podem ficar na mesma coluna que um preço por milhão de tokens.

Um mesmo fornecedor aparece várias vezes se vende este modelo com identificadores diferentes e a preços diferentes — por exemplo, com precisão de pesos diferente. O identificador é indicado ao lado do nome. As ofertas idênticas vindas de duas fontes com grafias diferentes são reunidas numa única linha.

A data da última coluna é o dia em que este preço entrou pela primeira vez na nossa recolha. O preço pode ser mais antigo: antes desse dia simplesmente não o registávamos. Desde então não mudou — caso contrário, no seu lugar estaria uma linha nova com uma data nova.

Resultados das medições

Conjunto de tarefas Resultado Condições da execução Medido por
Mock AIME 2024–2025 — problemas de olimpíada 97,78 % esforço: medium · com estrutura ajustada Epoch evaluations
ARC-AGI — generalização para padrões novos 93,67 % esforço: xhigh · com estrutura ajustada
GPQA Diamond — perguntas de nível de pós-graduação 91,07 % esforço: medium · com estrutura ajustada Epoch evaluations
Terminal-Bench — trabalho na linha de comandos 81,8 % · com estrutura ajustada https://www.tbench.ai/leaderboard/terminal-bench/2.0
FrontierMath, níveis 1–3 78,6 % esforço: xhigh Epoch evaluations
WeirdML — tarefas incomuns de aprendizagem automática 77,7 % esforço: xhigh WeirdML Leaderboard
SWE-bench Verified — correção de erros em repositórios 76,86 % esforço: high · com estrutura ajustada Epoch evaluations
ARC-AGI-2 73,95 % esforço: xhigh
FrontierMath, nível 4 — problemas de investigação 49 % esforço: xhigh Epoch evaluations
SimpleQA Verified — exatidão factual 44,84 % esforço: xhigh Epoch evaluations
Problemas de xadrez 41,08 % esforço: medium Epoch evaluations
APEX-Agents 36 % esforço: xhigh
DeepResearch Bench — pesquisa aprofundada 35,09 % esforço: low https://drb.futuresearch.ai/#drb autorrelatado
Humanity’s Last Exam — perguntas de nível especialista 33,03 % esforço: xhigh
GSO-Bench — otimização de código 31,37 % esforço: xhigh https://gso-bench.github.io/index.html
CritPt — problemas de física 23,43 % esforço: xhigh