OpenAI

GPT 5.2 2025-12-11

Tipo
geração de imagens
Contexto
272K tokens
Saída máxima
128K
String para a API
azure/gpt-5.2-2025-12-11

Preços por fornecedor

Fornecedor Entrada, $ por 1M Saída, $ por 1M Nos nossos dados desde
Microsoft Foundry $1,75 $14 31 jul 2026
OpenAI $1,75 $14 31 jul 2026

É mostrada apenas a tarifa base e apenas preços por token. Tarifas em lote, reduzidas ou em cache, bem como preços por imagem ou por segundo de vídeo, não entram nesta tabela: não podem ficar na mesma coluna que um preço por milhão de tokens.

A data da última coluna é o dia em que este preço entrou pela primeira vez na nossa recolha. O preço pode ser mais antigo: antes desse dia simplesmente não o registávamos. Desde então não mudou — caso contrário, no seu lugar estaria uma linha nova com uma data nova.

Resultados das medições

Conjunto de tarefas Resultado Condições da execução Medido por
Mock AIME 2024–2025 — problemas de olimpíada 96,11 % esforço: none · com estrutura ajustada Epoch evaluations
GPQA Diamond — perguntas de nível de pós-graduação 88,53 % esforço: none · com estrutura ajustada Epoch evaluations
ARC-AGI — generalização para padrões novos 86,2 % esforço: xhigh · com estrutura ajustada ARC Prize Leaderboard
SWE-bench Verified — correção de erros em repositórios 73,76 % esforço: high · com estrutura ajustada Epoch evaluations
WeirdML — tarefas incomuns de aprendizagem automática 72,2 % esforço: xhigh WeirdML Leaderboard
FrontierMath, níveis 1–3 67,4 % esforço: xhigh Epoch evaluations
Terminal-Bench — trabalho na linha de comandos 64,9 % esforço: medium · com estrutura ajustada Terminal-Bench v2 Leaderboard
ARC-AGI-2 52,91 % esforço: xhigh
GDPval — tarefas de profissões reais 49,7 % esforço: none
Problemas de xadrez 46,34 % esforço: none Epoch evaluations
DeepResearch Bench — pesquisa aprofundada 41,12 % esforço: low https://drb.futuresearch.ai/#drb autorrelatado
SimpleQA Verified — exatidão factual 38,9 % esforço: medium Epoch evaluations
SimpleBench — perguntas capciosas 34,96 % esforço: high SimpleBench Leaderboard
APEX-Agents 34,4 % esforço: xhigh
FrontierMath, nível 4 — problemas de investigação 31,7 % esforço: xhigh Epoch evaluations
GSO-Bench — otimização de código 27,4 % esforço: high GSO Leaderboard
Humanity’s Last Exam — perguntas de nível especialista 24,16 %
Remote Labor Index — trabalhos de uma plataforma de freelance 2,5 % esforço: medium