Qwen/Qwen2.5-72B-Instruct| Fornecedor | Entrada, $ por 1M | Saída, $ por 1M | Nos nossos dados desde |
|---|---|---|---|
| Abacus.AI | $0,11 | $0,38 | 31 jul 2026 |
| DeepInfra | $0,12 | $0,39 | 31 jul 2026 |
| Hyperbolic | $0,12 | $0,3 | 31 jul 2026 |
| Nebius Token Factory | $0,13 | $0,4 | 31 jul 2026 |
| alibaba-cn | $0,574 | $1,721 | 31 jul 2026 |
| siliconflow-cn | $0,59 | $0,59 | 31 jul 2026 |
| SiliconFlow | $0,59 | $0,59 | 31 jul 2026 |
| Fireworks AI | $0,9 | $0,9 | 1 ago 2026 |
| Alibaba (Qwen) | $1,4 | $5,6 | 31 jul 2026 |
É mostrada apenas a tarifa base e apenas preços por token. Tarifas em lote, reduzidas ou em cache, bem como preços por imagem ou por segundo de vídeo, não entram nesta tabela: não podem ficar na mesma coluna que um preço por milhão de tokens.
A data da última coluna é o dia em que este preço entrou pela primeira vez na nossa recolha. O preço pode ser mais antigo: antes desse dia simplesmente não o registávamos. Desde então não mudou — caso contrário, no seu lugar estaria uma linha nova com uma data nova.
| Conjunto de tarefas | Resultado | Condições da execução | Medido por |
|---|---|---|---|
| Arena Score, programação | 1.292,93 1.285–1.301 | — | — |
| Arena Score em inglês | 1.282,77 1.278–1.288 | — | — |
| Arena Score, matemática | 1.282,63 1.274–1.291 | — | — |
| Arena Score, pedidos longos | 1.281,92 1.274–1.290 | — | — |
| Arena Score em francês | 1.278,91 1.246–1.312 | — | — |
| Arena Score, diálogo de vários turnos | 1.271,85 1.264–1.280 | — | — |
| Arena Score, pedidos difíceis | 1.270,92 1.265–1.277 | — | — |
| Arena Score, geral | 1.269,18 1.265–1.273 | — | — |
| Arena Score em russo | 1.262,99 1.254–1.272 | — | — |
| Arena Score, seguimento de instruções | 1.254,53 1.249–1.260 | — | — |
| Arena Score em espanhol | 1.254,22 1.223–1.285 | — | — |
| Arena Score, perguntas de especialista | 1.244,85 1.233–1.257 | — | — |
| Arena Score, escrita criativa | 1.221,67 1.213–1.230 | — | — |
| MATH, nível de dificuldade cinco | 63,17 % | · com estrutura ajustada | Epoch evaluations |
| GPQA Diamond — perguntas de nível de pós-graduação | 32,2 % | · com estrutura ajustada | Epoch evaluations |
| BALROG — ambientes de jogo | 16,2 % | — | Balrog Leaderboard |
| WeirdML — tarefas incomuns de aprendizagem automática | 15,97 % | — | WeirdML Leaderboard |
| Mock AIME 2024–2025 — problemas de olimpíada | 7,96 % | · com estrutura ajustada | Epoch evaluations |
| The Agent Company — tarefas de trabalho num ambiente de escritório | 5,7 % | — | TheAgentCompany experiment results github |