Meta AI

Llama 3.1 8B

Tipo
modelo de linguagem
Contexto
131K tokens
Saída máxima
128K
Lançado em
23 julho 2024
Conhecimento até
dezembro 2023
String para a API
meta-llama/Llama-3.1-8B-Instruct
Pesos
abertos

Preços por fornecedor

Fornecedor Entrada, $ por 1M Saída, $ por 1M Nos nossos dados desde
novita-ai $0,02 $0,05 31 jul 2026
Abacus.AI $0,02 $0,05 1 ago 2026
Helicone $0,02 $0,05 31 jul 2026
Kilo Code $0,02 $0,05 31 jul 2026
NanoGPT Meta-Llama-3-1-8B-Instruct-FP8 $0,02 $0,03 1 ago 2026
Nebius Token Factory $0,02 $0,06 1 ago 2026
Novita AI $0,02 $0,05 31 jul 2026
inference $0,025 $0,025 31 jul 2026
DeepInfra $0,03 $0,05 1 ago 2026
Nscale $0,03 $0,03 31 jul 2026
regolo-ai $0,05 $0,25 31 jul 2026
OpenRouter $0,05 $0,08 31 jul 2026
NanoGPT meta-llama/llama-3.1-8b-instruct $0,054 $0,054 31 jul 2026
friendliai $0,1 $0,1 1 ago 2026
OVHCloud AI Endpoints $0,1 $0,1 31 jul 2026
SambaNova $0,1 $0,2 1 ago 2026
Cloudflare AI Gateway workers-ai/@cf/meta/llama-3.1-8b-instruct-awq $0,12 $0,27 31 jul 2026
Hyperbolic $0,12 $0,3 1 ago 2026
neon $0,15 $0,45 1 ago 2026
Cloudflare AI Gateway workers-ai/@cf/meta/llama-3.1-8b-instruct-fp8 $0,15 $0,29 31 jul 2026
Databricks $0,15 $0,45 1 ago 2026
cloudflare-workers-ai $0,152 $0,287 31 jul 2026
Cloudflare Workers AI $0,152 $0,287 31 jul 2026
Perplexity $0,2 $0,2 31 jul 2026
Pioneer $0,2 $0,2 31 jul 2026
Amazon Bedrock $0,22 $0,22 2 ago 2026
Weights & Biases $0,22 $0,22 31 jul 2026
Cloudflare AI Gateway workers-ai/@cf/meta/llama-3.1-8b-instruct $0,28 $0,83 31 jul 2026
Microsoft Foundry $0,3 $0,61 1 ago 2026
OCI Generative AI $0,72 $0,72 31 jul 2026

É mostrada apenas a tarifa base e apenas preços por token. Tarifas em lote, reduzidas ou em cache, bem como preços por imagem ou por segundo de vídeo, não entram nesta tabela: não podem ficar na mesma coluna que um preço por milhão de tokens.

Um mesmo fornecedor aparece várias vezes se vende este modelo com identificadores diferentes e a preços diferentes — por exemplo, com precisão de pesos diferente. O identificador é indicado ao lado do nome. As ofertas idênticas vindas de duas fontes com grafias diferentes são reunidas numa única linha.

A data da última coluna é o dia em que este preço entrou pela primeira vez na nossa recolha. O preço pode ser mais antigo: antes desse dia simplesmente não o registávamos. Desde então não mudou — caso contrário, no seu lugar estaria uma linha nova com uma data nova.

Resultados das medições

Conjunto de tarefas Resultado Condições da execução Medido por
Arena Score em inglês 1.217,68 1.213–1.223
Arena Score, programação 1.195,29 1.188–1.203
Arena Score, geral 1.186,74 1.183–1.191
Arena Score, pedidos longos 1.181,83 1.174–1.190
Arena Score, matemática 1.179,26 1.171–1.187
Arena Score em francês 1.176,17 1.147–1.206
Arena Score, pedidos difíceis 1.174,99 1.169–1.181
Arena Score, diálogo de vários turnos 1.172,04 1.164–1.180
Arena Score em espanhol 1.168,43 1.141–1.196
Arena Score, seguimento de instruções 1.159,42 1.154–1.165
Arena Score em russo 1.157,4 1.149–1.166
Arena Score, escrita criativa 1.154,71 1.146–1.163
Arena Score, perguntas de especialista 1.143,55 1.131–1.156
MATH, nível de dificuldade cinco 22,88 % · com estrutura ajustada Epoch evaluations
BALROG — ambientes de jogo 15,1 % Balrog Leaderboard
Mock AIME 2024–2025 — problemas de olimpíada 2,4 % · com estrutura ajustada Epoch evaluations
WeirdML — tarefas incomuns de aprendizagem automática 1,73 % WeirdML Leaderboard
GPQA Diamond — perguntas de nível de pós-graduação 1,26 % · com estrutura ajustada Epoch evaluations
CritPt — problemas de física 0 %