A mesma comparação às cegas das imagens, mas para vídeo. Aqui há dez vezes menos modelos do que nas seleções de texto, e as primeiras posições se destacam do resto com mais clareza — simplesmente porque os participantes são poucos.
| # | Modelo | Desenvolvedor | Arena Score, vídeo | Acesso$ / 1M | Saída$ / 1M | Contextotokens |
|---|---|---|---|---|---|---|
| 1 | Sora 2 Pro | OpenAI | 1.365,62 1.358–1.374 | — | — | — |
| 2 | Sora 2 | OpenAI | 1.337,11 1.330–1.344 | — | — | — |
| 3 | Seedance v1.5 Pro | ByteDance (Doubao) | 1.256,99 1.250–1.264 | — | — | — |
| 4 | Veo 3 ≈ | Google DeepMind | 1.252,4 1.241–1.263 | — | — | 0K |
| 5 | Veo 3 Fast ≈ | Google DeepMind | 1.247,67 1.236–1.259 | — | — | 0K |
| 6 | Veo 2 | Google DeepMind | 1.162,57 1.146–1.179 | — | — | 0K |
| 7 | Ray2 | Luma AI | 1.063,9 1.047–1.081 | — | — | 5K |
A tabela rola na horizontal: nem todas as colunas cabem.
O preço é o mais baixo entre os fornecedores do modelo, tarifa base, sem tarifas em lote nem reduzidas. A entrada e a saída são mostradas separadamente de propósito: na maioria dos modelos a saída custa várias vezes mais que a entrada, e a conta final depende do que predomina na tarefa.
O sinal ≈ marca os modelos cujo intervalo de confiança se sobrepõe ao da linha acima. Aqui há 2 modelos — a ordem entre eles não é determinada pelos dados disponíveis.
O intervalo de confiança de metade dos modelos é de 22,1 pontos, e isso é mais estreito que a distância até à linha vizinha: a ordem aqui é dada pelos dados, não por quem votou desta vez. Votos por modelo aqui — mediana 15.230: quanto menos houver, mais largo é o intervalo.
Arena (LMArena)
— licença CC-BY-4.0 · fonte original
По данным Arena (LMArena)