Lo stesso confronto alla cieca delle immagini, ma per i video. Qui i modelli sono dieci volte meno che nelle selezioni di testo, e le prime posizioni si staccano dal resto più nettamente — semplicemente perché i partecipanti sono pochi.
| # | Modello | Sviluppatore | Arena Score, video | Accesso$ / 1M | Uscita$ / 1M | Contestotoken |
|---|---|---|---|---|---|---|
| 1 | Sora 2 Pro | OpenAI | 1.365,62 1.358–1.374 | — | — | — |
| 2 | Sora 2 | OpenAI | 1.337,11 1.330–1.344 | — | — | — |
| 3 | Seedance v1.5 Pro | ByteDance (Doubao) | 1.256,99 1.250–1.264 | — | — | — |
| 4 | Veo 3 ≈ | Google DeepMind | 1.252,4 1.241–1.263 | — | — | 0K |
| 5 | Veo 3 Fast ≈ | Google DeepMind | 1.247,67 1.236–1.259 | — | — | 0K |
| 6 | Veo 2 | Google DeepMind | 1.162,57 1.146–1.179 | — | — | 0K |
| 7 | Ray2 | Luma AI | 1.063,9 1.047–1.081 | — | — | 5K |
La tabella scorre lateralmente: non tutte le colonne entrano.
Il prezzo è il più basso tra i fornitori del modello, tariffa base, senza tariffe batch o agevolate. Ingresso e uscita sono mostrati separatamente di proposito: nella maggior parte dei modelli l'uscita costa diverse volte più dell'ingresso, e il conto finale dipende da quale dei due prevale nel compito.
Il segno ≈ indica i modelli il cui intervallo di confidenza si sovrappone a quello della riga sopra. Qui ce ne sono 2 modelli — il loro ordine reciproco non è determinato dai dati disponibili.
L'intervallo di confidenza di metà dei modelli è di 22,1 punti, ed è più stretto della distanza dalla riga vicina: qui l'ordine è dato dai dati, non da chi ha votato questa volta. Voti per modello qui — mediana 15.230: meno ce ne sono, più ampio è l'intervallo.
Arena (LMArena)
— licenza CC-BY-4.0 · fonte originale
По данным Arena (LMArena)