llama-3.1-405b-instruct| Fornitore | Ingresso ($ per 1M) | Uscita ($ per 1M) | Nei nostri dati dal |
|---|---|---|---|
| Hyperbolic | $0,12 | $0,3 | 1 ago 2026 |
| Nebius Token Factory | $1 | $3 | 1 ago 2026 |
| Google Vertex AI | $5 | $16 | 31 lug 2026 |
| SambaNova | $5 | $10 | 1 ago 2026 |
| Databricks | $5 | $15 | 1 ago 2026 |
| Amazon Bedrock | $5,32 | $16 | 2 ago 2026 |
| Microsoft Foundry | $5,33 | $16 | 1 ago 2026 |
| OCI Generative AI | $10,68 | $10,68 | 31 lug 2026 |
È mostrata solo la tariffa base e solo i prezzi a token. Le tariffe batch, agevolate o in cache, così come i prezzi per immagine o per secondo di video, non entrano in questa tabella: non possono stare nella stessa colonna di un prezzo per milione di token.
La data nell'ultima colonna è il giorno in cui questo prezzo è entrato per la prima volta nella nostra raccolta. Il prezzo può essere più vecchio: prima di quel giorno semplicemente non lo registravamo. Da allora non è cambiato — altrimenti al suo posto ci sarebbe una riga nuova con una data nuova.
| Insieme di compiti | Risultato | Condizioni della prova | Misurato da |
|---|---|---|---|
| Arena Score in inglese | 1.308,06 1.303–1.313 | — | — |
| Arena Score, dialogo a più turni | 1.287,34 1.280–1.295 | — | — |
| Arena Score, programmazione | 1.284 1.277–1.291 | — | — |
| Arena Score, generale | 1.281,97 1.278–1.286 | — | — |
| Arena Score, matematica | 1.278,23 1.270–1.286 | — | — |
| Arena Score in francese | 1.269,69 1.242–1.297 | — | — |
| Arena Score, richieste difficili | 1.263,75 1.258–1.270 | — | — |
| Arena Score, scrittura creativa | 1.260,14 1.253–1.268 | — | — |
| Arena Score, richieste lunghe | 1.259,79 1.252–1.267 | — | — |
| Arena Score, rispetto delle istruzioni | 1.259,06 1.254–1.264 | — | — |
| Arena Score in russo | 1.255,23 1.247–1.264 | — | — |
| Arena Score in spagnolo | 1.252,29 1.227–1.277 | — | — |
| Arena Score, domande da esperto | 1.228,55 1.216–1.241 | — | — |
| MATH, livello di difficoltà cinque | 49,77 % | · con impalcatura calibrata | Epoch evaluations |
| GPQA Diamond — domande di livello dottorale | 34,55 % | · con impalcatura calibrata | Epoch evaluations |
| WeirdML — compiti insoliti di apprendimento automatico | 21,38 % | — | WeirdML Leaderboard |
| Mock AIME 2024–2025 — problemi da olimpiadi | 9,63 % | · con impalcatura calibrata | Epoch evaluations |
| SimpleBench — domande trabocchetto | 7,6 % | — | SimpleBench Leaderboard |
| Cybench — compiti di cybersicurezza | 7,5 % | · con impalcatura calibrata | Cybench leaderboard |
| The Agent Company — compiti di lavoro in un ambiente d'ufficio | 7,4 % | — | TheAgentCompany experiment results github |