claude-opus-4-1-20250805| Fornitore | Ingresso ($ per 1M) | Uscita ($ per 1M) | Nei nostri dati dal |
|---|---|---|---|
| Jiekou.AI | $13,5 | $67,5 | 31 lug 2026 |
| NanoGPT | $14,994 | $75,004 | 31 lug 2026 |
| 302.AI | $15 | $75 | 31 lug 2026 |
| Abacus.AI | $15 | $75 | 31 lug 2026 |
| Amazon Bedrock | $15 | $75 | 2 ago 2026 |
| Anthropic | $15 | $75 | 31 lug 2026 |
| Helicone | $15 | $75 | 31 lug 2026 |
| LLM Gateway | $15 | $75 | 31 lug 2026 |
| Merge Gateway | $15 | $75 | 31 lug 2026 |
È mostrata solo la tariffa base e solo i prezzi a token. Le tariffe batch, agevolate o in cache, così come i prezzi per immagine o per secondo di video, non entrano in questa tabella: non possono stare nella stessa colonna di un prezzo per milione di token.
La data nell'ultima colonna è il giorno in cui questo prezzo è entrato per la prima volta nella nostra raccolta. Il prezzo può essere più vecchio: prima di quel giorno semplicemente non lo registravamo. Da allora non è cambiato — altrimenti al suo posto ci sarebbe una riga nuova con una data nuova.
| Insieme di compiti | Risultato | Condizioni della prova | Misurato da |
|---|---|---|---|
| Arena Score, programmazione | 1.473,09 1.468–1.478 | — | — |
| Arena Score, richieste lunghe | 1.445,19 1.440–1.450 | — | — |
| Arena Score in spagnolo | 1.444,59 1.430–1.459 | — | — |
| Arena Score, dialogo a più turni | 1.441,82 1.436–1.448 | — | — |
| Arena Score, richieste difficili | 1.441,49 1.438–1.445 | — | — |
| Arena Score, rispetto delle istruzioni | 1.433,82 1.429–1.439 | — | — |
| Arena Score in inglese | 1.428,72 1.425–1.433 | — | — |
| Arena Score in francese | 1.427,47 1.410–1.445 | — | — |
| Arena Score, domande da esperto | 1.425,18 1.415–1.435 | — | — |
| Arena Score in russo | 1.422,37 1.414–1.430 | — | — |
| Arena Score, matematica | 1.421,84 1.413–1.430 | — | — |
| Arena Score, generale | 1.417,42 1.414–1.420 | — | — |
| Arena Score, scrittura creativa | 1.410,22 1.404–1.416 | — | — |
| Arena Score, sviluppo web | 1.388,74 1.378–1.400 | — | — |
| Scrittura creativa (valutazione di Lech Mazur) | 84,7 % | — | lechmazur/writing Github repository |
| SWE-bench Verified — correzione di bug nei repository | 73,35 % | · con impalcatura calibrata | Epoch evaluations |
| GPQA Diamond — domande di livello dottorale | 69,7 % | budget di ragionamento: 27K · con impalcatura calibrata | Epoch evaluations |
| Mock AIME 2024–2025 — problemi da olimpiadi | 68,86 % | budget di ragionamento: 27K · con impalcatura calibrata | Epoch evaluations |
| SimpleBench — domande trabocchetto | 52 % | — | SimpleBench Leaderboard |
| DeepResearch Bench — ricerca approfondita | 49,7 % | — | DeepResearchBench Leaderboard |
| GDPval — compiti di professioni reali | 43,6 % | — | — |
| WeirdML — compiti insoliti di apprendimento automatico | 42,76 % | budget di ragionamento: 16K | WeirdML Leaderboard |
| Cybench — compiti di cybersicurezza | 42 % | · con impalcatura calibrata | Cybench leaderboard |
| Terminal-Bench — lavoro da riga di comando | 38 % | · con impalcatura calibrata | Terminal-Bench v2 Leaderboard |
| SimpleQA Verified — accuratezza fattuale | 34,8 % | budget di ragionamento: 27K | Epoch evaluations |
| FrontierMath, livelli 1–3 | 12,63 % | budget di ragionamento: 32K | Epoch evaluations |
| Humanity’s Last Exam — domande da esperto | 7,06 % | — | — |
| FrontierMath, livello 4 — problemi di ricerca | 2,44 % | budget di ragionamento: 32K | Epoch evaluations |
| Problemi di scacchi | 2,15 % | — | Epoch evaluations |