claude-sonnet-4-20250514| Fornitore | Ingresso ($ per 1M) | Uscita ($ per 1M) | Nei nostri dati dal |
|---|---|---|---|
| Jiekou.AI | $2,7 | $13,5 | 31 lug 2026 |
| NanoGPT | $2,992 | $14,994 | 31 lug 2026 |
| 302.AI | $3 | $15 | 31 lug 2026 |
| Abacus.AI | $3 | $15 | 31 lug 2026 |
| Amazon Bedrock | $3 | $15 | 2 ago 2026 |
| Anthropic | $3 | $15 | 1 ago 2026 |
| Merge Gateway | $3 | $15 | 31 lug 2026 |
È mostrata solo la tariffa base e solo i prezzi a token. Le tariffe batch, agevolate o in cache, così come i prezzi per immagine o per secondo di video, non entrano in questa tabella: non possono stare nella stessa colonna di un prezzo per milione di token.
La data nell'ultima colonna è il giorno in cui questo prezzo è entrato per la prima volta nella nostra raccolta. Il prezzo può essere più vecchio: prima di quel giorno semplicemente non lo registravamo. Da allora non è cambiato — altrimenti al suo posto ci sarebbe una riga nuova con una data nuova.
| Insieme di compiti | Risultato | Condizioni della prova | Misurato da |
|---|---|---|---|
| Arena Score, richieste lunghe | 1.379,71 1.372–1.387 | — | — |
| Arena Score, programmazione | 1.379,68 1.372–1.387 | — | — |
| Arena Score in francese | 1.363,66 1.337–1.390 | — | — |
| Arena Score, dialogo a più turni | 1.363,52 1.356–1.371 | — | — |
| Arena Score, matematica | 1.357,74 1.346–1.369 | — | — |
| Arena Score, richieste difficili | 1.354,2 1.349–1.360 | — | — |
| Arena Score in spagnolo | 1.350,72 1.329–1.373 | — | — |
| Arena Score, rispetto delle istruzioni | 1.350,14 1.343–1.357 | — | — |
| Arena Score in inglese | 1.345,71 1.340–1.351 | — | — |
| Arena Score in russo | 1.344,73 1.333–1.356 | — | — |
| Arena Score, scrittura creativa | 1.339,09 1.330–1.348 | — | — |
| Arena Score, generale | 1.337,9 1.334–1.342 | — | — |
| Arena Score, domande da esperto | 1.333,62 1.320–1.347 | — | — |
| Arena Score, comprensione degli schemi | 1.178,16 1.150–1.207 | — | — |
| Arena Score, lavoro con le immagini | 1.175,73 1.162–1.190 | — | — |
| Arena Score, riconoscimento del testo nell'immagine | 1.173,12 1.156–1.191 | — | — |
| MATH, livello di difficoltà cinque | 84,37 % | · con impalcatura calibrata | Epoch evaluations |
| Scrittura creativa (valutazione di Lech Mazur) | 81,4 % | budget di ragionamento: 16K | lechmazur/writing Github repository |
| GPQA Diamond — domande di livello dottorale | 72,25 % | budget di ragionamento: 59K · con impalcatura calibrata | Epoch evaluations |
| Mock AIME 2024–2025 — problemi da olimpiadi | 71,08 % | budget di ragionamento: 59K · con impalcatura calibrata | Epoch evaluations |
| Aider Polyglot — modifiche di codice in sei linguaggi | 61,3 % | · con impalcatura calibrata | Aider LLM Leaderboards |
| DeepResearch Bench — ricerca approfondita | 47,8 % | budget di ragionamento: 2K | DeepResearchBench Leaderboard |
| Fiction.LiveBench — tenuta di un contesto lungo | 46,9 % | — | Fiction.live leaderboard |
| WeirdML — compiti insoliti di apprendimento automatico | 46,11 % | budget di ragionamento: 16K | WeirdML Leaderboard |
| OSWorld — lavoro in un sistema operativo, prima versione | 43,9 % | · con impalcatura calibrata | OS World Website |
| ARC-AGI — generalizzazione su schemi nuovi | 40 % | budget di ragionamento: 16K · con impalcatura calibrata | ARC Prize Leaderboard |
| GeoBench — individuazione di un luogo da una foto | 37 % | — | GeoBench leaderboard |
| Cybench — compiti di cybersicurezza | 35 % | · con impalcatura calibrata | Cybench leaderboard |
| SimpleBench — domande trabocchetto | 34,6 % | budget di ragionamento: 12K | SimpleBench Leaderboard |
| The Agent Company — compiti di lavoro in un ambiente d'ufficio | 33,1 % | — | TheAgentCompany leaderboard |
| APEX-Agents | 9,3 % | — | — |
| ARC-AGI-2 | 5,93 % | budget di ragionamento: 16K | — |
| GSO-Bench — ottimizzazione del codice | 4,9 % | — | GSO Leaderboard |
| Humanity’s Last Exam — domande da esperto | 3,11 % | — | — |
| CritPt — problemi di fisica | 0,29 % | — | — |