Anthropic

Claude 4 Sonnet

Tipo
modello linguistico
Contesto
1.000K token
Uscita massima
64K
Uscito il
29 settembre 2025
Conoscenze fino a
marzo 2025
Stringa per l'API
claude-sonnet-4-20250514

Prezzi per fornitore

Fornitore Ingresso ($ per 1M) Uscita ($ per 1M) Nei nostri dati dal
Jiekou.AI $2,7 $13,5 31 lug 2026
NanoGPT $2,992 $14,994 31 lug 2026
302.AI $3 $15 31 lug 2026
Abacus.AI $3 $15 31 lug 2026
Amazon Bedrock $3 $15 2 ago 2026
Anthropic $3 $15 1 ago 2026
Merge Gateway $3 $15 31 lug 2026

È mostrata solo la tariffa base e solo i prezzi a token. Le tariffe batch, agevolate o in cache, così come i prezzi per immagine o per secondo di video, non entrano in questa tabella: non possono stare nella stessa colonna di un prezzo per milione di token.

La data nell'ultima colonna è il giorno in cui questo prezzo è entrato per la prima volta nella nostra raccolta. Il prezzo può essere più vecchio: prima di quel giorno semplicemente non lo registravamo. Da allora non è cambiato — altrimenti al suo posto ci sarebbe una riga nuova con una data nuova.

Risultati delle misurazioni

Insieme di compiti Risultato Condizioni della prova Misurato da
Arena Score, richieste lunghe 1.379,71 1.372–1.387
Arena Score, programmazione 1.379,68 1.372–1.387
Arena Score in francese 1.363,66 1.337–1.390
Arena Score, dialogo a più turni 1.363,52 1.356–1.371
Arena Score, matematica 1.357,74 1.346–1.369
Arena Score, richieste difficili 1.354,2 1.349–1.360
Arena Score in spagnolo 1.350,72 1.329–1.373
Arena Score, rispetto delle istruzioni 1.350,14 1.343–1.357
Arena Score in inglese 1.345,71 1.340–1.351
Arena Score in russo 1.344,73 1.333–1.356
Arena Score, scrittura creativa 1.339,09 1.330–1.348
Arena Score, generale 1.337,9 1.334–1.342
Arena Score, domande da esperto 1.333,62 1.320–1.347
Arena Score, comprensione degli schemi 1.178,16 1.150–1.207
Arena Score, lavoro con le immagini 1.175,73 1.162–1.190
Arena Score, riconoscimento del testo nell'immagine 1.173,12 1.156–1.191
MATH, livello di difficoltà cinque 84,37 % · con impalcatura calibrata Epoch evaluations
Scrittura creativa (valutazione di Lech Mazur) 81,4 % budget di ragionamento: 16K lechmazur/writing Github repository
GPQA Diamond — domande di livello dottorale 72,25 % budget di ragionamento: 59K · con impalcatura calibrata Epoch evaluations
Mock AIME 2024–2025 — problemi da olimpiadi 71,08 % budget di ragionamento: 59K · con impalcatura calibrata Epoch evaluations
Aider Polyglot — modifiche di codice in sei linguaggi 61,3 % · con impalcatura calibrata Aider LLM Leaderboards
DeepResearch Bench — ricerca approfondita 47,8 % budget di ragionamento: 2K DeepResearchBench Leaderboard
Fiction.LiveBench — tenuta di un contesto lungo 46,9 % Fiction.live leaderboard
WeirdML — compiti insoliti di apprendimento automatico 46,11 % budget di ragionamento: 16K WeirdML Leaderboard
OSWorld — lavoro in un sistema operativo, prima versione 43,9 % · con impalcatura calibrata OS World Website
ARC-AGI — generalizzazione su schemi nuovi 40 % budget di ragionamento: 16K · con impalcatura calibrata ARC Prize Leaderboard
GeoBench — individuazione di un luogo da una foto 37 % GeoBench leaderboard
Cybench — compiti di cybersicurezza 35 % · con impalcatura calibrata Cybench leaderboard
SimpleBench — domande trabocchetto 34,6 % budget di ragionamento: 12K SimpleBench Leaderboard
The Agent Company — compiti di lavoro in un ambiente d'ufficio 33,1 % TheAgentCompany leaderboard
APEX-Agents 9,3 %
ARC-AGI-2 5,93 % budget di ragionamento: 16K
GSO-Bench — ottimizzazione del codice 4,9 % GSO Leaderboard
Humanity’s Last Exam — domande da esperto 3,11 %
CritPt — problemi di fisica 0,29 %