Anthropic

Claude Sonnet 4.5

Tipo
modello linguistico
Contesto
1.000K token
Uscita massima
64K
Uscito il
29 settembre 2025
Conoscenze fino a
luglio 2025
Stringa per l'API
claude-sonnet-4-5-20250929

Prezzi per fornitore

Fornitore Ingresso ($ per 1M) Uscita ($ per 1M) Nei nostri dati dal
qihang-ai $0,43 $2,14 31 lug 2026
Jiekou.AI $2,7 $13,5 31 lug 2026
NanoGPT $2,992 $14,994 31 lug 2026
302.AI $3 $15 31 lug 2026
Abacus.AI $3 $15 31 lug 2026
Amazon Bedrock anthropic.claude-sonnet-4-5-20250929-v1:0 $3 $15 2 ago 2026
Anthropic $3 $15 31 lug 2026
Helicone $3 $15 31 lug 2026
LLM Gateway $3 $15 31 lug 2026
Merge Gateway $3 $15 31 lug 2026
Amazon Bedrock eu.anthropic.claude-sonnet-4-5-20250929-v1:0 $3,3 $16,5 2 ago 2026
Amazon Bedrock bedrock/us-gov-east-1/anthropic.claude-sonnet-4-5-20250929-v1:0 $3,6 $18 2 ago 2026

È mostrata solo la tariffa base e solo i prezzi a token. Le tariffe batch, agevolate o in cache, così come i prezzi per immagine o per secondo di video, non entrano in questa tabella: non possono stare nella stessa colonna di un prezzo per milione di token.

Uno stesso fornitore compare più volte se vende questo modello con identificatori diversi e a prezzi diversi — per esempio con precisione dei pesi diversa. L'identificatore è indicato accanto al nome. Le offerte identiche arrivate da due fonti con grafie diverse sono unite in un'unica riga.

La data nell'ultima colonna è il giorno in cui questo prezzo è entrato per la prima volta nella nostra raccolta. Il prezzo può essere più vecchio: prima di quel giorno semplicemente non lo registravamo. Da allora non è cambiato — altrimenti al suo posto ci sarebbe una riga nuova con una data nuova.

Risultati delle misurazioni

Insieme di compiti Risultato Condizioni della prova Misurato da
Arena Score, programmazione 1.485,37 1.480–1.490
Arena Score, richieste lunghe 1.476,02 1.471–1.481
Arena Score, domande da esperto 1.472,22 1.464–1.481
Arena Score, dialogo a più turni 1.464,84 1.459–1.471
Arena Score, richieste difficili 1.461,7 1.458–1.465
Arena Score, rispetto delle istruzioni 1.458,64 1.454–1.463
Arena Score in francese 1.457,25 1.441–1.473
Arena Score in spagnolo 1.455,76 1.442–1.470
Arena Score in inglese 1.451,19 1.447–1.455
Arena Score, scrittura creativa 1.440,99 1.435–1.447
Arena Score, generale 1.437,78 1.435–1.441
Arena Score in russo 1.435,09 1.428–1.442
Arena Score, matematica 1.421,66 1.413–1.430
Arena Score, sviluppo web 1.385,13 1.378–1.392
MATH, livello di difficoltà cinque 97,73 % budget di ragionamento: 32K · con impalcatura calibrata Epoch evaluations
Mock AIME 2024–2025 — problemi da olimpiadi 77,76 % budget di ragionamento: 59K · con impalcatura calibrata Epoch evaluations
GPQA Diamond — domande di livello dottorale 76,43 % budget di ragionamento: 16K · con impalcatura calibrata Epoch evaluations
SWE-bench Verified — correzione di bug nei repository 71,28 % · con impalcatura calibrata Epoch evaluations
ARC-AGI — generalizzazione su schemi nuovi 63,67 % budget di ragionamento: 32K · con impalcatura calibrata
OSWorld — lavoro in un sistema operativo, prima versione 62,9 % · con impalcatura calibrata OS World Website
Cybench — compiti di cybersicurezza 60 % · con impalcatura calibrata Opus 4.5 System Card autodichiarato
DeepResearch Bench — ricerca approfondita 52,6 % budget di ragionamento: 2K DeepResearchBench Leaderboard
WeirdML — compiti insoliti di apprendimento automatico 47,71 % budget di ragionamento: 16K WeirdML Leaderboard
Terminal-Bench — lavoro da riga di comando 46,5 % · con impalcatura calibrata Terminal-Bench v2 Leaderboard
SimpleBench — domande trabocchetto 45,16 % budget di ragionamento: 12K SimpleBench Leaderboard
GDPval — compiti di professioni reali 42,5 %
FrontierMath, livelli 1–3 23,86 % budget di ragionamento: 32K Epoch evaluations
SimpleQA Verified — accuratezza fattuale 23,6 % budget di ragionamento: 59K Epoch evaluations
GSO-Bench — ottimizzazione del codice 14,71 % GSO Leaderboard
ARC-AGI-2 13,61 % budget di ragionamento: 32K
Humanity’s Last Exam — domande da esperto 9,37 %
Problemi di scacchi 7,41 % budget di ragionamento: 32K Epoch evaluations
FrontierMath, livello 4 — problemi di ricerca 2,44 % budget di ragionamento: 32K Epoch evaluations
Remote Labor Index — incarichi da una piattaforma di freelance 2,08 %
CritPt — problemi di fisica 1,14 %