Anthropic

Claude Sonnet 3.7

Tipo
modello linguistico
Contesto
200K token
Uscita massima
64K
Uscito il
19 febbraio 2025
Conoscenze fino a
ottobre 2024
Stringa per l'API
claude-3-7-sonnet-20250219

Prezzi per fornitore

Fornitore Ingresso ($ per 1M) Uscita ($ per 1M) Nei nostri dati dal
Abacus.AI $3 $15 1 ago 2026
Amazon Bedrock anthropic.claude-3-7-sonnet-20250219-v1:0 $3 $15 2 ago 2026
Anthropic $3 $15 1 ago 2026
Merge Gateway $3 $15 1 ago 2026
Amazon Bedrock bedrock/us-gov-west-1/anthropic.claude-3-7-sonnet-20250219-v1:0 $3,6 $18 2 ago 2026

È mostrata solo la tariffa base e solo i prezzi a token. Le tariffe batch, agevolate o in cache, così come i prezzi per immagine o per secondo di video, non entrano in questa tabella: non possono stare nella stessa colonna di un prezzo per milione di token.

Uno stesso fornitore compare più volte se vende questo modello con identificatori diversi e a prezzi diversi — per esempio con precisione dei pesi diversa. L'identificatore è indicato accanto al nome. Le offerte identiche arrivate da due fonti con grafie diverse sono unite in un'unica riga.

La data nell'ultima colonna è il giorno in cui questo prezzo è entrato per la prima volta nella nostra raccolta. Il prezzo può essere più vecchio: prima di quel giorno semplicemente non lo registravamo. Da allora non è cambiato — altrimenti al suo posto ci sarebbe una riga nuova con una data nuova.

Risultati delle misurazioni

Insieme di compiti Risultato Condizioni della prova Misurato da
Arena Score, richieste lunghe 1.354,73 1.347–1.362
Arena Score, programmazione 1.338,88 1.331–1.346
Arena Score, dialogo a più turni 1.338,32 1.331–1.346
Arena Score, rispetto delle istruzioni 1.325,19 1.319–1.331
Arena Score, matematica 1.318,41 1.308–1.328
Arena Score, scrittura creativa 1.316,76 1.309–1.325
Arena Score, richieste difficili 1.315,07 1.309–1.321
Arena Score in inglese 1.311,02 1.306–1.316
Arena Score in russo 1.309,67 1.299–1.320
Arena Score in francese 1.302,75 1.275–1.330
Arena Score, domande da esperto 1.300,32 1.287–1.313
Arena Score, generale 1.299,32 1.295–1.303
Arena Score in spagnolo 1.289,11 1.263–1.315
Arena Score, riconoscimento del testo nell'immagine 1.158,07 1.139–1.177
Arena Score, comprensione degli schemi 1.151,01 1.119–1.183
Arena Score, lavoro con le immagini 1.151 1.142–1.160
MATH, livello di difficoltà cinque 91,16 % budget di ragionamento: 64K · con impalcatura calibrata Epoch evaluations
Fiction.LiveBench — tenuta di un contesto lungo 83,3 % Fiction.live leaderboard
Scrittura creativa (valutazione di Lech Mazur) 81,1 % budget di ragionamento: 16K lechmazur/writing Github repository
GPQA Diamond — domande di livello dottorale 72,98 % budget di ragionamento: 64K · con impalcatura calibrata Epoch evaluations
GeoBench — individuazione di un luogo da una foto 68 % budget di ragionamento: 15K GeoBench leaderboard
Aider Polyglot — modifiche di codice in sei linguaggi 64,9 % · con impalcatura calibrata Aider LLM Leaderboards
SWE-bench Verified — correzione di bug nei repository 60,95 % · con impalcatura calibrata Epoch evaluations
Mock AIME 2024–2025 — problemi da olimpiadi 57,74 % budget di ragionamento: 64K · con impalcatura calibrata Epoch evaluations
CadEval — costruzione di modelli CAD tramite codice 54 % CadEval Dashboard
DeepResearch Bench — ricerca approfondita 43,6 % budget di ragionamento: 2K DeepResearchBench Leaderboard
OSWorld — lavoro in un sistema operativo, prima versione 35,8 % · con impalcatura calibrata OS World Website
SimpleBench — domande trabocchetto 35,68 % budget di ragionamento: 12K SimpleBench Leaderboard
The Agent Company — compiti di lavoro in un ambiente d'ufficio 30,9 % TheAgentCompany leaderboard
ARC-AGI — generalizzazione su schemi nuovi 28,6 % budget di ragionamento: 16K · con impalcatura calibrata ARC Prize Leaderboard
Cybench — compiti di cybersicurezza 20 % · con impalcatura calibrata Cybench leaderboard
GSO-Bench — ottimizzazione del codice 3,8 % GSO Leaderboard
Humanity’s Last Exam — domande da esperto 3,4 %
ARC-AGI-2 0,9 % budget di ragionamento: 8K