Anthropic

Claude 4.1 Opus

Tipo
modello linguistico
Contesto
200K token
Uscita massima
32K
Uscito il
5 agosto 2025
Conoscenze fino a
marzo 2025
Stringa per l'API
claude-opus-4-1-20250805

Prezzi per fornitore

Fornitore Ingresso ($ per 1M) Uscita ($ per 1M) Nei nostri dati dal
Jiekou.AI $13,5 $67,5 31 lug 2026
NanoGPT $14,994 $75,004 31 lug 2026
302.AI $15 $75 31 lug 2026
Abacus.AI $15 $75 31 lug 2026
Amazon Bedrock $15 $75 2 ago 2026
Anthropic $15 $75 31 lug 2026
Helicone $15 $75 31 lug 2026
LLM Gateway $15 $75 31 lug 2026
Merge Gateway $15 $75 31 lug 2026

È mostrata solo la tariffa base e solo i prezzi a token. Le tariffe batch, agevolate o in cache, così come i prezzi per immagine o per secondo di video, non entrano in questa tabella: non possono stare nella stessa colonna di un prezzo per milione di token.

La data nell'ultima colonna è il giorno in cui questo prezzo è entrato per la prima volta nella nostra raccolta. Il prezzo può essere più vecchio: prima di quel giorno semplicemente non lo registravamo. Da allora non è cambiato — altrimenti al suo posto ci sarebbe una riga nuova con una data nuova.

Risultati delle misurazioni

Insieme di compiti Risultato Condizioni della prova Misurato da
Arena Score, programmazione 1.473,09 1.468–1.478
Arena Score, richieste lunghe 1.445,19 1.440–1.450
Arena Score in spagnolo 1.444,59 1.430–1.459
Arena Score, dialogo a più turni 1.441,82 1.436–1.448
Arena Score, richieste difficili 1.441,49 1.438–1.445
Arena Score, rispetto delle istruzioni 1.433,82 1.429–1.439
Arena Score in inglese 1.428,72 1.425–1.433
Arena Score in francese 1.427,47 1.410–1.445
Arena Score, domande da esperto 1.425,18 1.415–1.435
Arena Score in russo 1.422,37 1.414–1.430
Arena Score, matematica 1.421,84 1.413–1.430
Arena Score, generale 1.417,42 1.414–1.420
Arena Score, scrittura creativa 1.410,22 1.404–1.416
Arena Score, sviluppo web 1.388,74 1.378–1.400
Scrittura creativa (valutazione di Lech Mazur) 84,7 % lechmazur/writing Github repository
SWE-bench Verified — correzione di bug nei repository 73,35 % · con impalcatura calibrata Epoch evaluations
GPQA Diamond — domande di livello dottorale 69,7 % budget di ragionamento: 27K · con impalcatura calibrata Epoch evaluations
Mock AIME 2024–2025 — problemi da olimpiadi 68,86 % budget di ragionamento: 27K · con impalcatura calibrata Epoch evaluations
SimpleBench — domande trabocchetto 52 % SimpleBench Leaderboard
DeepResearch Bench — ricerca approfondita 49,7 % DeepResearchBench Leaderboard
GDPval — compiti di professioni reali 43,6 %
WeirdML — compiti insoliti di apprendimento automatico 42,76 % budget di ragionamento: 16K WeirdML Leaderboard
Cybench — compiti di cybersicurezza 42 % · con impalcatura calibrata Cybench leaderboard
Terminal-Bench — lavoro da riga di comando 38 % · con impalcatura calibrata Terminal-Bench v2 Leaderboard
SimpleQA Verified — accuratezza fattuale 34,8 % budget di ragionamento: 27K Epoch evaluations
FrontierMath, livelli 1–3 12,63 % budget di ragionamento: 32K Epoch evaluations
Humanity’s Last Exam — domande da esperto 7,06 %
FrontierMath, livello 4 — problemi di ricerca 2,44 % budget di ragionamento: 32K Epoch evaluations
Problemi di scacchi 2,15 % Epoch evaluations