Anthropic

Claude 4.5 Opus

Tipo
modello linguistico
Contesto
200K token
Uscita massima
32K
Uscito il
1 novembre 2025
Conoscenze fino a
marzo 2025
Stringa per l'API
claude-opus-4-5-20251101

Prezzi per fornitore

Fornitore Ingresso ($ per 1M) Uscita ($ per 1M) Nei nostri dati dal
qihang-ai $0,71 $3,57 31 lug 2026
Jiekou.AI $4,5 $22,5 31 lug 2026
NanoGPT $4,998 $25,007 31 lug 2026
302.AI $5 $25 31 lug 2026
Abacus.AI $5 $25 31 lug 2026
Amazon Bedrock anthropic.claude-opus-4-5-20251101-v1:0 $5 $25 2 ago 2026
Anthropic $5 $25 31 lug 2026
LLM Gateway $5 $25 31 lug 2026
Merge Gateway $5 $25 31 lug 2026
Amazon Bedrock eu.anthropic.claude-opus-4-5-20251101-v1:0 $5,5 $27,5 2 ago 2026

È mostrata solo la tariffa base e solo i prezzi a token. Le tariffe batch, agevolate o in cache, così come i prezzi per immagine o per secondo di video, non entrano in questa tabella: non possono stare nella stessa colonna di un prezzo per milione di token.

Uno stesso fornitore compare più volte se vende questo modello con identificatori diversi e a prezzi diversi — per esempio con precisione dei pesi diversa. L'identificatore è indicato accanto al nome. Le offerte identiche arrivate da due fonti con grafie diverse sono unite in un'unica riga.

La data nell'ultima colonna è il giorno in cui questo prezzo è entrato per la prima volta nella nostra raccolta. Il prezzo può essere più vecchio: prima di quel giorno semplicemente non lo registravamo. Da allora non è cambiato — altrimenti al suo posto ci sarebbe una riga nuova con una data nuova.

Risultati delle misurazioni

Insieme di compiti Risultato Condizioni della prova Misurato da
Arena Score, programmazione 1.498,02 1.493–1.503
Arena Score, domande da esperto 1.486,32 1.477–1.495
Arena Score, richieste lunghe 1.478,41 1.473–1.483
Arena Score in francese 1.477,28 1.461–1.493
Arena Score, richieste difficili 1.474,98 1.471–1.479
Arena Score, rispetto delle istruzioni 1.471,36 1.466–1.476
Arena Score, sviluppo web 1.466,99 1.460–1.474
Arena Score, dialogo a più turni 1.464,55 1.458–1.471
Arena Score in inglese 1.460,01 1.456–1.464
Arena Score, matematica 1.459,45 1.450–1.469
Arena Score in spagnolo 1.453,21 1.438–1.468
Arena Score, generale 1.449,24 1.446–1.452
Arena Score in russo 1.446,81 1.439–1.454
Arena Score, scrittura creativa 1.440,86 1.434–1.447
Mock AIME 2024–2025 — problemi da olimpiadi 86,1 % · con impalcatura calibrata Epoch evaluations
Cybench — compiti di cybersicurezza 82 % · con impalcatura calibrata Opus 4.5 System Card autodichiarato
GPQA Diamond — domande di livello dottorale 81,4 % budget di ragionamento: 16K · con impalcatura calibrata Epoch evaluations
ARC-AGI — generalizzazione su schemi nuovi 80 % budget di ragionamento: 64K · con impalcatura calibrata ARC Prize Leaderboard
SWE-bench Verified — correzione di bug nei repository 76,65 % · con impalcatura calibrata Epoch evaluations
GeoBench — individuazione di un luogo da una foto 75 % GeoBench leaderboard
OSWorld — lavoro in un sistema operativo, prima versione 66,3 % · con impalcatura calibrata Anthropic annoucement autodichiarato
WeirdML — compiti insoliti di apprendimento automatico 63,7 % budget di ragionamento: 16K WeirdML Leaderboard
Terminal-Bench — lavoro da riga di comando 63,1 % · con impalcatura calibrata Terminal-Bench v2 Leaderboard
SimpleBench — domande trabocchetto 54,4 % SimpleBench Leaderboard
GDPval — compiti di professioni reali 45,5 %
BALROG — ambienti di gioco 43,5 % Balrog Leaderboard
SimpleQA Verified — accuratezza fattuale 41,8 % budget di ragionamento: 32K Epoch evaluations
ARC-AGI-2 37,64 % budget di ragionamento: 64K
FrontierMath, livelli 1–3 34,39 % budget di ragionamento: 32K Epoch evaluations
GSO-Bench — ottimizzazione del codice 26,5 % GSO Leaderboard
Humanity’s Last Exam — domande da esperto 21,43 %
APEX-Agents 20,7 %
Problemi di scacchi 7,41 % budget di ragionamento: 32K Epoch evaluations
FrontierMath, livello 4 — problemi di ricerca 4,88 % budget di ragionamento: 32K Epoch evaluations
Remote Labor Index — incarichi da una piattaforma di freelance 3,75 %