OpenAI

o4 Mini 2025-04-16

Tipo
modello linguistico
Contesto
200K token
Uscita massima
100K
Stringa per l'API
azure/o4-mini-2025-04-16

Prezzi per fornitore

Fornitore Ingresso ($ per 1M) Uscita ($ per 1M) Nei nostri dati dal
Microsoft Foundry azure/o4-mini-2025-04-16 $1,1 $4,4 31 lug 2026
OpenAI $1,1 $4,4 31 lug 2026
Microsoft Foundry azure/us/o4-mini-2025-04-16 $1,21 $4,84 31 lug 2026

È mostrata solo la tariffa base e solo i prezzi a token. Le tariffe batch, agevolate o in cache, così come i prezzi per immagine o per secondo di video, non entrano in questa tabella: non possono stare nella stessa colonna di un prezzo per milione di token.

Uno stesso fornitore compare più volte se vende questo modello con identificatori diversi e a prezzi diversi — per esempio con precisione dei pesi diversa. L'identificatore è indicato accanto al nome. Le offerte identiche arrivate da due fonti con grafie diverse sono unite in un'unica riga.

La data nell'ultima colonna è il giorno in cui questo prezzo è entrato per la prima volta nella nostra raccolta. Il prezzo può essere più vecchio: prima di quel giorno semplicemente non lo registravamo. Da allora non è cambiato — altrimenti al suo posto ci sarebbe una riga nuova con una data nuova.

Risultati delle misurazioni

Insieme di compiti Risultato Condizioni della prova Misurato da
Arena Score, matematica 1.386,94 1.376–1.398
Arena Score, programmazione 1.368,52 1.362–1.375
Arena Score in inglese 1.366,19 1.361–1.371
Arena Score in francese 1.359,86 1.334–1.385
Arena Score, generale 1.352,74 1.349–1.357
Arena Score, richieste difficili 1.350,98 1.346–1.356
Arena Score, dialogo a più turni 1.349,24 1.342–1.356
Arena Score in spagnolo 1.345,84 1.325–1.366
Arena Score, domande da esperto 1.343,59 1.331–1.356
Arena Score in russo 1.335,24 1.325–1.346
Arena Score, rispetto delle istruzioni 1.321,33 1.315–1.327
Arena Score, richieste lunghe 1.314,94 1.308–1.322
Arena Score, scrittura creativa 1.295,6 1.287–1.304
Arena Score, riconoscimento del testo nell'immagine 1.197,64 1.189–1.206
Arena Score, comprensione degli schemi 1.197,47 1.185–1.210
Arena Score, lavoro con le immagini 1.194,83 1.188–1.202
MATH, livello di difficoltà cinque 97,83 % sforzo: high · con impalcatura calibrata Epoch evaluations
Mock AIME 2024–2025 — problemi da olimpiadi 81,65 % sforzo: low · con impalcatura calibrata Epoch evaluations
Fiction.LiveBench — tenuta di un contesto lungo 77,8 % sforzo: medium Fiction.live leaderboard
Scrittura creativa (valutazione di Lech Mazur) 75 % sforzo: medium lechmazur/writing Github repository
GPQA Diamond — domande di livello dottorale 72,81 % sforzo: low · con impalcatura calibrata Epoch evaluations
Aider Polyglot — modifiche di codice in sei linguaggi 72 % sforzo: high · con impalcatura calibrata Aider LLM Leaderboards
GeoBench — individuazione di un luogo da una foto 64 % sforzo: high GeoBench leaderboard
CadEval — costruzione di modelli CAD tramite codice 62 % sforzo: medium CadEval Dashboard
ARC-AGI — generalizzazione su schemi nuovi 58,7 % sforzo: high · con impalcatura calibrata ARC Prize Leaderboard
WeirdML — compiti insoliti di apprendimento automatico 52,56 % sforzo: high WeirdML Leaderboard
FrontierMath, livelli 1–3 36,14 % sforzo: high Epoch evaluations
SimpleBench — domande trabocchetto 26,44 % sforzo: high SimpleBench Leaderboard
GDPval — compiti di professioni reali 25,3 % sforzo: high
SimpleQA Verified — accuratezza fattuale 23,9 % sforzo: low Epoch evaluations
Problemi di scacchi 22,14 % sforzo: low Epoch evaluations
Humanity’s Last Exam — domande da esperto 13,95 % sforzo: high
ARC-AGI-2 6,11 % sforzo: high
FrontierMath, livello 4 — problemi di ricerca 4,88 % sforzo: high Epoch evaluations
GSO-Bench — ottimizzazione del codice 3,6 % sforzo: high GSO Leaderboard
CritPt — problemi di fisica 0,6 % sforzo: high