OpenAI

o3 Mini 2025-01-31

Tipo
modello linguistico
Contesto
200K token
Uscita massima
100K
Stringa per l'API
azure/eu/o3-mini-2025-01-31

Prezzi per fornitore

Fornitore Ingresso ($ per 1M) Uscita ($ per 1M) Nei nostri dati dal
Microsoft Foundry azure/o3-mini-2025-01-31 $1,1 $4,4 31 lug 2026
OpenAI $1,1 $4,4 31 lug 2026
Microsoft Foundry azure/eu/o3-mini-2025-01-31 $1,21 $4,84 31 lug 2026

È mostrata solo la tariffa base e solo i prezzi a token. Le tariffe batch, agevolate o in cache, così come i prezzi per immagine o per secondo di video, non entrano in questa tabella: non possono stare nella stessa colonna di un prezzo per milione di token.

Uno stesso fornitore compare più volte se vende questo modello con identificatori diversi e a prezzi diversi — per esempio con precisione dei pesi diversa. L'identificatore è indicato accanto al nome. Le offerte identiche arrivate da due fonti con grafie diverse sono unite in un'unica riga.

La data nell'ultima colonna è il giorno in cui questo prezzo è entrato per la prima volta nella nostra raccolta. Il prezzo può essere più vecchio: prima di quel giorno semplicemente non lo registravamo. Da allora non è cambiato — altrimenti al suo posto ci sarebbe una riga nuova con una data nuova.

Risultati delle misurazioni

Insieme di compiti Risultato Condizioni della prova Misurato da
MATH, livello di difficoltà cinque 96,49 % sforzo: high · con impalcatura calibrata Epoch evaluations
Mock AIME 2024–2025 — problemi da olimpiadi 76,92 % sforzo: low · con impalcatura calibrata Epoch evaluations
GPQA Diamond — domande di livello dottorale 69,36 % sforzo: low · con impalcatura calibrata Epoch evaluations
Scrittura creativa (valutazione di Lech Mazur) 61,7 % sforzo: high lechmazur/writing Github repository
Aider Polyglot — modifiche di codice in sei linguaggi 60,4 % sforzo: medium · con impalcatura calibrata Aider LLM Leaderboards
CadEval — costruzione di modelli CAD tramite codice 54 % sforzo: medium CadEval Dashboard
Fiction.LiveBench — tenuta di un contesto lungo 50 % sforzo: medium Fiction.live leaderboard
WeirdML — compiti insoliti di apprendimento automatico 43,7 % sforzo: high WeirdML Leaderboard
ARC-AGI — generalizzazione su schemi nuovi 34,5 % sforzo: high · con impalcatura calibrata ARC Prize Leaderboard
Cybench — compiti di cybersicurezza 22,5 % sforzo: medium · con impalcatura calibrata Cybench leaderboard
FrontierMath, livelli 1–3 18,6 % sforzo: high Epoch evaluations
Problemi di scacchi 12,67 % sforzo: low Epoch evaluations
SimpleBench — domande trabocchetto 7,36 % sforzo: high SimpleBench Leaderboard
ARC-AGI-2 2,99 % sforzo: high
GSO-Bench — ottimizzazione del codice 1,3 % sforzo: low GSO Leaderboard
FrontierMath, livello 4 — problemi di ricerca 0 % sforzo: high Epoch evaluations