azure/eu/o3-mini-2025-01-31| Fornitore | Ingresso ($ per 1M) | Uscita ($ per 1M) | Nei nostri dati dal |
|---|---|---|---|
Microsoft Foundry
azure/o3-mini-2025-01-31
|
$1,1 | $4,4 | 31 lug 2026 |
| OpenAI | $1,1 | $4,4 | 31 lug 2026 |
Microsoft Foundry
azure/eu/o3-mini-2025-01-31
|
$1,21 | $4,84 | 31 lug 2026 |
È mostrata solo la tariffa base e solo i prezzi a token. Le tariffe batch, agevolate o in cache, così come i prezzi per immagine o per secondo di video, non entrano in questa tabella: non possono stare nella stessa colonna di un prezzo per milione di token.
Uno stesso fornitore compare più volte se vende questo modello con identificatori diversi e a prezzi diversi — per esempio con precisione dei pesi diversa. L'identificatore è indicato accanto al nome. Le offerte identiche arrivate da due fonti con grafie diverse sono unite in un'unica riga.
La data nell'ultima colonna è il giorno in cui questo prezzo è entrato per la prima volta nella nostra raccolta. Il prezzo può essere più vecchio: prima di quel giorno semplicemente non lo registravamo. Da allora non è cambiato — altrimenti al suo posto ci sarebbe una riga nuova con una data nuova.
| Insieme di compiti | Risultato | Condizioni della prova | Misurato da |
|---|---|---|---|
| MATH, livello di difficoltà cinque | 96,49 % | sforzo: high · con impalcatura calibrata | Epoch evaluations |
| Mock AIME 2024–2025 — problemi da olimpiadi | 76,92 % | sforzo: low · con impalcatura calibrata | Epoch evaluations |
| GPQA Diamond — domande di livello dottorale | 69,36 % | sforzo: low · con impalcatura calibrata | Epoch evaluations |
| Scrittura creativa (valutazione di Lech Mazur) | 61,7 % | sforzo: high | lechmazur/writing Github repository |
| Aider Polyglot — modifiche di codice in sei linguaggi | 60,4 % | sforzo: medium · con impalcatura calibrata | Aider LLM Leaderboards |
| CadEval — costruzione di modelli CAD tramite codice | 54 % | sforzo: medium | CadEval Dashboard |
| Fiction.LiveBench — tenuta di un contesto lungo | 50 % | sforzo: medium | Fiction.live leaderboard |
| WeirdML — compiti insoliti di apprendimento automatico | 43,7 % | sforzo: high | WeirdML Leaderboard |
| ARC-AGI — generalizzazione su schemi nuovi | 34,5 % | sforzo: high · con impalcatura calibrata | ARC Prize Leaderboard |
| Cybench — compiti di cybersicurezza | 22,5 % | sforzo: medium · con impalcatura calibrata | Cybench leaderboard |
| FrontierMath, livelli 1–3 | 18,6 % | sforzo: high | Epoch evaluations |
| Problemi di scacchi | 12,67 % | sforzo: low | Epoch evaluations |
| SimpleBench — domande trabocchetto | 7,36 % | sforzo: high | SimpleBench Leaderboard |
| ARC-AGI-2 | 2,99 % | sforzo: high | — |
| GSO-Bench — ottimizzazione del codice | 1,3 % | sforzo: low | GSO Leaderboard |
| FrontierMath, livello 4 — problemi di ricerca | 0 % | sforzo: high | Epoch evaluations |