OpenAI

o1 2024-12-17

Tipo
modello linguistico
Contesto
200K token
Uscita massima
100K
Stringa per l'API
azure/eu/o1-2024-12-17

Prezzi per fornitore

Fornitore Ingresso ($ per 1M) Uscita ($ per 1M) Nei nostri dati dal
Microsoft Foundry azure/o1-2024-12-17 $15 $60 31 lug 2026
OpenAI $15 $60 31 lug 2026
Microsoft Foundry azure/eu/o1-2024-12-17 $16,5 $66 31 lug 2026

È mostrata solo la tariffa base e solo i prezzi a token. Le tariffe batch, agevolate o in cache, così come i prezzi per immagine o per secondo di video, non entrano in questa tabella: non possono stare nella stessa colonna di un prezzo per milione di token.

Uno stesso fornitore compare più volte se vende questo modello con identificatori diversi e a prezzi diversi — per esempio con precisione dei pesi diversa. L'identificatore è indicato accanto al nome. Le offerte identiche arrivate da due fonti con grafie diverse sono unite in un'unica riga.

La data nell'ultima colonna è il giorno in cui questo prezzo è entrato per la prima volta nella nostra raccolta. Il prezzo può essere più vecchio: prima di quel giorno semplicemente non lo registravamo. Da allora non è cambiato — altrimenti al suo posto ci sarebbe una riga nuova con una data nuova.

Risultati delle misurazioni

Insieme di compiti Risultato Condizioni della prova Misurato da
Arena Score, matematica 1.388,33 1.378–1.399
Arena Score, richieste lunghe 1.377,99 1.368–1.388
Arena Score in inglese 1.372,18 1.367–1.378
Arena Score, richieste difficili 1.371,69 1.364–1.379
Arena Score, rispetto delle istruzioni 1.367,83 1.361–1.374
Arena Score, programmazione 1.367,4 1.358–1.377
Arena Score, generale 1.365,96 1.362–1.370
Arena Score, domande da esperto 1.361,05 1.344–1.378
Arena Score in russo 1.354,9 1.344–1.365
Arena Score, dialogo a più turni 1.354,76 1.346–1.364
Arena Score, scrittura creativa 1.347,89 1.339–1.357
Arena Score in francese 1.343,31 1.306–1.380
Arena Score in spagnolo 1.341,83 1.294–1.390
Arena Score, lavoro con le immagini 1.168,58 1.158–1.179
MATH, livello di difficoltà cinque 94,71 % sforzo: high · con impalcatura calibrata Epoch evaluations
Fiction.LiveBench — tenuta di un contesto lungo 83,3 % sforzo: medium Fiction.live leaderboard
GeoBench — individuazione di un luogo da una foto 80 % sforzo: medium GeoBench leaderboard
Mock AIME 2024–2025 — problemi da olimpiadi 73,31 % sforzo: low · con impalcatura calibrata Epoch evaluations
Scrittura creativa (valutazione di Lech Mazur) 70,2 % sforzo: medium lechmazur/writing Github repository
GPQA Diamond — domande di livello dottorale 69,02 % sforzo: low · con impalcatura calibrata Epoch evaluations
Aider Polyglot — modifiche di codice in sei linguaggi 61,7 % sforzo: high · con impalcatura calibrata Aider LLM Leaderboards
CadEval — costruzione di modelli CAD tramite codice 56 % sforzo: medium CadEval Dashboard
WeirdML — compiti insoliti di apprendimento automatico 43,82 % sforzo: high WeirdML Leaderboard
ARC-AGI — generalizzazione su schemi nuovi 30,7 % sforzo: medium · con impalcatura calibrata ARC Prize Leaderboard
SimpleBench — domande trabocchetto 28,12 % sforzo: high SimpleBench Leaderboard
Humanity’s Last Exam — domande da esperto 3,32 %
Problemi di scacchi 2,15 % sforzo: low Epoch evaluations
APEX-Agents 1,1 % sforzo: high