OpenAI

GPT 5 Mini 2025-08-07

Tipo
modello linguistico
Contesto
272K token
Uscita massima
128K
Stringa per l'API
azure/eu/gpt-5-mini-2025-08-07

Prezzi per fornitore

Fornitore Ingresso ($ per 1M) Uscita ($ per 1M) Nei nostri dati dal
Microsoft Foundry azure/gpt-5-mini-2025-08-07 $0,25 $2 31 lug 2026
OpenAI $0,25 $2 31 lug 2026
Microsoft Foundry azure/eu/gpt-5-mini-2025-08-07 $0,275 $2,2 31 lug 2026

È mostrata solo la tariffa base e solo i prezzi a token. Le tariffe batch, agevolate o in cache, così come i prezzi per immagine o per secondo di video, non entrano in questa tabella: non possono stare nella stessa colonna di un prezzo per milione di token.

Uno stesso fornitore compare più volte se vende questo modello con identificatori diversi e a prezzi diversi — per esempio con precisione dei pesi diversa. L'identificatore è indicato accanto al nome. Le offerte identiche arrivate da due fonti con grafie diverse sono unite in un'unica riga.

La data nell'ultima colonna è il giorno in cui questo prezzo è entrato per la prima volta nella nostra raccolta. Il prezzo può essere più vecchio: prima di quel giorno semplicemente non lo registravamo. Da allora non è cambiato — altrimenti al suo posto ci sarebbe una riga nuova con una data nuova.

Risultati delle misurazioni

Insieme di compiti Risultato Condizioni della prova Misurato da
MATH, livello di difficoltà cinque 97,85 % sforzo: high · con impalcatura calibrata Epoch evaluations
Mock AIME 2024–2025 — problemi da olimpiadi 86,65 % sforzo: high · con impalcatura calibrata Epoch evaluations
Scrittura creativa (valutazione di Lech Mazur) 83,1 % sforzo: medium lechmazur/writing Github repository
Fiction.LiveBench — tenuta di un contesto lungo 69,4 % sforzo: medium Fiction.live leaderboard
GPQA Diamond — domande di livello dottorale 66,67 % sforzo: high · con impalcatura calibrata Epoch evaluations
SWE-bench Verified — correzione di bug nei repository 64,67 % sforzo: medium · con impalcatura calibrata Epoch evaluations
ARC-AGI — generalizzazione su schemi nuovi 54,33 % sforzo: high · con impalcatura calibrata
WeirdML — compiti insoliti di apprendimento automatico 52,67 % sforzo: high WeirdML Leaderboard
FrontierMath, livelli 1–3 46,67 % sforzo: high Epoch evaluations
Terminal-Bench — lavoro da riga di comando 34,8 % · con impalcatura calibrata https://www.tbench.ai/leaderboard/terminal-bench/2.0
SimpleQA Verified — accuratezza fattuale 21 % sforzo: high Epoch evaluations
Humanity’s Last Exam — domande da esperto 15,38 %
FrontierMath, livello 4 — problemi di ricerca 12,2 % sforzo: high Epoch evaluations
ARC-AGI-2 4,44 % sforzo: high
CritPt — problemi di fisica 0 %