OpenAI

GPT 5 2025-08-07

Tipo
modello linguistico
Contesto
272K token
Uscita massima
128K
Stringa per l'API
azure/eu/gpt-5-2025-08-07

Prezzi per fornitore

Fornitore Ingresso ($ per 1M) Uscita ($ per 1M) Nei nostri dati dal
Microsoft Foundry azure/gpt-5-2025-08-07 $1,25 $10 31 lug 2026
OpenAI $1,25 $10 31 lug 2026
Microsoft Foundry azure/eu/gpt-5-2025-08-07 $1,375 $11 31 lug 2026

È mostrata solo la tariffa base e solo i prezzi a token. Le tariffe batch, agevolate o in cache, così come i prezzi per immagine o per secondo di video, non entrano in questa tabella: non possono stare nella stessa colonna di un prezzo per milione di token.

Uno stesso fornitore compare più volte se vende questo modello con identificatori diversi e a prezzi diversi — per esempio con precisione dei pesi diversa. L'identificatore è indicato accanto al nome. Le offerte identiche arrivate da due fonti con grafie diverse sono unite in un'unica riga.

La data nell'ultima colonna è il giorno in cui questo prezzo è entrato per la prima volta nella nostra raccolta. Il prezzo può essere più vecchio: prima di quel giorno semplicemente non lo registravamo. Da allora non è cambiato — altrimenti al suo posto ci sarebbe una riga nuova con una data nuova.

Risultati delle misurazioni

Insieme di compiti Risultato Condizioni della prova Misurato da
MATH, livello di difficoltà cinque 98,13 % sforzo: high · con impalcatura calibrata Epoch evaluations
Fiction.LiveBench — tenuta di un contesto lungo 97,2 % sforzo: medium Fiction.live leaderboard
Mock AIME 2024–2025 — problemi da olimpiadi 91,38 % sforzo: minimal · con impalcatura calibrata Epoch evaluations
Aider Polyglot — modifiche di codice in sei linguaggi 88 % sforzo: low · con impalcatura calibrata Aider LLM Leaderboards
Scrittura creativa (valutazione di Lech Mazur) 86 % sforzo: medium lechmazur/writing Github repository
GPQA Diamond — domande di livello dottorale 81,57 % sforzo: minimal · con impalcatura calibrata Epoch evaluations
GeoBench — individuazione di un luogo da una foto 81 % sforzo: medium GeoBench leaderboard
SWE-bench Verified — correzione di bug nei repository 73,55 % sforzo: high · con impalcatura calibrata Epoch evaluations
ARC-AGI — generalizzazione su schemi nuovi 65,7 % sforzo: high · con impalcatura calibrata ARC Prize Leaderboard
WeirdML — compiti insoliti di apprendimento automatico 60,7 % sforzo: high WeirdML Leaderboard
FrontierMath, livelli 1–3 55,44 % sforzo: high Epoch evaluations
DeepResearch Bench — ricerca approfondita 55,13 % DeepResearchBench Leaderboard
SimpleQA Verified — accuratezza fattuale 50,6 % sforzo: high Epoch evaluations
Terminal-Bench — lavoro da riga di comando 49,6 % · con impalcatura calibrata Terminal-Bench v2 Leaderboard
SimpleBench — domande trabocchetto 48,04 % sforzo: high SimpleBench Leaderboard
GDPval — compiti di professioni reali 34,8 % sforzo: medium
Problemi di scacchi 33,71 % sforzo: minimal Epoch evaluations
BALROG — ambienti di gioco 32,8 % sforzo: minimal Balrog Leaderboard
FrontierMath, livello 4 — problemi di ricerca 21,95 % sforzo: high Epoch evaluations
Humanity’s Last Exam — domande da esperto 21,56 % sforzo: high
APEX-Agents 18,3 % sforzo: high
CritPt — problemi di fisica 12,6 % sforzo: high
ARC-AGI-2 9,86 % sforzo: high
GSO-Bench — ottimizzazione del codice 6,9 % sforzo: high GSO Leaderboard
Remote Labor Index — incarichi da una piattaforma di freelance 1,67 %