azure/eu/gpt-5-2025-08-07| Fornitore | Ingresso ($ per 1M) | Uscita ($ per 1M) | Nei nostri dati dal |
|---|---|---|---|
Microsoft Foundry
azure/gpt-5-2025-08-07
|
$1,25 | $10 | 31 lug 2026 |
| OpenAI | $1,25 | $10 | 31 lug 2026 |
Microsoft Foundry
azure/eu/gpt-5-2025-08-07
|
$1,375 | $11 | 31 lug 2026 |
È mostrata solo la tariffa base e solo i prezzi a token. Le tariffe batch, agevolate o in cache, così come i prezzi per immagine o per secondo di video, non entrano in questa tabella: non possono stare nella stessa colonna di un prezzo per milione di token.
Uno stesso fornitore compare più volte se vende questo modello con identificatori diversi e a prezzi diversi — per esempio con precisione dei pesi diversa. L'identificatore è indicato accanto al nome. Le offerte identiche arrivate da due fonti con grafie diverse sono unite in un'unica riga.
La data nell'ultima colonna è il giorno in cui questo prezzo è entrato per la prima volta nella nostra raccolta. Il prezzo può essere più vecchio: prima di quel giorno semplicemente non lo registravamo. Da allora non è cambiato — altrimenti al suo posto ci sarebbe una riga nuova con una data nuova.
| Insieme di compiti | Risultato | Condizioni della prova | Misurato da |
|---|---|---|---|
| MATH, livello di difficoltà cinque | 98,13 % | sforzo: high · con impalcatura calibrata | Epoch evaluations |
| Fiction.LiveBench — tenuta di un contesto lungo | 97,2 % | sforzo: medium | Fiction.live leaderboard |
| Mock AIME 2024–2025 — problemi da olimpiadi | 91,38 % | sforzo: minimal · con impalcatura calibrata | Epoch evaluations |
| Aider Polyglot — modifiche di codice in sei linguaggi | 88 % | sforzo: low · con impalcatura calibrata | Aider LLM Leaderboards |
| Scrittura creativa (valutazione di Lech Mazur) | 86 % | sforzo: medium | lechmazur/writing Github repository |
| GPQA Diamond — domande di livello dottorale | 81,57 % | sforzo: minimal · con impalcatura calibrata | Epoch evaluations |
| GeoBench — individuazione di un luogo da una foto | 81 % | sforzo: medium | GeoBench leaderboard |
| SWE-bench Verified — correzione di bug nei repository | 73,55 % | sforzo: high · con impalcatura calibrata | Epoch evaluations |
| ARC-AGI — generalizzazione su schemi nuovi | 65,7 % | sforzo: high · con impalcatura calibrata | ARC Prize Leaderboard |
| WeirdML — compiti insoliti di apprendimento automatico | 60,7 % | sforzo: high | WeirdML Leaderboard |
| FrontierMath, livelli 1–3 | 55,44 % | sforzo: high | Epoch evaluations |
| DeepResearch Bench — ricerca approfondita | 55,13 % | — | DeepResearchBench Leaderboard |
| SimpleQA Verified — accuratezza fattuale | 50,6 % | sforzo: high | Epoch evaluations |
| Terminal-Bench — lavoro da riga di comando | 49,6 % | · con impalcatura calibrata | Terminal-Bench v2 Leaderboard |
| SimpleBench — domande trabocchetto | 48,04 % | sforzo: high | SimpleBench Leaderboard |
| GDPval — compiti di professioni reali | 34,8 % | sforzo: medium | — |
| Problemi di scacchi | 33,71 % | sforzo: minimal | Epoch evaluations |
| BALROG — ambienti di gioco | 32,8 % | sforzo: minimal | Balrog Leaderboard |
| FrontierMath, livello 4 — problemi di ricerca | 21,95 % | sforzo: high | Epoch evaluations |
| Humanity’s Last Exam — domande da esperto | 21,56 % | sforzo: high | — |
| APEX-Agents | 18,3 % | sforzo: high | — |
| CritPt — problemi di fisica | 12,6 % | sforzo: high | — |
| ARC-AGI-2 | 9,86 % | sforzo: high | — |
| GSO-Bench — ottimizzazione del codice | 6,9 % | sforzo: high | GSO Leaderboard |
| Remote Labor Index — incarichi da una piattaforma di freelance | 1,67 % | — | — |