openai/gpt-5.1-2025-11-13| Fornitore | Ingresso ($ per 1M) | Uscita ($ per 1M) | Nei nostri dati dal |
|---|---|---|---|
| Microsoft Foundry | $1,25 | $10 | 31 lug 2026 |
| NanoGPT | $1,25 | $10 | 31 lug 2026 |
| OpenAI | $1,25 | $10 | 31 lug 2026 |
È mostrata solo la tariffa base e solo i prezzi a token. Le tariffe batch, agevolate o in cache, così come i prezzi per immagine o per secondo di video, non entrano in questa tabella: non possono stare nella stessa colonna di un prezzo per milione di token.
La data nell'ultima colonna è il giorno in cui questo prezzo è entrato per la prima volta nella nostra raccolta. Il prezzo può essere più vecchio: prima di quel giorno semplicemente non lo registravamo. Da allora non è cambiato — altrimenti al suo posto ci sarebbe una riga nuova con una data nuova.
| Insieme di compiti | Risultato | Condizioni della prova | Misurato da |
|---|---|---|---|
| Mock AIME 2024–2025 — problemi da olimpiadi | 88,6 % | sforzo: low · con impalcatura calibrata | Epoch evaluations |
| GPQA Diamond — domande di livello dottorale | 83,5 % | sforzo: medium · con impalcatura calibrata | Epoch evaluations |
| ARC-AGI — generalizzazione su schemi nuovi | 72,8 % | sforzo: high · con impalcatura calibrata | ARC Prize Leaderboard |
| SWE-bench Verified — correzione di bug nei repository | 67,98 % | sforzo: high · con impalcatura calibrata | Epoch evaluations |
| WeirdML — compiti insoliti di apprendimento automatico | 60,77 % | sforzo: high | WeirdML Leaderboard |
| SimpleQA Verified — accuratezza fattuale | 48,9 % | sforzo: high | Epoch evaluations |
| Terminal-Bench — lavoro da riga di comando | 47,6 % | · con impalcatura calibrata | Terminal-Bench v2 Leaderboard |
| SimpleBench — domande trabocchetto | 43,84 % | sforzo: high | SimpleBench Leaderboard |
| DeepResearch Bench — ricerca approfondita | 42,79 % | sforzo: low | https://drb.futuresearch.ai/#drb autodichiarato |
| Problemi di scacchi | 28,45 % | sforzo: high | Epoch evaluations |
| Humanity’s Last Exam — domande da esperto | 19,83 % | — | — |
| ARC-AGI-2 | 17,64 % | sforzo: high | — |
| APEX-Agents | 17,5 % | sforzo: high | — |
| GSO-Bench — ottimizzazione del codice | 13,73 % | — | https://gso-bench.github.io/index.html |
| CritPt — problemi di fisica | 4,86 % | — | — |