azure/gpt-4.1-2025-04-14Il fornitore ha dichiarato obsoleto questo modello. Risponde ancora, ma è meglio non avviarci nuovi progetti.
| Fornitore | Ingresso ($ per 1M) | Uscita ($ per 1M) | Nei nostri dati dal |
|---|---|---|---|
Microsoft Foundry
azure/gpt-4.1-2025-04-14
|
$2 | $8 | 31 lug 2026 |
| OpenAI | $2 | $8 | 31 lug 2026 |
Microsoft Foundry
azure/us/gpt-4.1-2025-04-14
|
$2,2 | $8,8 | 31 lug 2026 |
È mostrata solo la tariffa base e solo i prezzi a token. Le tariffe batch, agevolate o in cache, così come i prezzi per immagine o per secondo di video, non entrano in questa tabella: non possono stare nella stessa colonna di un prezzo per milione di token.
Uno stesso fornitore compare più volte se vende questo modello con identificatori diversi e a prezzi diversi — per esempio con precisione dei pesi diversa. L'identificatore è indicato accanto al nome. Le offerte identiche arrivate da due fonti con grafie diverse sono unite in un'unica riga.
La data nell'ultima colonna è il giorno in cui questo prezzo è entrato per la prima volta nella nostra raccolta. Il prezzo può essere più vecchio: prima di quel giorno semplicemente non lo registravamo. Da allora non è cambiato — altrimenti al suo posto ci sarebbe una riga nuova con una data nuova.
| Insieme di compiti | Risultato | Condizioni della prova | Misurato da |
|---|---|---|---|
| Arena Score, dialogo a più turni | 1.396,99 1.390–1.404 | — | — |
| Arena Score in inglese | 1.390,3 1.386–1.395 | — | — |
| Arena Score, programmazione | 1.390,24 1.384–1.397 | — | — |
| Arena Score, richieste lunghe | 1.382,97 1.377–1.389 | — | — |
| Arena Score, richieste difficili | 1.382,46 1.378–1.387 | — | — |
| Arena Score, generale | 1.382,06 1.378–1.386 | — | — |
| Arena Score in francese | 1.381,97 1.359–1.405 | — | — |
| Arena Score in russo | 1.373,25 1.363–1.384 | — | — |
| Arena Score in spagnolo | 1.368,54 1.349–1.388 | — | — |
| Arena Score, matematica | 1.367,35 1.357–1.378 | — | — |
| Arena Score, rispetto delle istruzioni | 1.366,42 1.361–1.372 | — | — |
| Arena Score, scrittura creativa | 1.363,66 1.356–1.371 | — | — |
| Arena Score, domande da esperto | 1.363,58 1.352–1.375 | — | — |
| Arena Score, riconoscimento del testo nell'immagine | 1.217,28 1.209–1.226 | — | — |
| Arena Score, comprensione degli schemi | 1.214,97 1.202–1.228 | — | — |
| Arena Score, lavoro con le immagini | 1.209,86 1.203–1.217 | — | — |
| MATH, livello di difficoltà cinque | 83,01 % | · con impalcatura calibrata | Epoch evaluations |
| GeoBench — individuazione di un luogo da una foto | 72 % | — | GeoBench leaderboard |
| Fiction.LiveBench — tenuta di un contesto lungo | 63,9 % | — | Fiction.live leaderboard |
| GPQA Diamond — domande di livello dottorale | 55,89 % | · con impalcatura calibrata | Epoch evaluations |
| Aider Polyglot — modifiche di codice in sei linguaggi | 52,4 % | · con impalcatura calibrata | Aider LLM Leaderboards |
| SWE-bench Verified — correzione di bug nei repository | 48,54 % | · con impalcatura calibrata | Epoch evaluations |
| CadEval — costruzione di modelli CAD tramite codice | 42 % | — | CadEval Dashboard |
| WeirdML — compiti insoliti di apprendimento automatico | 39,04 % | — | WeirdML Leaderboard |
| Mock AIME 2024–2025 — problemi da olimpiadi | 38,27 % | · con impalcatura calibrata | Epoch evaluations |
| DeepResearch Bench — ricerca approfondita | 29,31 % | — | — |
| SimpleBench — domande trabocchetto | 12,4 % | — | SimpleBench Leaderboard |
| ARC-AGI — generalizzazione su schemi nuovi | 5,5 % | · con impalcatura calibrata | ARC Prize Leaderboard |
| Humanity’s Last Exam — domande da esperto | 0,63 % | — | — |
| ARC-AGI-2 | 0,42 % | — | — |