OpenAI

GPT 4.1 2025-04-14

Tipo
modello linguistico
Contesto
1.048K token
Uscita massima
33K
Stringa per l'API
azure/gpt-4.1-2025-04-14

Il fornitore ha dichiarato obsoleto questo modello. Risponde ancora, ma è meglio non avviarci nuovi progetti.

Prezzi per fornitore

Fornitore Ingresso ($ per 1M) Uscita ($ per 1M) Nei nostri dati dal
Microsoft Foundry azure/gpt-4.1-2025-04-14 $2 $8 31 lug 2026
OpenAI $2 $8 31 lug 2026
Microsoft Foundry azure/us/gpt-4.1-2025-04-14 $2,2 $8,8 31 lug 2026

È mostrata solo la tariffa base e solo i prezzi a token. Le tariffe batch, agevolate o in cache, così come i prezzi per immagine o per secondo di video, non entrano in questa tabella: non possono stare nella stessa colonna di un prezzo per milione di token.

Uno stesso fornitore compare più volte se vende questo modello con identificatori diversi e a prezzi diversi — per esempio con precisione dei pesi diversa. L'identificatore è indicato accanto al nome. Le offerte identiche arrivate da due fonti con grafie diverse sono unite in un'unica riga.

La data nell'ultima colonna è il giorno in cui questo prezzo è entrato per la prima volta nella nostra raccolta. Il prezzo può essere più vecchio: prima di quel giorno semplicemente non lo registravamo. Da allora non è cambiato — altrimenti al suo posto ci sarebbe una riga nuova con una data nuova.

Risultati delle misurazioni

Insieme di compiti Risultato Condizioni della prova Misurato da
Arena Score, dialogo a più turni 1.396,99 1.390–1.404
Arena Score in inglese 1.390,3 1.386–1.395
Arena Score, programmazione 1.390,24 1.384–1.397
Arena Score, richieste lunghe 1.382,97 1.377–1.389
Arena Score, richieste difficili 1.382,46 1.378–1.387
Arena Score, generale 1.382,06 1.378–1.386
Arena Score in francese 1.381,97 1.359–1.405
Arena Score in russo 1.373,25 1.363–1.384
Arena Score in spagnolo 1.368,54 1.349–1.388
Arena Score, matematica 1.367,35 1.357–1.378
Arena Score, rispetto delle istruzioni 1.366,42 1.361–1.372
Arena Score, scrittura creativa 1.363,66 1.356–1.371
Arena Score, domande da esperto 1.363,58 1.352–1.375
Arena Score, riconoscimento del testo nell'immagine 1.217,28 1.209–1.226
Arena Score, comprensione degli schemi 1.214,97 1.202–1.228
Arena Score, lavoro con le immagini 1.209,86 1.203–1.217
MATH, livello di difficoltà cinque 83,01 % · con impalcatura calibrata Epoch evaluations
GeoBench — individuazione di un luogo da una foto 72 % GeoBench leaderboard
Fiction.LiveBench — tenuta di un contesto lungo 63,9 % Fiction.live leaderboard
GPQA Diamond — domande di livello dottorale 55,89 % · con impalcatura calibrata Epoch evaluations
Aider Polyglot — modifiche di codice in sei linguaggi 52,4 % · con impalcatura calibrata Aider LLM Leaderboards
SWE-bench Verified — correzione di bug nei repository 48,54 % · con impalcatura calibrata Epoch evaluations
CadEval — costruzione di modelli CAD tramite codice 42 % CadEval Dashboard
WeirdML — compiti insoliti di apprendimento automatico 39,04 % WeirdML Leaderboard
Mock AIME 2024–2025 — problemi da olimpiadi 38,27 % · con impalcatura calibrata Epoch evaluations
DeepResearch Bench — ricerca approfondita 29,31 %
SimpleBench — domande trabocchetto 12,4 % SimpleBench Leaderboard
ARC-AGI — generalizzazione su schemi nuovi 5,5 % · con impalcatura calibrata ARC Prize Leaderboard
Humanity’s Last Exam — domande da esperto 0,63 %
ARC-AGI-2 0,42 %