OpenAI

OpenAI: GPT-4o-mini (2024-07-18)

Tipo
modello linguistico
Contesto
128K token
Uscita massima
16K
Uscito il
18 luglio 2024
Conoscenze fino a
ottobre 2023
Stringa per l'API
openai/gpt-4o-mini-2024-07-18

Prezzi per fornitore

Fornitore Ingresso ($ per 1M) Uscita ($ per 1M) Nei nostri dati dal
Kilo Code $0,15 $0,6 31 lug 2026
OpenAI $0,15 $0,6 31 lug 2026
OpenRouter $0,15 $0,6 31 lug 2026
Microsoft Foundry $0,165 $0,66 31 lug 2026
Venice AI $0,188 $0,75 1 ago 2026

È mostrata solo la tariffa base e solo i prezzi a token. Le tariffe batch, agevolate o in cache, così come i prezzi per immagine o per secondo di video, non entrano in questa tabella: non possono stare nella stessa colonna di un prezzo per milione di token.

La data nell'ultima colonna è il giorno in cui questo prezzo è entrato per la prima volta nella nostra raccolta. Il prezzo può essere più vecchio: prima di quel giorno semplicemente non lo registravamo. Da allora non è cambiato — altrimenti al suo posto ci sarebbe una riga nuova con una data nuova.

Risultati delle misurazioni

Insieme di compiti Risultato Condizioni della prova Misurato da
Arena Score in inglese 1.300,59 1.296–1.305
Arena Score in francese 1.295,68 1.271–1.320
Arena Score, programmazione 1.290,12 1.284–1.297
Arena Score, richieste lunghe 1.288,94 1.282–1.296
Arena Score, generale 1.286,57 1.283–1.290
Arena Score, dialogo a più turni 1.285,04 1.278–1.292
Arena Score in spagnolo 1.278,34 1.255–1.302
Arena Score in russo 1.274,29 1.267–1.282
Arena Score, scrittura creativa 1.268,26 1.261–1.275
Arena Score, matematica 1.267,33 1.260–1.274
Arena Score, richieste difficili 1.267,19 1.262–1.272
Arena Score, rispetto delle istruzioni 1.258,81 1.254–1.264
Arena Score, domande da esperto 1.233,87 1.223–1.245
Arena Score, lavoro con le immagini 1.065,76 1.058–1.074
Scrittura creativa (valutazione di Lech Mazur) 67,2 % lechmazur/writing Github repository
GeoBench — individuazione di un luogo da una foto 64 % GeoBench leaderboard
MATH, livello di difficoltà cinque 52,63 % · con impalcatura calibrata Epoch evaluations
BALROG — ambienti di gioco 17,4 % Balrog Leaderboard
GPQA Diamond — domande di livello dottorale 16,96 % · con impalcatura calibrata Epoch evaluations
WeirdML — compiti insoliti di apprendimento automatico 11,76 % WeirdML Leaderboard
Mock AIME 2024–2025 — problemi da olimpiadi 6,85 % · con impalcatura calibrata Epoch evaluations
Aider Polyglot — modifiche di codice in sei linguaggi 3,6 % · con impalcatura calibrata Aider LLM Leaderboards
ARC-AGI-2 0 %
SimpleBench — domande trabocchetto 0 % SimpleBench Leaderboard
Problemi di scacchi 0 % Epoch evaluations