xAI

Grok 3 Mini

Tipo
modello linguistico
Contesto
131K token
Uscita massima
8K
Uscito il
11 aprile 2025
Stringa per l'API
xai/grok-3-mini

Prezzi per fornitore

Fornitore Ingresso ($ per 1M) Uscita ($ per 1M) Nei nostri dati dal
Microsoft Foundry $0,25 $1,27 31 lug 2026
vercel_ai_gateway $0,3 $0,5 31 lug 2026
Helicone $0,3 $0,5 31 lug 2026
OCI Generative AI $0,3 $0,5 31 lug 2026
Poe $0,3 $0,5 31 lug 2026
xAI $0,3 $0,5 31 lug 2026

È mostrata solo la tariffa base e solo i prezzi a token. Le tariffe batch, agevolate o in cache, così come i prezzi per immagine o per secondo di video, non entrano in questa tabella: non possono stare nella stessa colonna di un prezzo per milione di token.

La data nell'ultima colonna è il giorno in cui questo prezzo è entrato per la prima volta nella nostra raccolta. Il prezzo può essere più vecchio: prima di quel giorno semplicemente non lo registravamo. Da allora non è cambiato — altrimenti al suo posto ci sarebbe una riga nuova con una data nuova.

Risultati delle misurazioni

Insieme di compiti Risultato Condizioni della prova Misurato da
Arena Score in inglese 1.373,29 1.367–1.380
Arena Score, matematica 1.370,22 1.356–1.384
Arena Score, programmazione 1.366,03 1.357–1.375
Arena Score, richieste difficili 1.363,32 1.357–1.370
Arena Score, generale 1.362,74 1.358–1.368
Arena Score, domande da esperto 1.360,62 1.344–1.378
Arena Score, richieste lunghe 1.356,9 1.348–1.366
Arena Score in spagnolo 1.355,7 1.322–1.390 sforzo: high
Arena Score in francese 1.352,74 1.308–1.398 sforzo: high
Arena Score in russo 1.350,69 1.335–1.366
Arena Score, dialogo a più turni 1.349,13 1.340–1.359
Arena Score, rispetto delle istruzioni 1.345,63 1.338–1.354
Arena Score, scrittura creativa 1.330,28 1.317–1.343 sforzo: high
MATH, livello di difficoltà cinque 90,94 % sforzo: low · con impalcatura calibrata Epoch evaluations
Mock AIME 2024–2025 — problemi da olimpiadi 77,76 % sforzo: low · con impalcatura calibrata Epoch evaluations
Scrittura creativa (valutazione di Lech Mazur) 73,5 % sforzo: low lechmazur/writing Github repository
GPQA Diamond — domande di livello dottorale 68,35 % sforzo: high · con impalcatura calibrata Epoch evaluations
Fiction.LiveBench — tenuta di un contesto lungo 66,7 % sforzo: medium Fiction.live leaderboard
Aider Polyglot — modifiche di codice in sei linguaggi 49,3 % sforzo: low · con impalcatura calibrata Aider LLM Leaderboards
WeirdML — compiti insoliti di apprendimento automatico 42,58 % sforzo: high WeirdML Leaderboard
SimpleQA Verified — accuratezza fattuale 21,1 % sforzo: high Epoch evaluations
ARC-AGI — generalizzazione su schemi nuovi 16,5 % sforzo: low · con impalcatura calibrata ARC Prize Leaderboard
ARC-AGI-2 0,42 % sforzo: low