Google DeepMind

Gemini 3.1 Pro Preview

Tipo
modello linguistico
Contesto
1.049K token
Uscita massima
66K
Uscito il
19 febbraio 2026
Conoscenze fino a
febbraio 2026
Stringa per l'API
gemini/gemini-3.1-pro-preview

Prezzi per fornitore

Fornitore Ingresso ($ per 1M) Uscita ($ per 1M) Nei nostri dati dal
vivgrid $2 $12 31 lug 2026
daoxe $2 $12 31 lug 2026
frogbot $2 $12 31 lug 2026
auriko $2 $12 31 lug 2026
ofox $2 $12 31 lug 2026
perplexity-agent $2 $12 31 lug 2026
AIHubMix $2 $12 31 lug 2026
Abacus.AI $2 $12 31 lug 2026
CrossModel $2 $12 31 lug 2026
FastRouter $2 $12 31 lug 2026
GitHub Copilot $2 $12 31 lug 2026
Google DeepMind $2 $12 31 lug 2026
Google Vertex AI $2 $12 31 lug 2026
Kilo Code $2 $12 31 lug 2026
LLM Gateway $2 $12 31 lug 2026
Merge Gateway $2 $12 31 lug 2026
NanoGPT $2 $12 31 lug 2026
OpenRouter $2 $12 31 lug 2026
Vercel $2 $12 31 lug 2026
ZenMux $2 $12 31 lug 2026
Venice AI $2,5 $15 31 lug 2026
OrcaRouter $4 $18 31 lug 2026

È mostrata solo la tariffa base e solo i prezzi a token. Le tariffe batch, agevolate o in cache, così come i prezzi per immagine o per secondo di video, non entrano in questa tabella: non possono stare nella stessa colonna di un prezzo per milione di token.

La data nell'ultima colonna è il giorno in cui questo prezzo è entrato per la prima volta nella nostra raccolta. Il prezzo può essere più vecchio: prima di quel giorno semplicemente non lo registravamo. Da allora non è cambiato — altrimenti al suo posto ci sarebbe una riga nuova con una data nuova.

Risultati delle misurazioni

Insieme di compiti Risultato Condizioni della prova Misurato da
Arena Score in russo 1.495,77 1.488–1.503
Arena Score, matematica 1.489,07 1.480–1.498
Arena Score in francese 1.488,01 1.474–1.502
Arena Score, domande da esperto 1.486,42 1.479–1.494
Arena Score, richieste difficili 1.484,41 1.480–1.489
Arena Score, programmazione 1.483,89 1.479–1.489
Arena Score, dialogo a più turni 1.482,41 1.476–1.489
Arena Score, richieste lunghe 1.482,3 1.477–1.487
Arena Score, scrittura creativa 1.481,61 1.475–1.488
Arena Score in spagnolo 1.479,93 1.467–1.493
Arena Score, generale 1.479,46 1.476–1.483
Arena Score in inglese 1.478,03 1.474–1.483
Arena Score, rispetto delle istruzioni 1.467,43 1.462–1.473
Arena Score, sviluppo web 1.446,83 1.441–1.452
Arena Score, comprensione degli schemi 1.312,53 1.305–1.320
Arena Score, riconoscimento del testo nell'immagine 1.305,79 1.300–1.311
Arena Score, lavoro con le immagini 1.295,15 1.289–1.301
ARC-AGI — generalizzazione su schemi nuovi 98 % · con impalcatura calibrata ARC Prize Leaderboard
Mock AIME 2024–2025 — problemi da olimpiadi 95,6 % · con impalcatura calibrata Epoch evaluations
GPQA Diamond — domande di livello dottorale 92,13 % · con impalcatura calibrata Epoch evaluations
Terminal-Bench — lavoro da riga di comando 80,2 % · con impalcatura calibrata https://www.tbench.ai/leaderboard/terminal-bench/2.0
SimpleQA Verified — accuratezza fattuale 77,3 % Epoch evaluations
ARC-AGI-2 77,1 %
SimpleBench — domande trabocchetto 75,52 % SimpleBench Leaderboard
WeirdML — compiti insoliti di apprendimento automatico 72,1 % WeirdML Leaderboard
FrontierMath, livelli 1–3 59,65 % Epoch evaluations
BALROG — ambienti di gioco 57 % Balrog Leaderboard
Problemi di scacchi 52,65 % Epoch evaluations
Humanity’s Last Exam — domande da esperto 43,74 %
APEX-Agents 33,5 %
FrontierMath, livello 4 — problemi di ricerca 26,83 % Epoch evaluations
GSO-Bench — ottimizzazione del codice 22,55 % https://gso-bench.github.io/index.html
CritPt — problemi di fisica 17,71 %
Arena Score, compiti di agente -0,01 0–0