phi-4| Fornitore | Ingresso ($ per 1M) | Uscita ($ per 1M) | Nei nostri dati dal |
|---|---|---|---|
| Kilo Code | $0,06 | $0,14 | 31 lug 2026 |
| DeepInfra | $0,07 | $0,14 | 31 lug 2026 |
| OpenRouter | $0,07 | $0,14 | 31 lug 2026 |
| Azure Cognitive Services | $0,125 | $0,5 | 31 lug 2026 |
| Microsoft Foundry | $0,125 | $0,5 | 31 lug 2026 |
È mostrata solo la tariffa base e solo i prezzi a token. Le tariffe batch, agevolate o in cache, così come i prezzi per immagine o per secondo di video, non entrano in questa tabella: non possono stare nella stessa colonna di un prezzo per milione di token.
La data nell'ultima colonna è il giorno in cui questo prezzo è entrato per la prima volta nella nostra raccolta. Il prezzo può essere più vecchio: prima di quel giorno semplicemente non lo registravamo. Da allora non è cambiato — altrimenti al suo posto ci sarebbe una riga nuova con una data nuova.
| Insieme di compiti | Risultato | Condizioni della prova | Misurato da |
|---|---|---|---|
| Arena Score, matematica | 1.245,75 1.235–1.256 | — | — |
| Arena Score, programmazione | 1.231,82 1.222–1.242 | — | — |
| Arena Score in spagnolo | 1.231,27 1.180–1.283 | — | — |
| Arena Score in inglese | 1.230,95 1.225–1.237 | — | — |
| Arena Score in francese | 1.223,46 1.184–1.263 | — | — |
| Arena Score, richieste difficili | 1.219,79 1.212–1.228 | — | — |
| Arena Score, richieste lunghe | 1.217,5 1.207–1.228 | — | — |
| Arena Score, generale | 1.216,84 1.212–1.221 | — | — |
| Arena Score in russo | 1.207,8 1.197–1.219 | — | — |
| Arena Score, dialogo a più turni | 1.205,9 1.196–1.216 | — | — |
| Arena Score, domande da esperto | 1.202,37 1.185–1.220 | — | — |
| Arena Score, rispetto delle istruzioni | 1.201,73 1.195–1.208 | — | — |
| Arena Score, scrittura creativa | 1.182,03 1.172–1.192 | — | — |
| MATH, livello di difficoltà cinque | 64,94 % | · con impalcatura calibrata | Epoch evaluations |
| Scrittura creativa (valutazione di Lech Mazur) | 62,6 % | — | lechmazur/writing Github repository |
| GPQA Diamond — domande di livello dottorale | 41,41 % | · con impalcatura calibrata | Epoch evaluations |
| Mock AIME 2024–2025 — problemi da olimpiadi | 13,66 % | · con impalcatura calibrata | Epoch evaluations |
| BALROG — ambienti di gioco | 11,6 % | — | Balrog Leaderboard |