Benchmark
Benchmark e metodologia.
Come si posiziona Ox Alpha rispetto alla frontiera attuale — la tabella completa, le avvertenze dietro ogni numero e come l'abbiamo costruita nel dettaglio.
Ultimo aggiornamento: agosto 2026
La maggior parte delle tabelle comparative ti dà un verdetto senza prove concrete. Questa mostra i numeri e poi ti dice da dove vengono, cosa non possono dirti e perché l'anteprima gratuita cambia i conti.
Ox Alpha è un modello in anteprima stealth, quindi considera i suoi dati come indicativi piuttosto che definitivi — il modo onesto di leggere questa pagina è "qualità ai margini della frontiera a un prezzo che nessun modello in produzione può eguagliare."
La tabella completa
Nove dimensioni, cinque modelli, una colonna gratuita.
| Metric | Ox Alpha | Fable 5 | GLM-5 | GPT-5.6 | Grok 4.6 |
|---|---|---|---|---|---|
| Indice di intelligenza | 59* | 62 | 57 | 59 | 61 |
| Coding agentico | 78* | 79 | 72 | 80 | 74 |
| Finestra di contesto | 1M | 1M | 200K | 400K | 500K |
| Output massimo | 131K | 64K | 128K | 128K | 64K |
| Throughput (tps) | 24* | 63 | 90 | 70 | 120 |
| Prezzo / 1M out | $0 | $50 | $1.50 | $15 | $6 |
| Multimodale | |||||
| Pesi aperti | |||||
| Uso gratuito |
Punteggio composito su benchmark di ragionamento, conoscenza e matematica (più alto è meglio).
Punteggio indicativo di coding agentico — attività reali su più file con strumenti (più alto è meglio).
Numero massimo di token a cui il modello può prestare attenzione in una singola richiesta.
Risposta più grande che il modello genererà in una singola chiamata.
Velocità di output mediana in token al secondo (più alto è più veloce).
Prezzo di listino per un milione di token di output (più basso è più economico).
Accetta input di immagini insieme al testo.
I pesi possono essere scaricati ed eseguiti in self-hosting.
Utilizzabile gratuitamente in questo momento.
Confronto diretto
Vuoi un'analisi mirata, uno contro uno? Scegli un match-up.
Metodologia
L'Intelligence Index è un indice composito di benchmark pubblici di ragionamento, conoscenza e matematica nello spirito dell'Artificial Analysis Intelligence Index. L'agentic coding riflette attività reali su più file eseguite con strumenti, piuttosto che frammenti isolati.
Finestra di contesto, output massimo, throughput e prezzo sono cifre riportate dal provider. Il prezzo è la tariffa di listino per un milione di token di output; i token di input sono solitamente più economici e vengono omessi per mantenere la tabella leggibile.
Ox Alpha è servito anonimamente in anteprima, quindi le sue cifre (contrassegnate con *) sono stime riportate dalla community piuttosto che una scheda tecnica del fornitore. Cambieranno man mano che il modello viene ottimizzato: aggiorniamo questa pagina quando emergono dati migliori.
In questo settore i numeri cambiano rapidamente. Usalo come guida orientativa per scegliere un modello, non come classifica di riferimento dei benchmark. In caso di dubbio, esegui la tua eval sui tuoi prompt.
Verifica con i tuoi occhi
I numeri sono una cosa. Affida a Ox Alpha un compito reale e giudica tu l'output.