Benchmarks
Benchmarks & methodologie.
Hoe Ox Alpha zich verhoudt tot de huidige frontier — de volledige tabel, de kanttekeningen achter elk cijfer en precies hoe we dit hebben samengesteld.
Laatst bijgewerkt: augustus 2026
De meeste vergelijkingstabellen geven je een oordeel zonder bewijs. Deze laat de cijfers zien en vertelt je vervolgens waar ze vandaan komen, wat ze niet kunnen vertellen en waarom de gratis preview de rekensom verandert.
Ox Alpha is een stealth-previewmodel, dus beschouw de cijfers als indicatief in plaats van definitief — de eerlijke manier om deze pagina te lezen is "kwaliteit op frontier-niveau tegen een prijs die geen enkel uitgebracht model kan evenaren."
De volledige tabel
Negen dimensies, vijf modellen, één kolom die gratis is.
| Metric | Ox Alpha | Fable 5 | GLM-5 | GPT-5.6 | Grok 4.6 |
|---|---|---|---|---|---|
| Intelligentie-index | 59* | 62 | 57 | 59 | 61 |
| Agentic coding | 78* | 79 | 72 | 80 | 74 |
| Contextvenster | 1M | 1M | 200K | 400K | 500K |
| Maximale output | 131K | 64K | 128K | 128K | 64K |
| Doorvoer (tps) | 24* | 63 | 90 | 70 | 120 |
| Prijs / 1M output | $0 | $50 | $1.50 | $15 | $6 |
| Multimodaal | |||||
| Open gewichten | |||||
| Gratis te gebruiken |
Samengestelde score over redeneer-, kennis- en wiskundebenchmarks (hoger is beter).
Indicatieve agentic-codingscore — praktijkgerichte taken met meerdere bestanden en tools (hoger is beter).
Maximaal aantal tokens dat het model in één verzoek kan verwerken.
Grootste antwoord dat het model in één aanroep genereert.
Mediane outputsnelheid in tokens per seconde (hoger is sneller).
Lijstprijs per miljoen outputtokens (lager is goedkoper).
Accepteert afbeeldingsinvoer naast tekst.
De gewichten kunnen worden gedownload en zelf gehost.
Nu gratis te gebruiken.
Onderlinge vergelijking
Wil je een gerichte, één-op-één analyse? Kies een combinatie.
Methodologie
De Intelligence Index is een samengestelde score van openbare redeneer-, kennis- en wiskundebenchmarks, in de geest van de Artificial Analysis Intelligence Index. Agentic coding weerspiegelt echte taken uit de praktijk met meerdere bestanden die met tools worden uitgevoerd, in plaats van losse fragmenten.
Contextvenster, maximale output, doorvoer en prijs zijn cijfers zoals gerapporteerd door de provider. De prijs is het lijsttarief per één miljoen outputtokens; inputtokens zijn meestal goedkoper en zijn weggelaten om de tabel leesbaar te houden.
Ox Alpha wordt anoniem aangeboden in preview, waardoor de cijfers (gemarkeerd met *) schattingen uit de community zijn in plaats van een datasheet van de leverancier. Ze zullen verschuiven naarmate het model wordt bijgesteld — we verversen deze pagina zodra betere gegevens beschikbaar komen.
De cijfers veranderen snel in dit vakgebied. Gebruik dit als richtinggevende gids voor het kiezen van een model, niet als officieel benchmarkklassement. Twijfel je? Voer dan je eigen eval uit op je eigen prompts.
Zie het zelf
Cijfers zijn het ene. Geef Ox Alpha een echte taak en beoordeel het resultaat.