Benchmarks
Benchmarks & Methodik.
Wie sich Ox Alpha im Vergleich zur aktuellen Frontier positioniert — die vollständige Tabelle, die Einschränkungen hinter jeder Zahl und genau, wie wir sie zusammengestellt haben.
Zuletzt aktualisiert: August 2026
Die meisten Vergleichstabellen liefern ein Urteil ohne Belege. Diese zeigt die Zahlen und verrät Ihnen dann, woher sie stammen, was sie nicht aussagen können und warum die kostenlose Vorschau die Rechnung verändert.
Ox Alpha ist ein Stealth-Vorschau-Modell, betrachten Sie seine Werte daher als Richtwerte und nicht als endgültig — die ehrliche Art, diese Seite zu lesen ist: „Frontier-nahe Qualität zu einem Preis, den kein ausgeliefertes Modell mithalten kann.“
Die vollständige Tabelle
Neun Dimensionen, fünf Modelle, eine Spalte, die kostenlos ist.
| Metric | Ox Alpha | Fable 5 | GLM-5 | GPT-5.6 | Grok 4.6 |
|---|---|---|---|---|---|
| Intelligenz-Index | 59* | 62 | 57 | 59 | 61 |
| Agentic Coding | 78* | 79 | 72 | 80 | 74 |
| Kontextfenster | 1M | 1M | 200K | 400K | 500K |
| Max. Ausgabe | 131K | 64K | 128K | 128K | 64K |
| Durchsatz (tps) | 24* | 63 | 90 | 70 | 120 |
| Preis / 1M Ausgabe | $0 | $50 | $1.50 | $15 | $6 |
| Multimodal | |||||
| Offene Gewichte | |||||
| Kostenlos nutzbar |
Gesamtscore über Reasoning-, Wissens- und Mathematik-Benchmarks (höher ist besser).
Indikativer Score für Agentic Coding — praxisnahe, mehrdateige Aufgaben mit Tools (höher ist besser).
Maximale Anzahl an Tokens, die das Modell in einer einzelnen Anfrage berücksichtigen kann.
Größte Antwort, die das Modell in einem einzigen Aufruf generiert.
Mediane Ausgabegeschwindigkeit in Tokens pro Sekunde (höher ist schneller).
Listenpreis pro eine Million Ausgabe-Tokens (niedriger ist günstiger).
Akzeptiert Bildeingaben zusätzlich zu Text.
Gewichte können heruntergeladen und selbst gehostet werden.
Derzeit kostenlos nutzbar.
Direktvergleich
Möchten Sie eine fokussierte Gegenüberstellung? Wählen Sie ein Match-up.
Methodik
Der Intelligence Index ist ein zusammengesetzter Wert aus öffentlichen Reasoning-, Wissens- und Mathematik-Benchmarks im Geiste des Artificial Analysis Intelligence Index. Agentic Coding spiegelt reale Aufgaben mit mehreren Dateien wider, die mit Tools ausgeführt werden – statt isolierter Snippets.
Kontextfenster, maximale Ausgabe, Durchsatz und Preis sind vom Anbieter gemeldete Angaben. Der Preis ist der Listenpreis pro eine Million Ausgabe-Tokens; Eingabe-Tokens sind meist günstiger und werden der Lesbarkeit halber weggelassen.
Ox Alpha wird anonym in der Vorschau bereitgestellt, daher sind seine Zahlen (mit * markiert) von der Community gemeldete Schätzungen und kein Hersteller-Datenblatt. Sie werden sich ändern, während das Modell weiter optimiert wird – wir aktualisieren diese Seite, sobald bessere Daten vorliegen.
Die Zahlen ändern sich in diesem Bereich schnell. Nutzen Sie diese Übersicht als Orientierungshilfe bei der Modellauswahl, nicht als maßgebliche Benchmark-Rangliste. Im Zweifel führen Sie Ihren eigenen Eval mit Ihren eigenen Prompts durch.
Überzeugen Sie sich selbst
Zahlen sind das eine. Geben Sie Ox Alpha eine echte Aufgabe und beurteilen Sie das Ergebnis.