Benchmarks
Benchmarks & méthodologie.
Comment Ox Alpha se positionne face à la frontière actuelle — le tableau complet, les réserves derrière chaque chiffre et exactement comment nous l'avons constitué.
Dernière mise à jour : août 2026
La plupart des tableaux comparatifs vous donnent un verdict sans les preuves. Celui-ci montre les chiffres puis vous explique d'où ils viennent, ce qu'ils ne peuvent pas vous dire, et pourquoi l'aperçu gratuit change tous les calculs.
Ox Alpha est un modèle en avant-première discret, considérez donc ses chiffres comme indicatifs plutôt que définitifs — la façon honnête de lire cette page est « une qualité proche de la frontière à un prix qu'aucun modèle commercial ne peut égaler ».
Le tableau complet
Neuf dimensions, cinq modèles, une colonne gratuite.
| Metric | Ox Alpha | Fable 5 | GLM-5 | GPT-5.6 | Grok 4.6 |
|---|---|---|---|---|---|
| Indice d'intelligence | 59* | 62 | 57 | 59 | 61 |
| Codage agentique | 78* | 79 | 72 | 80 | 74 |
| Fenêtre de contexte | 1M | 1M | 200K | 400K | 500K |
| Sortie max | 131K | 64K | 128K | 128K | 64K |
| Débit (tps) | 24* | 63 | 90 | 70 | 120 |
| Prix / 1M en sortie | $0 | $50 | $1.50 | $15 | $6 |
| Multimodal | |||||
| Poids ouverts | |||||
| Utilisation gratuite |
Score composite sur les benchmarks de raisonnement, de connaissances et de mathématiques (plus élevé est meilleur).
Score indicatif de codage agentique — tâches réelles multi-fichiers avec outils (plus élevé est meilleur).
Nombre maximal de tokens auxquels le modèle peut prêter attention dans une seule requête.
Réponse la plus longue que le modèle peut générer en un seul appel.
Vitesse de sortie médiane en tokens par seconde (plus c'est élevé, plus c'est rapide).
Prix catalogue par million de tokens de sortie (plus c'est bas, moins c'est cher).
Accepte les images en entrée en plus du texte.
Les poids peuvent être téléchargés et auto-hébergés.
Utilisable gratuitement dès maintenant.
Face à face
Envie d'une analyse ciblée, en tête-à-tête ? Choisissez un duel.
Méthodologie
L'Indice d'intelligence est un composite de benchmarks publics de raisonnement, de connaissances et de mathématiques, dans l'esprit de l'Artificial Analysis Intelligence Index. Le codage agentique reflète des tâches réelles multi-fichiers exécutées avec des outils plutôt que des extraits isolés.
La fenêtre de contexte, la sortie maximale, le débit et le prix sont des chiffres communiqués par les fournisseurs. Le prix correspond au tarif catalogue par million de tokens de sortie ; les tokens d'entrée sont généralement moins chers et sont omis pour garder le tableau lisible.
Ox Alpha est servi anonymement en avant-première : ses chiffres (marqués *) sont donc des estimations rapportées par la communauté plutôt qu'une fiche technique officielle. Ils évolueront à mesure que le modèle sera affiné — nous actualisons cette page dès que de meilleures données apparaissent.
Les chiffres évoluent vite dans ce domaine. Utilisez ceci comme guide indicatif pour choisir un modèle, non comme classement de référence définitif. En cas de doute, lancez votre propre évaluation sur vos propres prompts.
Voyez par vous-même
Les chiffres, c'est une chose. Confiez une vraie tâche à Ox Alpha et jugez le résultat.