Benchmarks

Benchmarks & méthodologie.

Comment Ox Alpha se positionne face à la frontière actuelle — le tableau complet, les réserves derrière chaque chiffre et exactement comment nous l'avons constitué.

Dernière mise à jour : août 2026

La plupart des tableaux comparatifs vous donnent un verdict sans les preuves. Celui-ci montre les chiffres puis vous explique d'où ils viennent, ce qu'ils ne peuvent pas vous dire, et pourquoi l'aperçu gratuit change tous les calculs.

Ox Alpha est un modèle en avant-première discret, considérez donc ses chiffres comme indicatifs plutôt que définitifs — la façon honnête de lire cette page est « une qualité proche de la frontière à un prix qu'aucun modèle commercial ne peut égaler ».

Le tableau complet

Neuf dimensions, cinq modèles, une colonne gratuite.

Metric
Ox Alpha
Fable 5
GLM-5
GPT-5.6
Grok 4.6
Indice d'intelligence59*62575961
Codage agentique78*79728074
Fenêtre de contexte1M1M200K400K500K
Sortie max131K64K128K128K64K
Débit (tps)24*639070120
Prix / 1M en sortie$0$50$1.50$15$6
Multimodal
Poids ouverts
Utilisation gratuite
Indice d'intelligence

Score composite sur les benchmarks de raisonnement, de connaissances et de mathématiques (plus élevé est meilleur).

Codage agentique

Score indicatif de codage agentique — tâches réelles multi-fichiers avec outils (plus élevé est meilleur).

Fenêtre de contexte

Nombre maximal de tokens auxquels le modèle peut prêter attention dans une seule requête.

Sortie max

Réponse la plus longue que le modèle peut générer en un seul appel.

Débit (tps)

Vitesse de sortie médiane en tokens par seconde (plus c'est élevé, plus c'est rapide).

Prix / 1M en sortie

Prix catalogue par million de tokens de sortie (plus c'est bas, moins c'est cher).

Multimodal

Accepte les images en entrée en plus du texte.

Poids ouverts

Les poids peuvent être téléchargés et auto-hébergés.

Utilisation gratuite

Utilisable gratuitement dès maintenant.

Méthodologie

L'Indice d'intelligence est un composite de benchmarks publics de raisonnement, de connaissances et de mathématiques, dans l'esprit de l'Artificial Analysis Intelligence Index. Le codage agentique reflète des tâches réelles multi-fichiers exécutées avec des outils plutôt que des extraits isolés.

La fenêtre de contexte, la sortie maximale, le débit et le prix sont des chiffres communiqués par les fournisseurs. Le prix correspond au tarif catalogue par million de tokens de sortie ; les tokens d'entrée sont généralement moins chers et sont omis pour garder le tableau lisible.

Ox Alpha est servi anonymement en avant-première : ses chiffres (marqués *) sont donc des estimations rapportées par la communauté plutôt qu'une fiche technique officielle. Ils évolueront à mesure que le modèle sera affiné — nous actualisons cette page dès que de meilleures données apparaissent.

Les chiffres évoluent vite dans ce domaine. Utilisez ceci comme guide indicatif pour choisir un modèle, non comme classement de référence définitif. En cas de doute, lancez votre propre évaluation sur vos propres prompts.

Voyez par vous-même

Les chiffres, c'est une chose. Confiez une vraie tâche à Ox Alpha et jugez le résultat.

Ouvrir le chat