Бенчмарки
Бенчмарки и методология.
Как Ox Alpha соотносится с текущим фронтиром — полная таблица, оговорки за каждой цифрой и точное описание того, как мы всё это собрали.
Последнее обновление: август 2026
Большинство сравнительных таблиц выносят вердикт без доказательств. Эта показывает цифры, а затем рассказывает, откуда они взялись, чего они сказать не могут и почему бесплатное превью меняет всю математику.
Ox Alpha — это стелс-модель в статусе превью, поэтому считайте её показатели ориентировочными, а не окончательными — честный способ читать эту страницу таков: «качество на уровне фронтира по цене, которую не может предложить ни одна выпущенная модель».
Полная таблица
Девять измерений, пять моделей и один столбец, который бесплатен.
| Metric | Ox Alpha | Fable 5 | GLM-5 | GPT-5.6 | Grok 4.6 |
|---|---|---|---|---|---|
| Индекс интеллекта | 59* | 62 | 57 | 59 | 61 |
| Агентный кодинг | 78* | 79 | 72 | 80 | 74 |
| Контекстное окно | 1M | 1M | 200K | 400K | 500K |
| Максимальный вывод | 131K | 64K | 128K | 128K | 64K |
| Пропускная способность (tps) | 24* | 63 | 90 | 70 | 120 |
| Цена / 1M out | $0 | $50 | $1.50 | $15 | $6 |
| Мультимодальность | |||||
| Открытые веса | |||||
| Бесплатное использование |
Суммарный балл по бенчмаркам рассуждений, знаний и математики (выше — лучше).
Ориентировочный балл агентного кодинга — реальные многофайловые задачи с инструментами (выше — лучше).
Максимальное количество tokens, которое модель может обработать в одном запросе.
Наибольший ответ, который модель сгенерирует за один вызов.
Медианная скорость генерации в tokens в секунду (чем выше, тем быстрее).
Прейскурантная цена за миллион выходных tokens (чем ниже, тем дешевле).
Принимает изображения наряду с текстом.
Веса можно скачать и развернуть на собственном сервере.
Доступно бесплатно прямо сейчас.
Прямое сравнение
Хотите детальный разбор двух моделей один на один? Выберите пару для сравнения.
Методология
Intelligence Index — это составной показатель публичных бенчмарков по рассуждениям, знаниям и математике в духе Artificial Analysis Intelligence Index. Agentic coding отражает реальные многофайловые задачи, выполняемые с помощью инструментов, а не изолированные фрагменты кода.
Контекстное окно, максимальный вывод, пропускная способность и цена — данные, предоставленные провайдером. Цена указана как прейскурантная ставка за один миллион выходных tokens; входные tokens обычно дешевле и не показаны, чтобы таблица оставалась читаемой.
Ox Alpha в превью доступен анонимно, поэтому его показатели (помеченные *) — это оценки от сообщества, а не официальные данные производителя. Они будут меняться по мере настройки модели — мы обновляем эту страницу по мере появления более точных данных.
Цифры в этой сфере меняются быстро. Используйте это как ориентир при выборе модели, а не как официальный рейтинг бенчмарков. Если сомневаетесь — прогоните собственный eval на своих промптах.
Убедитесь сами
Цифры — это одно. Дайте Ox Alpha реальную задачу и оцените результат.