Điểm chuẩn
Điểm chuẩn & phương pháp luận.
Ox Alpha so sánh thế nào với các mô hình tiên tiến hiện nay — bảng đầy đủ, những lưu ý đằng sau mỗi con số, và chính xác cách chúng tôi xây dựng nó.
Cập nhật lần cuối: Tháng 8 năm 2026
Hầu hết các bảng so sánh đưa ra kết luận mà không có bằng chứng. Bảng này hiển thị các con số rồi cho bạn biết chúng đến từ đâu, những gì chúng không thể nói lên, và tại sao bản xem trước miễn phí thay đổi cách tính toán.
Ox Alpha là một mô hình xem trước bí mật, vì vậy hãy coi các số liệu của nó mang tính định hướng chứ chưa phải kết quả cuối cùng — cách đọc trung thực của trang này là "chất lượng gần mức tiên tiến với mức giá không mô hình nào đang phát hành có thể sánh kịp."
Bảng đầy đủ
Chín chiều, năm mô hình, một cột miễn phí.
| Metric | Ox Alpha | Fable 5 | GLM-5 | GPT-5.6 | Grok 4.6 |
|---|---|---|---|---|---|
| Chỉ số thông minh | 59* | 62 | 57 | 59 | 61 |
| Lập trình agentic | 78* | 79 | 72 | 80 | 74 |
| Cửa sổ ngữ cảnh | 1M | 1M | 200K | 400K | 500K |
| Đầu ra tối đa | 131K | 64K | 128K | 128K | 64K |
| Thông lượng (tps) | 24* | 63 | 90 | 70 | 120 |
| Giá / 1M đầu ra | $0 | $50 | $1.50 | $15 | $6 |
| Đa phương thức | |||||
| Trọng số mở | |||||
| Miễn phí sử dụng |
Điểm tổng hợp trên các điểm chuẩn suy luận, kiến thức và toán học (càng cao càng tốt).
Điểm lập trình agentic tham khảo — tác vụ thực tế nhiều tệp với công cụ (càng cao càng tốt).
Số tokens tối đa mà mô hình có thể xử lý trong một yêu cầu duy nhất.
Phản hồi lớn nhất mà mô hình sẽ tạo ra trong một lần gọi.
Tốc độ đầu ra trung vị tính bằng tokens mỗi giây (cao hơn là nhanh hơn).
Giá niêm yết cho mỗi triệu output tokens (thấp hơn là rẻ hơn).
Chấp nhận đầu vào hình ảnh đi kèm văn bản.
Weights có thể được tải xuống và tự lưu trữ (self-host).
Có thể sử dụng miễn phí ngay lúc này.
Đối đầu trực tiếp
Muốn một bản phân tích chi tiết, tập trung giữa hai mô hình? Hãy chọn một cặp đối đầu.
Phương pháp
Intelligence Index là chỉ số tổng hợp từ các benchmark suy luận, kiến thức và toán học công khai, theo tinh thần của Artificial Analysis Intelligence Index. Agentic coding phản ánh các tác vụ thực tế nhiều tệp được thực hiện với công cụ thay vì các đoạn mã riêng lẻ.
Context window, max output, throughput và giá là các số liệu do nhà cung cấp báo cáo. Giá là mức niêm yết cho mỗi một triệu output tokens; input tokens thường rẻ hơn và bị lược bỏ để bảng dễ đọc hơn.
Ox Alpha đang được phục vụ ẩn danh ở giai đoạn xem trước, nên các số liệu của nó (đánh dấu *) là ước tính do cộng đồng báo cáo chứ không phải datasheet chính thức từ nhà cung cấp. Các con số này sẽ thay đổi khi mô hình được tinh chỉnh — chúng tôi sẽ cập nhật trang này khi có dữ liệu tốt hơn.
Các con số trong lĩnh vực này thay đổi rất nhanh. Hãy dùng trang này như một hướng dẫn tham khảo để chọn mô hình, không phải bảng xếp hạng benchmark chính thức. Khi còn nghi ngờ, hãy chạy eval của riêng bạn trên các prompt của riêng bạn.
Tự mình trải nghiệm
Con số chỉ là một phần. Hãy giao cho Ox Alpha một tác vụ thực tế và tự đánh giá kết quả.