Điểm chuẩn
Điểm chuẩn & phương pháp luận.
ChatGPT-6 so sánh với các mô hình tiên tiến hiện nay như thế nào — bảng đầy đủ, các lưu ý đằng sau từng con số và chính xác cách chúng tôi tổng hợp dữ liệu.
Cập nhật lần cuối: tháng 9 năm 2026
Hầu hết các bảng so sánh đều đưa ra kết luận mà không có bằng chứng đi kèm. Bảng này hiển thị các con số, sau đó cho bạn biết chúng bắt nguồn từ đâu, chúng không thể cho bạn biết điều gì và tại sao bản xem trước miễn phí lại thay đổi phép tính.
ChatGPT-6 là bản xem trước quyền truy cập sớm, vì vậy hãy xem các số liệu của nó mang tính định hướng thay vì kết quả cuối cùng — cách trung thực để đọc trang này là "chất lượng cấp độ tiên phong với mức giá mà không mô hình nào đã phát hành có thể sánh được."
Bảng đầy đủ
Chín khía cạnh, năm mô hình, một cột miễn phí.
| Metric | ChatGPT-6 | GPT-5.6 | Opus 5 | Gemini 3.7 | Grok 4.6 |
|---|---|---|---|---|---|
| Chỉ số trí tuệ | 71* | 67 | 68 | 66 | 65 |
| Lập trình tác tử | 86* | 84 | 82 | 78 | 76 |
| Cửa sổ ngữ cảnh | 400K | 400K | 1M | 2M | 500K |
| Đầu ra tối đa | 128K | 128K | 64K | 64K | 64K |
| Thông lượng (tps) | 58* | 70 | 55 | 92 | 120 |
| Giá / 1M đầu ra | $0 | $10 | $25 | $10 | $6 |
| Đa phương thức | |||||
| Trọng số mở | |||||
| Miễn phí sử dụng |
Điểm tổng hợp trên các bài đánh giá về suy luận, kiến thức và toán học (điểm cao hơn là tốt hơn).
Điểm lập trình tác tử mang tính tham khảo — các tác vụ thực tế nhiều tệp với công cụ (điểm cao hơn là tốt hơn).
Số token tối đa mà mô hình có thể tiếp nhận trong một cuộc trò chuyện duy nhất.
Phản hồi lớn nhất mà mô hình sẽ tạo ra trong một lần gọi.
Tốc độ đầu ra trung vị tính bằng token mỗi giây (cao hơn là nhanh hơn).
Giá niêm yết cho mỗi triệu token đầu ra (giá thấp hơn là rẻ hơn).
Hỗ trợ đầu vào hình ảnh cùng với văn bản.
Có thể tải xuống trọng số và tự lưu trữ.
Hiện có thể sử dụng miễn phí.
Đối đầu trực tiếp
Muốn xem phân tích tập trung, một-một? Hãy chọn một cặp đấu.
Phương pháp luận
Chỉ số Trí tuệ là chỉ số tổng hợp từ các bài đánh giá công khai về khả năng suy luận, kiến thức và toán học, theo tinh thần của Artificial Analysis Intelligence Index. Khả năng lập trình tác vụ phản ánh các tác vụ thực tế, nhiều tệp được thực thi bằng công cụ thay vì các đoạn mã riêng lẻ.
Cửa sổ ngữ cảnh, đầu ra tối đa, thông lượng và giá là các số liệu do nhà cung cấp công bố. Giá là mức niêm yết cho mỗi một triệu token đầu ra; token đầu vào thường rẻ hơn và được lược bỏ để bảng dễ đọc hơn.
ChatGPT-6 đang ở giai đoạn xem trước quyền truy cập sớm, vì vậy các số liệu của mẫu này (được đánh dấu *) là các ước tính do cộng đồng báo cáo thay vì dữ liệu từ bảng thông số của nhà cung cấp. Chúng sẽ thay đổi khi mẫu được tinh chỉnh — chúng tôi cập nhật trang này khi có dữ liệu tốt hơn.
Các con số thay đổi nhanh chóng trong lĩnh vực này. Hãy sử dụng thông tin này như một hướng dẫn định hướng để chọn mẫu, không phải như bảng xếp hạng kỷ lục của các bài đánh giá chuẩn. Khi còn phân vân, hãy tự đánh giá bằng các lời nhắc của chính bạn.
Tự mình kiểm chứng
Các con số chỉ là một phần. Giao cho ChatGPT-6 một tác vụ thực tế và tự đánh giá kết quả.