GPT-6.1 Sol thay thế GPT-6 Sol chỉ sau 7 ngày, trí tuệ tiệm cận Astra
Chỉ 7 ngày sau khi GPT-6 Sol ra mắt, OpenAI đã tung ra GPT-6.1 Sol với trí tuệ tiệm cận GPT-6 Astra nhưng chi phí chỉ bằng một phần tư. Mô hình mới ghi dấu ấn ở khả năng làm việc tác tử, lập trình và giảm đáng kể tỷ lệ ảo giác.

GPT-6.1 Sol thay thế GPT-6 Sol chỉ sau 7 ngày, trí tuệ tiệm cận Astra
Chỉ vỏn vẹn 7 ngày sau khi GPT-6 Sol trình làng, OpenAI đã tung ra GPT-6.1 Sol với sức mạnh trí tuệ tiệm cận dòng Astra cao cấp. Đáng chú ý, mô hình mới đạt điểm số chỉ kém GPT-6 Astra đúng 1 điểm trên Chỉ số Trí tuệ, nhưng chi phí cho mỗi tác vụ lại chưa bằng một phần tư. Đây là minh chứng rõ nét cho cuộc đua nâng cấp thần tốc của các mô hình ngôn ngữ lớn hiện nay.
So sánh hiệu năng các mô hình GPT thế hệ mới
Những điểm nhấn chính
Theo phân tích từ Artificial Analysis, GPT-6.1 Sol ghi nhận mức tăng 4 điểm trên Chỉ số Trí tuệ so với GPT-6 Sol và 5 điểm so với GPT-5.6 Sol, qua đó chỉ còn kém GPT-6 Astra đúng 1 điểm. Mô hình này cải thiện đáng kể ở nhóm tác vụ tri thức tác tử, với mức tăng lần lượt 4 và 5 điểm ở AA-Briefcase v1.1 và GDPval-AA v2.1.
Các chỉ số nổi bật khác bao gồm:
- Tăng 12 điểm ở Terminal-Bench 4.0
- Tăng 5 điểm ở Humanity's Last Exam
- Tăng 6 điểm ở GDP.pdf
- Tăng 8 điểm ở AA-Omniscience Accuracy, đồng thời tỷ lệ ảo giác giảm từ 60% xuống còn 54%
Đẩy xa biên giới hiệu quả chi phí
Ở mức nỗ lực tối đa, GPT-6.1 Sol chỉ tốn 0,72 USD cho mỗi tác vụ trên Chỉ số Trí tuệ, so với 3,26 USD của GPT-6 Astra — tức chưa bằng một phần tư. Con số này cũng thấp hơn 31% so với GPT-6 Sol (1,05 USD) và 64% so với GPT-5.6 Sol (1,99 USD).
Ở mọi mức nỗ lực, GPT-6.1 Sol đều mở rộng biên giới hiệu quả chi phí: với cùng một mức trí tuệ, không có mô hình nào rẻ hơn.
Về giá niêm yết, GPT-6.1 Sol giữ nguyên mức 2 USD/10 USD cho mỗi triệu token đầu vào/đầu ra như GPT-6 Sol, song mức chiết khấu khi đọc từ bộ nhớ đệm tăng từ 90% lên 95%. Nhờ đó, giá tổng hợp cho các tác vụ tác tử của mô hình mới thấp hơn một chút so với người tiền nhiệm. Đây là lần giảm giá tiếp theo, sau mức giảm 50% mà GPT-6 Sol từng áp dụng so với GPT-5.6 Sol.
Biểu đồ hiệu quả chi phí và trí tuệ của các mô hình
Hiệu quả token và các chỉ số chuyên biệt
Về hiệu quả token, GPT-6.1 Sol tiêu thụ lượng token đầu ra nhiều hơn GPT-6 Sol khoảng 10-30% tùy theo mức nỗ lực. Tuy nhiên, nhờ điểm trí tuệ cao hơn, hai mức nỗ lực thấp và trung bình của mô hình này vẫn đạt trạng thái tối ưu Pareto về hiệu quả token.
Ở Chỉ số Tác tử Lập trình (Coding Agent Index), GPT-6.1 Sol tăng 3 điểm so với GPT-6 Sol ở mức nỗ lực tối đa và chỉ kém GPT-6 Astra 2 điểm. Đáng chú ý, phiên bản xhigh đạt điểm cao hơn cả mức max tới 3 điểm — một chi tiết cho thấy việc tinh chỉnh mức nỗ lực có thể mang lại lợi ích bất ngờ. Ở mức xhigh, mô hình vượt GPT-6 Astra 1 điểm trong khi chi phí chưa tới 15%.
Tại AA-Briefcase, GPT-6.1 Sol cải thiện khoảng 80 Elo, đến từ việc tăng điểm tiêu chí đánh giá và Elo Chất lượng Phân tích, dù Elo Trình bày giảm nhẹ.
Ý nghĩa với cộng đồng công nghệ Việt Nam
Với các startup và đội ngũ phát triển tại Việt Nam, việc một mô hình có trí tuệ gần bằng dòng cao cấp nhưng chi phí chỉ bằng một phần tư mở ra nhiều khả năng ứng dụng thực tế. Các tác vụ như viết mã tự động, xử lý tài liệu dài hay xây dựng tác tử làm việc theo quy trình giờ đây trở nên khả thi về mặt ngân sách hơn bao giờ hết.
Minh họa khả năng của mô hình AI thế hệ mới
Chu kỳ ra mắt chỉ 7 ngày giữa hai thế hệ cũng đặt ra câu hỏi về việc doanh nghiệp nên lựa chọn thời điểm nâng cấp như thế nào. Thay vì chạy theo từng bản phát hành, các đội ngũ có thể cân nhắc xây dựng lớp trừu tượng để dễ dàng chuyển đổi giữa các mô hình, đồng thời theo dõi sát chỉ số chi phí trên mỗi tác vụ — vốn đang trở thành thước đo quan trọng không kém gì điểm trí tuệ.


