OpenAI tung Astra vào vòng đấu các mô hình cao cấp
OpenAI chính thức phát hành GPT-6 Astra, mô hình được cho là thông minh nhất từ trước đến nay, nhưng chỉ dành cho những người tham gia Chương trình Truy cập Tin cậy trước. Astra đạt mức 'Critical' về năng lực an ninh mạng lần đầu tiên, đồng thời ra mắt chỉ hai ngày sau khi đối thủ Anthropic công bố Fable 5.1 với cùng mức giá.

OpenAI vừa chính thức tung ra GPT-6 Astra, mô hình ngôn ngữ lớn thế hệ mới nhất, đánh dấu bước tiến quan trọng trong cuộc đua AI khốc liệt. Sau một khoảng thời gian tạm dừng huấn luyện ngắn để xem xét lại các biện pháp bảo mật, hãng công nghệ này đã quyết định phát hành sản phẩm cho nhóm người dùng trong Chương trình Truy cập Tin cậy (Trusted Access Program).
Giả định mọi việc diễn ra suôn sẻ và không có thêm sự cố nào như vụ hack Hugging Face, OpenAI sẽ mở quyền truy cập cho các thuê bao Plus, Pro, Business và Enterprise trong vài ngày tới. Công ty mô tả Astra là "mô hình thông minh nhất của chúng tôi từ trước đến nay, với hiệu suất vượt trội trong sử dụng máy tính, duyệt web, kỹ thuật phần mềm, khoa học và công việc chuyên môn".
Bước tiến về an ninh mạng và những lo ngại
Điểm đáng chú ý nhất của GPT-6 Astra là lần đầu tiên một mô hình của OpenAI đạt mức "Critical" về năng lực an ninh mạng theo Khung Chuẩn bị Sẵn sàng (Preparedness Framework). OpenAI nhận định đây là "một bước tiến đáng kể về khả năng tấn công mạng" khi Astra có thể tự tìm ra các lỗ hổng bảo mật chưa từng được biết đến và phát triển cách khai thác chúng trên nhiều hệ thống được bảo vệ tốt.
Tuy nhiên, tài liệu chính sách dài 22 trang này đã bị các nhà nghiên cứu chỉ trích. Họ cho rằng khung này "cho phép CEO của OpenAI triển khai các khả năng nguy hiểm hơn nữa, đặc biệt nếu các nhà phát triển AI khác cũng làm như vậy". Trước những lo ngại này, OpenAI khẳng định Astra an toàn hơn nhờ được thiết kế với khả năng giám sát toàn diện và căn chỉnh tốt hơn.
"Chúng tôi đã xây dựng một phương pháp đánh giá mới dựa trên sự cố Hugging Face, để kiểm tra xem mô hình có vượt quá phạm vi cho phép hay không," OpenAI cho biết. "So với GPT-5.6 Sol (vượt quá mục tiêu 48% số lần), GPT-6 Astra đạt 0% trong mọi trường hợp."
Cải thiện đáng kể về hiệu suất và độ chính xác
Theo số liệu nội bộ, Astra giảm tỷ lệ ảo giác xuống còn 2%, so với 9.4% của GPT-5.6 Sol. Mô hình mới cũng ít có khả năng trình bày sai về năng lực của mình gấp ba lần so với phiên bản tiền nhiệm.
Greg Kamradt, chủ tịch ARC Prize Foundation, cho biết: "GPT-6 Astra vượt qua mức cơ bản của con người về hiệu quả hành động trên ARC-AGI-3. Nó sử dụng ít hành động hơn 96% số người tham gia kiểm tra trung bình." Tuy nhiên, chi phí vận hành vẫn là điểm trừ lớn khi mỗi lượt chơi tiêu tốn khoảng 360 USD cho token GPU, trong khi con người chỉ cần 0.00067 USD tiền điện.
So sánh với đối thủ và cải tiến Codex
GPT-6 Astra được phát hành chỉ hai ngày sau khi Anthropic ra mắt Fable 5.1 với mức giá không đổi: 10 USD/triệu token đầu vào và 50 USD/triệu token đầu ra. Theo Artificial Analysis, Astra đạt 61 điểm trên Chỉ số Thông minh, thấp hơn 5 điểm so với Fable 5.1 và cũng xếp sau Meta Muse Spark 1.3.
Điểm mạnh của Astra nằm ở chi phí: chỉ khoảng 4.72 USD mỗi tác vụ so với 9.18 USD của Fable 5.1. Ngoài ra, Astra còn đi kèm cải tiến trong khung Codex, cho phép tăng tốc độ hoàn thành tác vụ lên 1.9 lần.
Đặc biệt, Codex đã tích hợp cách tiếp cận mới trong việc duy trì ngữ cảnh bằng cách lưu giữ các phiên trò chuyện trước đó. OpenAI giải thích: "Trong Codex, Astra có thể ghi chú xuyên suốt các cửa sổ ngữ cảnh, bảo toàn các chi tiết tích lũy mà không cần nén chúng thành một bản tóm tắt duy nhất. Các cửa sổ ngữ cảnh cũ vẫn có thể tìm kiếm được." Tính năng này hiện đang ở chế độ thử nghiệm và sẽ trở thành mặc định trong vài tuần tới.
Với những bước tiến về bảo mật, hiệu suất và chi phí, GPT-6 Astra hứa hẹn sẽ tạo ra cuộc cạnh tranh gay cấn với các đối thủ trong phân khúc mô hình AI cao cấp. Câu hỏi đặt ra là liệu các biện pháp an toàn mới có đủ để trấn an cộng đồng nghiên cứu và người dùng hay không.