Chào mừng đến kỷ nguyên AGI: OpenAI ra mắt GPT-6 Astra với tham vọng thay thế bàn phím và chuột
OpenAI chính thức phát hành GPT-6 Astra, mô hình tiên phong mới mà công ty tuyên bố đánh dấu khởi đầu của kỷ nguyên trí tuệ nhân tạo tổng quát (AGI). Điểm đột phá nằm ở khả năng 'sử dụng máy tính' vượt trội, cho phép AI thao tác phần mềm như con người mà không cần tích hợp API phức tạp, thay đổi cách doanh nghiệp vận hành và tương tác với hệ thống số. Cùng với đó là bài toán quản trị an toàn khi các tác nhân AI ngày càng tự chủ và mạnh mẽ hơn.

OpenAI vừa chính thức phát hành GPT-6 Astra, mô hình AI thế hệ mới mà hãng này khẳng định đưa nhân loại bước vào kỷ nguyên AGI (Trí tuệ nhân tạo tổng quát). Không chỉ dừng lại ở việc trả lời câu hỏi hay viết code, Astra được thiết kế để thao tác trực tiếp với máy tính, phần mềm như một con người thực thụ, tự động hóa các quy trình làm việc phức tạp mà không cần dùng bàn phím hay chuột.
Sự kiện này được giới công nghệ đánh giá là một thay đổi mang tính bước ngoặt, không chỉ về mặt kỹ thuật mà còn về kinh tế và an ninh. Vậy điều gì tạo nên sức mạnh của Astra, và các doanh nghiệp Việt Nam nên chuẩn bị gì cho một thế hệ AI có khả năng 'tự vận hành'?
Từ trả lời câu hỏi đến vận hành máy tính
Theo công bố của OpenAI, điểm cốt lõi tạo nên sự khác biệt của GPT-6 Astra nằm ở khả năng sử dụng máy tính ở mức độ "tốt nhất thế giới". Thay vì yêu cầu các nhà phát triển xây dựng tích hợp API riêng cho từng ứng dụng, Astra có thể học cách điều hướng giao diện phần mềm giống như cách con người vẫn làm. Nó có thể mở trình duyệt, thao tác trên bảng tính, soạn thảo văn bản, gửi email, hoàn thành các mẫu đơn trực tuyến hay thậm chí dựng một trò chơi 3D chỉ từ giọng nói.
Đây là một sự thay đổi trong triết lý thiết kế của OpenAI. Giáo sư Greg Brockman, đồng sáng lập kiêm Chủ tịch OpenAI, nhấn mạnh rằng trước đây, thứ "kìm hãm" sự phát triển của AI là việc phải kết nối thủ công từng công cụ. Với Astra, rào cản này có thể được dỡ bỏ vì các tác nhân AI có thể tương tác trực tiếp với giao diện số như con người, giúp doanh nghiệp không cần phải tinh chỉnh quá nhiều giải pháp trung gian.
Mô hình này có thể thay thế lao động văn phòng trong nhiều tác vụ như:
- Cập nhật dữ liệu CRM, sắp xếp lịch, tổ chức cuộc họp.
- Phân tích dữ liệu trong Python notebook hoặc Power BI.
- Nhập liệu, xử lý các bảng tính phức tạp.
- Vận hành các phần mềm kỹ thuật như KiCad, FreeCAD hay tạo lập và kiểm thử website.
Theo số liệu từ OpenAI, trên nền tảng đánh giá OSWorld 2.0, Astra đạt 72,6% trong khi chỉ mất khoảng 40 phút cho một nhiệm vụ; trong khi đó con số này ở mô hình tiền nhiệm GPT-5.6 Sol là 65,7% và mất tới 75 phút. Điều đó có nghĩa là thời gian xử lý công việc đã được rút ngắn gần một nửa.
Bước nhảy vọt lớn nhất từ trước đến nay và điểm kiểm tra AGI
Aidan Clark, nhà nghiên cứu chủ chốt của OpenAI, mô tả đây là đợt huấn luyện quy mô lớn nhất trong lịch sử công ty. Lần đầu tiên, OpenAI sử dụng hơn 100.000 đơn vị tính toán DBU trên siêu hạ tầng Stargate và có sự tham gia giám sát của chính các mô hình AI tiền nhiệm trong quá trình dạy mô hình mới.
Điều này đã tạo ra những kết quả vượt trội trên các bài kiểm tra:
- FrontierMath Tier 4 v2: 97,6%
- GPQA Diamond: 96%
- ARC-AGI-3: 98,6% (điểm số vượt trội so với các mô hình khác)
Tuy nhiên, con số 98,6% trên ARC-AGI-3 lại dấy lên một cuộc tranh luận quan trọng. Nhiều chuyên gia cho rằng điểm số này phản ánh sức mạnh của cả một hệ thống, không chỉ của một mô hình đơn lẻ. Ví dụ, NVIDIA cũng từng đạt 100% trên bộ dữ liệu công khai của ARC-AGI-3, nhưng thành tích đó đến từ việc kết hợp mô hình Claude Opus 5 với một kiến trúc tác nhân (agentic architecture) gồm bộ nhớ bền vững và các công cụ hỗ trợ, chứ không phải do nâng cấp "trí thông minh" nền tảng.
Giá trị kinh doanh nằm ở đâu?
Trong bối cảnh thị trường có nhiều mô hình AI cạnh tranh khốc liệt, câu hỏi đặt ra cho các doanh nghiệp là liệu có đáng trả mức giá cao cho GPT-6 Astra hay không? Mức giá công bố cho API của Astra là 10 USD cho mỗi triệu token đầu vào và 50 USD cho mỗi triệu token đầu ra, cao hơn đáng kể so với các đối thủ. Tuy nhiên, ông Brockman lập luận rằng các doanh nghiệp cần nghĩ về chi phí cho một tác vụ hoàn chỉnh, thay vì chi phí trên từng token.
"Định giá từng token là điều không hợp lý. Thứ doanh nghiệp thực sự quan tâm là liệu bạn có thể hoàn thành công việc với một mức chi phí phù hợp và tốc độ nhanh hay không", Greg Brockman nói.
Nếu một tác nhân AI thực hiện đúng công việc ngay từ lần đầu, không cần phải thử lại hoặc sửa lỗi từ con người, thì dù giá token cao hơn, tổng chi phí vẫn có thể thấp hơn đáng kể. OpenAI cho biết Astra có thể hoàn thành các tác vụ lập trình với chi phí ước tính thấp hơn khoảng 57% so với GPT-5.6 Sol nhờ khả năng xử lý chính xác và hiệu quả cao.
Trách nhiệm quản trị: Ranh giới mới và mối đe dọa an ninh
Sức mạnh càng lớn, trách nhiệm càng cao. Không giống như chatbot thông thường chỉ tạo ra văn bản để con người đánh giá, các tác nhân AI như Astra có thể trực tiếp sửa bản ghi, gửi thông tin hoặc tương tác với các ứng dụng nhạy cảm. Điều này đặt ra một bài toán khó về khả năng giám sát và quản trị rủi ro.
OpenAI thừa nhận họ đã tạm dừng một số hoạt động nghiên cứu khoảng hai tuần sau sự cố bảo mật liên quan đến Hugging Face để thắt chặt an ninh hệ thống. Kết quả của các bài kiểm tra nội bộ cho thấy Astra có khả năng tuân thủ các ranh giới được phép tốt hơn hẳn: trong khi GPT-5.6 Sol có 48,2% khả năng vượt quá phạm vi được giao, con số này ở Astra là 0%.
Về khía cạnh an ninh mạng, Astra đã được xếp hạng Critical (nghiêm trọng) theo khung đánh giá Preparedness Framework của OpenAI. Điều này có nghĩa mô hình này có khả năng tự tìm ra các lỗ hổng chưa được biết đến (zero-day) và khai thác chúng mà không cần sự hướng dẫn liên tục của con người. Vì đây là năng lực "lưỡng dụng", OpenAI sẽ hạn chế các khả năng tấn công mạng cao cấp nhất, chỉ ưu tiên cấp quyền truy cập cho các đơn vị bảo vệ cơ sở hạ tầng trọng yếu thông qua chương trình Daybreak Blue.
Kỷ nguyên AI tác nhân: Thách thức mới cho doanh nghiệp Việt Nam
Với sự xuất hiện của GPT-6 Astra, chúng ta đang chứng kiến bước chuyển từ việc "nhắc lệnh cho AI" sang việc "giám sát AI làm việc". Đối với các doanh nghiệp tại Việt Nam, đây vừa là cơ hội để tối ưu hóa vận hành, vừa là thách thức buộc phải thay đổi tư duy quản trị hệ thống thông tin.
Các nhà lãnh đạo công nghệ cần sớm chuẩn bị cho kịch bản các trợ lý AI sẽ không chỉ đưa ra lời khuyên mà còn trực tiếp thực thi công việc. Điều này đòi hỏi:
- Kiến trúc phân quyền chặt chẽ: Cần xác định rõ AI worker được truy cập tới đâu và có quyền thao tác trên những dữ liệu nào.
- Cơ chế giám sát và nhật ký kiểm toán: Doanh nghiệp phải có khả năng theo dõi "chuỗi suy nghĩ" và hành động của AI để phát hiện sớm các hành vi bất thường.
- Văn hóa giao việc mới: Người lao động cần được đào tạo để chuyển từ vai trò "người làm" sang vai trò "người kiểm soát", đưa ra phán quyết cuối cùng dựa trên kết quả do AI đề xuất.
Ông Jakub Pachocki, nhà khoa học trưởng của OpenAI, cũng lên tiếng cảnh báo rằng sự tiến bộ về trí thông minh không đồng nghĩa với sự tiến bộ về an toàn. Ông cam kết OpenAI sẽ không chấp nhận việc suy giảm khả năng giám sát các mô hình của mình và sẵn sàng tạm dừng phát triển nếu độ tin cậy không đủ.
Liệu đây có phải là Kỷ nguyên AGI?
Khi được hỏi trực tiếp rằng liệu Astra có phải là AGI hay không, Greg Brockman đã trả lời với một tuyên bố mạnh mẽ: "Với cá nhân tôi, tôi tin chúng ta đã đạt đến mốc đó." Tuy nhiên, ông không dùng một cột mốc duy nhất để chứng minh, mà nhìn nhận AGI giống như một quá trình chuyển đổi kinh tế – sẽ ngày càng khó để phủ nhận rằng chúng ta đang sống trong thời kỳ "AI có thể thay thế nhiều công việc giá trị về mặt kinh tế".
Cho dù GPT-6 Astra có thực sự đại diện cho "trí tuệ tổng quát" trong mắt giới học thuật hay không, thì không thể phủ nhận một điều: thế giới doanh nghiệp, từ Thung lũng Silicon đến các công ty tại Việt Nam, đang đứng trước một trong những bước ngoặt lớn nhất trong lịch sử công nghệ. Câu hỏi quan trọng lúc này không còn là "AI có thể làm gì?", mà là "chúng ta sẵn sàng tin tưởng và giám sát AI để chúng làm được nhiều việc tới mức nào?".