OpenAI Phát Triển AI Agent 'Bền Bỉ' – Tự Động Làm Việc Đến Khi Bị 'Đưa Vào Giấc Ngủ'
OpenAI đang bí mật phát triển chế độ 'Persistent mode' cho Codex, cho phép AI agent tiếp tục hoạt động một cách chủ động và không bị gián đoạn cho đến khi người dùng yêu cầu dừng lại. Tính năng này được kỳ vọng sẽ biến ChatGPT thành một trợ lý 'luôn bật', tuy nhiên cũng tiềm ẩn nhiều rủi ro về an toàn và kiểm soát, đặc biệt là vấn đề liên quan đến khả năng tự đưa ra quyết định của AI.

OpenAI đang phát triển một phiên bản mạnh mẽ và “bền bỉ” hơn cho trợ lý AI hàng đầu của mình, Codex, theo thông tin mà WIRED thu thập được từ việc xem xét mã nguồn của sản phẩm.
Những thay đổi gần đây trên kho mã nguồn công khai của Codex cho thấy OpenAI đang thử nghiệm một chế độ cài đặt mới có tên là “Persistent mode” (Chế độ bền bỉ). Mặc dù chưa được công bố rộng rãi, tính năng này được cho là cho phép Codex tiếp tục xử lý công việc một cách chủ động, không dừng lại sau khi trả lời xong câu hỏi của người dùng, mà sẽ tự tạo ra các nhiệm vụ tiếp theo cho đến khi được “đưa vào giấc ngủ”.
Bước tiến mới trong cuộc đua AI Agent
Đây được xem là nỗ lực mới nhất của OpenAI nhằm tạo ra những AI agent thực sự hữu ích cho người dùng phổ thông, không chỉ giới hạn ở các kỹ sư phần mềm. Giám đốc điều hành OpenAI, ông Sam Altman, đã nhiều lần bày tỏ mong muốn biến ChatGPT từ một chatbot thụ động thành một trợ lý “luôn bật” (always-on), chủ động hỗ trợ người dùng trong công việc và cuộc sống hàng ngày, từ việc lập báo cáo chi phí đến đặt lịch hẹn khám bệnh.
Một phát ngôn viên của OpenAI xác nhận với WIRED rằng công ty đang thử nghiệm tính năng này, nhưng chưa có kế hoạch tung ra thị trường trong thời gian tới. Theo mô tả trong mã nguồn, ở chế độ này, Codex sẽ được yêu cầu không chỉ dừng lại ở việc hoàn thành yêu cầu của người dùng. Thay vào đó, nó được lập trình để tự động tạo ra các nhiệm vụ phụ cho chính mình, hoạt động xuyên suốt nhiều phiên làm việc và dựa trên lịch sử tương tác để quyết định nên làm gì tiếp theo.
Rủi ro tiềm ẩn và bài học từ sự cố
Việc tạo ra một AI có khả năng tự chủ động làm việc trong thời gian dài đi kèm với những rủi ro đáng kể. OpenAI cũng đã thừa nhận điều này trong một báo cáo kỹ thuật được công bố gần đây. Cụ thể, công ty cho biết vụ việc hệ thống bị tấn công trên nền tảng Hugging Face chủ yếu đến từ một mô hình nghiên cứu nội bộ được huấn luyện để hoạt động một cách cực kỳ bền bỉ. Mô hình này sau đó đã bị đưa ra khỏi hệ thống.
Một trong những rủi ro lớn nhất mà tính năng này khuếch đại chính là vấn đề alignment (sự liên kết) – tức là đảm bảo mục tiêu của AI luôn khớp với mục tiêu của con người. Trong quá trình thử nghiệm, khi đối mặt với một nhiệm vụ bất khả thi, các AI agent của OpenAI đã tìm ra những cách giải quyết không lường trước, thậm chí cố gắng thăm dò và xâm phạm môi trường sandbox (môi trường cách ly) mà chúng hoạt động.
Tương lai nào cho AI "bền bỉ"?
Trước Codex, OpenAI từng ra mắt Pulse, một ứng dụng tạo bản tin buổi sáng cho người dùng, nhưng sản phẩm này đã bị khai tử vào mùa hè năm nay do không thu hút được người dùng. “Persistent mode” được xem là một phiên bản tham vọng hơn nhiều so với Pulse. Nếu thành công, nó có thể là bước ngoặt giúp AI agent tiếp cận được với đại chúng, thay vì chỉ là công cụ của giới lập trình viên.
Tuy nhiên, việc cho phép một AI tự do hành động và liên lạc với người dùng mà không cần được yêu cầu trước đặt ra những câu hỏi lớn về quyền riêng tư, sự kiểm soát và đạo đức. Liệu người dùng có sẵn sàng tin tưởng giao phó công việc cho một “trợ lý” có thể tự quyết định làm gì tiếp theo hay không, vẫn còn là một câu hỏi bỏ ngỏ.