Veda: Hệ điều hành đầu tiên được thiết kế cho tác nhân AI ngay từ gốc

Công nghệ11 tháng 10, 2026·9 phút đọc

Veda là một hệ điều hành mã nguồn mở viết hoàn toàn bằng Rust, tích hợp tác nhân AI như một thành phần cốt lõi của hệ thống chứ không phải trợ lý gắn thêm. Mọi ứng dụng đều giao tiếp với tác nhân qua giao thức riêng, tuân thủ cơ chế đồng ý của người dùng, và toàn bộ hệ thống chạy trên kiến trúc vi nhân (microkernel) với các dịch vụ tách biệt.

Veda: Hệ điều hành đầu tiên được thiết kế cho tác nhân AI ngay từ gốc

Veda: Hệ điều hành đầu tiên được thiết kế cho tác nhân AI ngay từ gốc

Veda là một hệ điều hành mã nguồn mở trong đó tác nhân AI (AI agent) là một phần của hệ thống, chứ không phải một trợ lý được gắn thêm vào màn hình nền. Người dùng ra lệnh bằng giọng nói hoặc bàn phím, và tác nhân thực hiện thao tác thông qua chính các API mà ứng dụng dùng — nhưng luôn xin phép trước những hành động khó hoàn tác. Toàn bộ hệ thống được viết từ đầu bằng Rust, từ bộ nạp khởi động UEFI, vi nhân, driver, cho đến hệ thống cửa sổ và các ứng dụng.

Tác nhân AI là một phần của hệ điều hành

Các hệ điều hành truyền thống được thiết kế cho người dùng ngồi trước bàn phím. Khi ta thêm một trợ lý AI vào sau này, nó thường phải đọc màn hình, mô phỏng cú nhấp chuột, hoặc chỉ dùng được với vài ứng dụng có sẵn API — và hệ thống không hề kiểm soát được những gì trợ lý đó làm.

Veda đảo ngược cách tiếp cận này. Tác nhân là một người dùng hạng nhất (first-class user) của hệ thống, và hệ thống được xây dựng để công việc của nó trở nên đáng tin cậy, minh bạch và an toàn.

Giao diện màn hình nền VedaGiao diện màn hình nền Veda

  • Tác nhân là một dịch vụ hệ thống: khởi động cùng máy, tự phục hồi nếu gặp sự cố, hiển thị dưới dạng một vòng tròn nhỏ trên thanh tác vụ và ở trạng thái ngủ cho đến khi được gọi — bằng tên, bằng cú nhấp vào vòng tròn, hoặc bằng tổ hợp Super+Space.
  • Mọi ứng dụng đều giao tiếp với tác nhân một cách tự nhiên: hỗ trợ tác nhân là một phần của nền tảng ứng dụng. Ứng dụng mô tả các hành động của mình với tham số có kiểu dữ liệu và mức độ rủi ro, báo cáo trạng thái có cấu trúc, và thực thi hành động qua cùng đoạn mã mà bàn phím và chuột sử dụng — nên cửa sổ hiển thị kết quả y hệt như khi bạn tự làm. Không cần đọc màn hình, không mô phỏng cú nhấp. Các ứng dụng tích hợp sẵn cung cấp hơn 70 hành động, từ việc viết trong tài liệu cho đến bắt đầu một cuộc đua.
  • Hệ thống ràng buộc tác nhân theo sự đồng ý của bạn: mỗi hành động được phân loại là thường nhật, nhạy cảm hoặc có tính hủy hoại. Hành động thường nhật diễn ra ngay; các loại khác phải chờ bạn xác nhận. Dịch vụ tác nhân — chứ không phải mô hình ngôn ngữ — thực thi quy tắc này.
  • Hoạt động dựa trên ngữ cảnh thực: mỗi cuộc hội thoại bắt đầu với thời gian, các cửa sổ đang mở, hành động của từng ứng dụng, thông tin bạn đã cung cấp về bản thân, và cách cuộc trò chuyện trước kết thúc.
  • Bộ nhớ thuộc về bạn: hệ thống chỉ ghi nhớ những gì bạn nói rõ ràng, không bao giờ lưu phỏng đoán của chính nó. Bộ nhớ được lưu trên máy của bạn, và phần Cài đặt cho phép xem toàn bộ hoặc xóa bất kỳ mục nào.
  • Giọng nói là ưu tiên hàng đầu: các cuộc hội thoại diễn ra theo thời gian thực, bạn có thể ngắt lời tác nhân bất cứ lúc nào. Hệ thống âm thanh được thiết kế riêng với khả năng khử tiếng vọng và cổng chống vọng để tác nhân không bao giờ nghe thấy chính mình.
  • Trí tuệ là một tùy chọn cấu hình: nhận dạng giọng nói, mô hình ngôn ngữ và giọng đọc đến từ nền tảng Voice Agent của Deepgram, với âm thanh được chọn không dùng để cải thiện mô hình. Mô hình, giọng đọc và cả tên của tác nhân đều có thể thay đổi trong phần Cài đặt.

Cách tác nhân hoạt động

Kiến trúc của Veda được chia thành nhiều tầng rõ ràng, từ phần cứng lên đến giao diện người dùng. Khi bạn ngủ, tác nhân chạy một bộ phát hiện giọng nói ngay trên máy. Khi có người lên tiếng, âm thanh được gửi đến bộ nhận dạng đã biết tên của tác nhân; một câu gọi nó ("Hey Veda, …") sẽ đánh thức nó, và những gì được nói kèm theo tên chính là điều đầu tiên nó nghe thấy.

Việc đánh thức sẽ mở một phiên Deepgram Voice Agent với hướng dẫn, ngữ cảnh và các hàm của tác nhân. Deepgram đảm nhiệm việc luân phiên lượt nói, mô hình ngôn ngữ và giọng đọc; dịch vụ âm thanh của Veda truyền âm thanh theo cả hai chiều.

Khi hành động, mô hình gọi các hàm của chính tác nhân — cửa sổ, tệp tin, âm lượng, Wi-Fi, hình nền, thông báo, bộ hẹn giờ, bộ nhớ — và thông qua use_app và read_app, gọi được cả hành động lẫn trạng thái của mọi ứng dụng. Một lệnh gọi cần sự đồng ý của bạn sẽ bị giữ lại và hiển thị trong cửa sổ tác nhân, nêu rõ chính xác điều gì sẽ xảy ra và với đối tượng nào.

Hệ điều hành bên dưới

Veda dùng kiến trúc vi nhân (microkernel). Nhân vkernel chỉ đảm nhiệm cô lập, lập lịch, bộ nhớ và IPC: các handle có quyền hạn theo mô hình capability, kênh truyền handle, VMO, sự kiện, futex, đối tượng ngắt. Driver, hệ thống tệp, hệ thống cửa sổ và tác nhân đều là các tiến trình không gian người dùng do init giám sát — nếu hệ thống cửa sổ gặp sự cố, nó sẽ được khởi động lại và màn hình nền tự phục hồi.

Phần màn hình nền có trình quản lý cửa sổ tổng hợp với bóng đổ, hoạt ảnh, tính năng gắn cửa sổ và trình chuyển đổi Alt+Tab có hình thu nhỏ trực tiếp; nó tổng hợp bằng GPU với OpenGL ES trên các máy PC dùng đồ họa Intel, và bằng CPU ở những nơi khác.

Mạng và Wi-Fi được xử lý bởi dịch vụ không gian người dùng hỗ trợ IPv4, IPv6, DHCP, DNS, định tuyến, TCP, UDP, ICMP, cùng dịch vụ Wi-Fi có khả năng quét, kết nối WPA2/WPA3, ghi nhớ mạng và tự động chuyển vùng. Các ứng dụng — kể cả tác nhân — nhận TLS 1.3 và 1.2 từ vtls, với chứng chỉ được kiểm tra dựa trên kho gốc Mozilla.

Âm thanh là dịch vụ trộn với khả năng thu âm đã khử tiếng vọng và giảm âm thanh khác khi tác nhân đang nói, được thiết kế cho cả hội thoại lẫn nghe nhạc.

Driver Linux chạy trong máy ảo: Veda tự điều khiển đĩa (và âm thanh, hiện tại), còn lại lấy từ Linux chạy trong một máy ảo gọi là driver VM, trên một hypervisor riêng (VMX với EPT, nền tảng bán ảo hóa không mô phỏng phần cứng). Thiết bị được giao trọn vẹn cho máy ảo này, DMA bị giới hạn trong bộ nhớ của nó và ngắt được ánh xạ lại qua driver IOMMU của Veda.

Trình soạn thảo văn bản của VedaTrình soạn thảo văn bản của Veda

Ứng dụng và trải nghiệm người dùng

Veda đi kèm bộ ứng dụng đầy đủ, tất cả đều tương thích với tác nhân:

  • Text Editor: hỗ trợ tab, tô sáng cú pháp (Rust, C, TOML, Markdown), tìm và thay thế, hoàn tác không giới hạn.
  • Photos: thư viện ảnh thu nhỏ của ~/Pictures, xem ảnh với thu phóng, xoay, toàn màn hình và trình chiếu; hỗ trợ PNG, JPEG, BMP và QOI.
  • Music: thư viện nhạc từ ~/Music, phát QOA và WAV qua dịch vụ âm thanh, có bộ hiển thị phổ âm thanh trực tiếp.
  • Files: quản lý tệp với chế độ danh sách và biểu tượng, tìm kiếm, sao chép/di chuyển, và thùng rác có thể khôi phục.
  • Terminal: khoảng 50 lệnh tích hợp cho tệp tin, tiến trình, mạng và hệ thống, hỗ trợ pipe và chuyển hướng.
  • Task Manager, Settings và hai trò chơi 3D là Velocity (đua xe) và Starfall (bắn súng không gian).

Trình quản lý tệp của VedaTrình quản lý tệp của Veda

Veda còn có khả năng chạy GCC 16 ngay bên trong hệ điều hành. Bạn có thể viết một chương trình C trong Terminal hoặc Text Editor, biên dịch và chạy nó — trên máy ảo hoặc trên PC thật. Các chương trình C là tệp thực thi ELF tĩnh dùng thư viện C musl, với các lời gọi hệ thống đi đến vposix, một lớp POSIX viết bằng Rust.

Hướng dẫn cài đặt nhanh

Để chạy Veda, bạn cần một máy PC x64 chạy Linux, Rust (bản ổn định), QEMU cùng firmware UEFI OVMF, và quyền truy cập /dev/kvm. Các bước cơ bản:

# Kiểm tra môi trường
cargo xtask doctor

# Biên dịch và chạy
cargo xtask run

# Tùy chọn độ phân giải, số CPU và bộ nhớ
cargo xtask run --resolution 1920x1080 --smp 4 --memory 2048

Để chạy trên PC thật từ USB, dùng lệnh cargo xtask iso để tạo ảnh ISO, ghi vào USB bằng Rufus (GPT, UEFI, chế độ ISO) và khởi động ở chế độ UEFI với Secure Boot tắt, vì bộ nạp của Veda chưa được ký số. Veda chạy từ bộ nhớ và không đọc hay ghi vào đĩa của PC, nên đây là cách an toàn để thử nghiệm.

Để dùng tác nhân, bạn mở Settings → Agent và nhập khóa Deepgram API. Sau đó chỉ cần nói "Hey Veda", nhấp vào vòng tròn nhỏ trên thanh tác vụ, hoặc nhấn Super+Space. Một vài câu lệnh ví dụ:

"Đổi hình nền của tôi thành cồn cát."

"Phát bài Neon Horizon."

"Viết danh sách mua sắm gồm trứng, sữa và cà phê."

"Nhắc tôi giãn người sau hai mươi phút."

"Xóa ảnh City Lights đi" — và xem nó hỏi bạn trước.

Ý nghĩa đối với người dùng Việt Nam

Veda là một dự án mã nguồn mở đáng chú ý vì nó đặt ra một câu hỏi lớn cho ngành công nghiệp: nếu AI tác nhân trở thành cách chính để con người tương tác với máy tính, thì hệ điều hành cần thay đổi ra sao? Thay vì cố nhồi nhét AI vào Windows, macOS hay Linux, Veda xây dựng lại từ đầu với giả định rằng tác nhân là người dùng hạng nhất.

Với cộng đồng lập trình viên Việt Nam, đây là một dự án tham khảo giá trị, đặc biệt ở phần thiết kế giao thức tác nhân, cơ chế xin phép dựa trên capability, và cách kiểm thử tự động toàn bộ hệ thống bao gồm cả hội thoại với tác nhân. Toàn bộ mã nguồn nằm trên GitHub tại vahmoh25/Veda, phát hành theo giấy phép GNU GPL phiên bản 3.

Chia sẻ:FacebookX
Nội dung tổng hợp bằng AI, mang tính tham khảo. Xem bài gốc ↗