Base Labs hợp tác cùng Hugging Face và Goodfire xây dựng chuẩn an toàn cho mô hình AI mở

Công nghệ17 tháng 9, 2026·3 phút đọc

Base Labs — nhóm nghiên cứu do Baseten thành lập — công bố quan hệ đối tác với Hugging Face và Goodfire AI nhằm phát triển các phương pháp huấn luyện và giám sát mô hình AI trọng số mở. Sáng kiến ra đời trong bối cảnh hơn 6.000 mô hình mở đã bị gỡ bỏ rào chắn an toàn thông qua kỹ thuật "abliteration".

Base Labs hợp tác cùng Hugging Face và Goodfire xây dựng chuẩn an toàn cho mô hình AI mở

Baseten vừa công bố một chuẩn hạ tầng an toàn mới song hành cùng nhóm nghiên cứu Base Labs, hợp tác với Hugging Face và Goodfire AI để xây dựng hạ tầng đánh giá và giám sát an toàn cho các mô hình AI trọng số mở (open-weight).

Thông báo này xuất hiện giữa lúc dư luận đang tranh luận gay gắt về mức độ an toàn của mô hình mở — vốn có thể bị biến thành công cụ nguy hiểm khi các rào chắn bảo vệ bị gỡ bỏ bằng một kỹ thuật đang nổi lên có tên abliteration. Quy mô của vấn đề không hề nhỏ: Hugging Face, nền tảng lưu trữ mô hình AI mã nguồn mở, hiện liệt kê hơn 6.000 mô hình đã bị abliterated.

Chuẩn an toàn gắn liền với quá trình huấn luyện

Base Labs — nhóm nghiên cứu được Baseten thành lập hồi đầu năm nay — sẽ phát triển và công bố các phương pháp huấn luyện và giám sát mô hình mở. Công ty định vị công việc sắp tới của mình như một "chuẩn" cho mô hình mở, theo hướng minh bạch và được tích hợp ngay vào cách mô hình được huấn luyện và triển khai, thay vì gắn thêm sau khi hoàn tất.

"Chúng tôi tin rằng sự cởi mở là một lợi thế cho an toàn AI. Tính mở mang lại khả năng quan sát hành vi của mô hình tốt hơn, và quan trọng nhất là nhiều phương tiện hơn để biến nghiên cứu an toàn thành các biện pháp kiểm soát minh bạch và có thể hành động so với mã nguồn đóng."

Các bên chưa tiết lộ chi tiết kỹ thuật của quan hệ đối tác, dù Goodfire đã phác họa mục tiêu trong phản hồi bài đăng của Baseten: "An toàn phải được tích hợp sẵn vào mô hình mở và do chính những đơn vị cung cấp chúng đảm bảo." Goodfire — đơn vị chuyên mở "hộp đen" AI để giải thích cách mô hình đưa ra quyết định — là ứng viên sáng giá nhất cho phần "tích hợp sẵn" này.

Tiềm lực tài chính của các bên

Baseten, nhà cung cấp dịch vụ suy luận AI (AI inference), đã gọi vốn thành công 1,5 tỷ USD ở vòng Series F hồi tháng 6, đẩy định giá công ty lên 13 tỷ USD. Đối tác Goodfire AI cũng được tài trợ mạnh không kém, với 150 triệu USD ở vòng Series B do B Capital dẫn dắt hồi đầu năm để phát triển nền tảng diễn giải mô hình.

Lời kêu gọi cộng đồng

Trong thời gian tới, Baseten đưa ra lời kêu gọi mở đối với toàn bộ hệ sinh thái nhà phát triển cùng đóng góp cho khuôn khổ này.

"Cùng nhau, chúng tôi đang xây dựng một hệ sinh thái mô hình mở an toàn và dễ tiếp cận cho tất cả mọi người."

Góc nhìn cho Việt Nam

Với cộng đồng AI Việt Nam đang ngày càng tích cực tham gia các mô hình mở như Llama, Mistral hay Qwen, việc thiếu chuẩn an toàn có thể tạo ra rủi ro thực tế. Các doanh nghiệp và nhóm nghiên cứu trong nước khi tinh chỉnh (fine-tune) hoặc triển khai mô hình mở nên theo dõi sát các chuẩn mới này, đồng thời chủ động đánh giá rủi ro trước khi đưa mô hình vào sản phẩm thương mại. Một khuôn khổ an toàn minh bạch, gắn liền với huấn luyện, sẽ giúp các dự án AI nội địa vừa tận dụng được lợi thế của mã nguồn mở, vừa hạn chế nguy cơ bị lạm dụng hoặc gỡ bỏ rào chắn trái phép.

Chia sẻ:FacebookX
Nội dung tổng hợp bằng AI, mang tính tham khảo. Xem bài gốc ↗