CEO Y Combinator: Mỹ nên cho phép các lab AI mã nguồn mở 'chưng cất' mô hình tiên tiến
Garry Tan, CEO của Y Combinator, cho rằng các phòng thí nghiệm AI mã nguồn mở của Mỹ nên được tự do 'chưng cất' (distill) kiến thức từ các mô hình tiên tiến nội địa, thay vì để Trung Quốc độc chiếm lợi thế này. Ông lập luận rằng tri thức huấn luyện từ dữ liệu công khai nên được xem là tài sản chung, không nên bị khóa chặt sau các điều khoản dịch vụ hạn chế.

CEO Y Combinator: Mỹ nên cho phép các lab AI mã nguồn mở 'chưng cất' mô hình tiên tiến
Garry Tan — CEO của Y Combinator — vừa đưa ra quan điểm gây tranh cãi khi cho rằng các phòng thí nghiệm AI mã nguồn mở của Mỹ nên được phép sử dụng kỹ thuật "chưng cất" (distillation) để học hỏi từ các mô hình tiên tiến trong nước. Ông phản đối việc cơ quan quản lý can thiệp vào vấn đề này, đồng thời nhấn mạnh rằng tri thức được huấn luyện từ dữ liệu công khai nên được coi là một dạng tài sản chung.
Chưng cất là gì và tại sao nó gây tranh cãi?
Chưng cất (distillation) là kỹ thuật trong đó một nhà phát triển mô hình liên tục đặt câu hỏi cho một mô hình khác nhằm tìm hiểu cách nó hoạt động và lý luận. Đây là phương pháp phổ biến và hợp pháp, thường được các phòng thí nghiệm AI sử dụng để hỗ trợ huấn luyện các mô hình mới.
Tuy nhiên, tranh cãi nổ ra khi Anthropic công bố báo cáo thứ hai cáo buộc các phòng thí nghiệm Trung Quốc thực hiện "các cuộc tấn công chưng cất bất hợp pháp" — che giấu danh tính để chưng cất mà không xin phép, dựa vào gian lận và thông tin đăng nhập bị đánh cắp. Trước đó, CEO Anthropic Dario Amodei từng công khai kêu gọi cơ quan quản lý Mỹ mạnh tay xử lý vấn đề này.
Quan điểm trái chiều từ "thủ lĩnh" Thung lũng Silicon
Điều đáng chú ý là người đứng đầu Y Combinator — chương trình tăng tốc khởi nghiệp danh giá và sung mãn bậc nhất Thung lũng Silicon — lại không đồng tình với lập trường trên.
"Tôi sẽ không làm gì cả. Chúng ta có thể tranh luận rằng nên có một chế độ chưng cất của riêng nước Mỹ."
Tan giải thích với TechCrunch rằng ông muốn các phòng thí nghiệm AI mã nguồn mở nhỏ hơn của Mỹ được áp dụng kỹ thuật huấn luyện tương tự lên các mô hình tiên tiến nội địa, qua đó mang lại cho nước Mỹ một bộ lựa chọn mã nguồn mở mạnh mẽ hơn, không phải là hàng Trung Quốc.
Cần làm rõ: Tan không cổ vũ việc các lab Mỹ dùng thông tin đăng nhập bị đánh cắp để chưng cất. Ông muốn họ được tự do bước qua "cửa chính". Lập luận của ông gồm hai phần:
- Thứ nhất, việc các lab AI áp đặt quy định lên những gì khách hàng có thể làm với thông tin mà mô hình chia sẻ là hành vi vượt quá thẩm quyền.
- Thứ hai, chính các lab AI độc quyền cũng từng không xin phép khi thu thập lượng lớn tri thức nhân loại để huấn luyện mô hình, bao gồm nhiều tài liệu có bản quyền.
"Việc kiểm soát những gì người dùng và khách hàng làm với các lệnh gọi API tới mô hình đóng kín cảm giác rất gò bó. Chính phủ có thể đóng vai trò ở đây để bình thường hóa thực tế rằng quyền truy cập vào trí tuệ được huấn luyện trên dữ liệu công khai rộng rãi cũng nên là một dạng tài sản chung, thay vì bị khóa sau các điều khoản dịch vụ hạn chế."
Bài toán cân bằng giữa mã nguồn mở và mô hình tiên tiến
Bản thân Tan là một người dùng AI nhiệt thành đến mức từng tự mô tả mình mắc "chứng loạn thần kinh mạng". Ông mong muốn thấy sự cân bằng giữa các phòng thí nghiệm AI mã nguồn mở và các lab tiên tiến.
"Họ đang ở tuyến đầu và thúc đẩy nó tiến lên. Chúng ta muốn điều đó có thể gọi vốn được và trở thành mô hình kinh doanh tuyệt vời lâu dài. Bạn cũng muốn các mô hình mã nguồn mở trao cho con người sự tự do và khả năng tiếp cận."
Theo Tan, kịch bản "ngày tận thế" thực sự của AI là khi toàn bộ sức mạnh khổng lồ của trí tuệ nhân tạo tiên tiến rơi vào tay chỉ một nhà cung cấp độc quyền duy nhất.
"Kịch bản ác mộng, kịch bản bi quan nhất cho AI là chỉ có một công ty duy nhất. Công ty đó có khả năng tiếp cận vốn tốt nhất, có những nhà nghiên cứu AI giỏi nhất. Nó bứt phá và đột nhiên chỉ còn một công ty độc tôn. Điều đó sẽ rất tồi tệ."
Ý nghĩa với cộng đồng công nghệ Việt Nam
Câu chuyện này đặc biệt đáng chú ý với các nhà phát triển và startup AI tại Việt Nam. Khi các mô hình mã nguồn mở ngày càng mạnh mẽ và dễ tiếp cận, việc được tự do nghiên cứu, tinh chỉnh và chưng cất từ các mô hình lớn sẽ mở ra cánh cửa cho các đội ngũ nhỏ với nguồn lực hạn chế.
Việc cân bằng giữa bảo vệ quyền sở hữu trí tuệ của các lab tiên tiến và thúc đẩy đổi mới sáng tạo mở là bài toán mà cả cộng đồng AI toàn cầu, trong đó có Việt Nam, cần theo dõi sát sao trong thời gian tới. Quan điểm của Garry Tan cho thấy làn sóng ủng hộ mã nguồn mở vẫn đang có tiếng nói mạnh mẽ từ những nhân vật có tầm ảnh hưởng lớn nhất trong giới khởi nghiệp công nghệ.
