OpenAI tuyên bố giải mã bài toán 90 năm tuổi, nhưng ngay lập tức vướng vào tranh cãi đạo văn
OpenAI vừa công bố tìm ra lời giải cho bài toán Navier-Stokes, một trong bảy bài toán Thiên niên kỷ tồn tại suốt 90 năm qua, bằng một mô hình AI nội bộ mạnh hơn GPT-6 Astra. Tuy nhiên, niềm vui chiến thắng nhanh chóng bị lu mờ bởi cáo buộc từ nhà toán học Tristan Buckmaster rằng OpenAI có thể đã sử dụng dữ liệu nghiên cứu của ông và đồng nghiệp để đạt được kết quả này.

OpenAI tuyên bố giải mã bài toán 90 năm tuổi, nhưng ngay lập tức vướng vào tranh cãi đạo văn
OpenAI vừa gây chấn động giới toán học khi tuyên bố tìm ra lời giải cho bài toán Navier-Stokes, một thách thức tồn tại suốt 90 năm qua và là một trong bảy "Bài toán Thiên niên kỷ" của Viện Toán học Clay, kèm giải thưởng 1 triệu USD. Thế nhưng, chiến thắng mang tính biểu tượng này lại ngay lập tức bị nghi ngờ khi một nhà nghiên cứu khác công bố lời giải cho một bài toán liên quan chỉ một ngày trước đó, dấy lên cáo buộc về việc OpenAI có thể đã tiếp cận dữ liệu nghiên cứu bí mật để đi tắt đón đầu.
Trong một bài đăng trên blog vào thứ Ba (theo giờ Mỹ), OpenAI cho biết họ đã sử dụng một mô hình AI nội bộ mạnh hơn cả GPT-6 Astra vừa ra mắt, kết hợp với 10.000 tác nhân (agents) hoạt động song song, để giải quyết bài toán Navier-Stokes. Đây là phương trình mô tả chuyển động của chất lỏng và chất khí, được đặt theo tên nhà vật lý người Pháp Claude-Louis Navier và nhà toán học người Ireland George Gabriel Stokes. Việc tìm ra lời giải cho bài toán này được xem là bước đột phá lớn, không chỉ về mặt lý thuyết mà còn có ứng dụng thực tiễn trong khí tượng học, hàng không và thiết kế tàu thủy.
Mô phỏng trí tuệ nhân tạo đang xử lý các phương trình toán học phức tạp
Đây là một thành tựu vượt bậc, cho thấy tiềm năng của AI trong việc giải quyết những vấn đề toán học mà con người đã bó tay trong gần một thế kỷ. Nhưng câu chuyện chưa dừng lại ở đó.
Nghi vấn về nguồn dữ liệu nghiên cứu
Phía sau tuyên bố lịch sử là một loạt cáo buộc gây tranh cãi. Một ngày trước khi OpenAI công bố kết quả, giáo sư toán học Tristan Buckmaster đến từ Đại học New York (NYU) và nhà nghiên cứu Levent Alpöge tại Anthropic cũng đã công bố phát hiện về một bài toán có liên quan mật thiết đến phương trình Navier-Stokes.
Đáng chú ý, Buckmaster cho biết chính ông đã liên hệ với OpenAI sau khi nghe tin công ty này đã biết về tiến độ nghiên cứu của họ. Tuy nhiên, ông nhanh chóng nhận ra rằng OpenAI đã tạo ra một chứng minh cho phương trình Navier-Stokes bằng chính con đường mà ông và Alpöge đang theo đuổi, sử dụng công cụ Codex của OpenAI và Claude của Anthropic trong suốt quá trình nghiên cứu.
Trong tuyên bố của mình, Buckmaster bày tỏ lo ngại: "Tôi hỏi liệu mô hình có được huấn luyện hoặc có quyền truy cập vào các phiên làm việc của chúng tôi trong Codex hay không, nơi chúng tôi đã đưa toàn bộ bản nháp của dự án này vào. Tôi được trả lời rằng mô hình không xem xét dữ liệu người dùng. Khi tôi hỏi lại về việc huấn luyện, tôi đã không nhận được câu trả lời." Điều này vô tình làm dấy lên nghi ngờ rằng OpenAI có thể đã hấp thụ dữ liệu từ các phiên lập trình của Buckmaster trên Codex để tối ưu hóa mô hình của mình.
Phản hồi từ OpenAI
Đối mặt với làn sóng chỉ trích, OpenAI đã nhanh chóng đưa ra tuyên bố chính thức trong bài đăng thứ Ba của mình, khẳng định: "Không có dữ liệu người dùng cụ thể nào được truy cập để giải quyết vấn đề này." Trong một động thái có phần mềm mỏng, họ nói thêm: "Mặc dù điều này khó xảy ra, nhưng chúng tôi không thể loại trừ khả năng dữ liệu phi định danh có nguồn gốc từ việc sử dụng sản phẩm của chúng tôi có thể đã giúp cải thiện mô hình."
Sebastien Bubeck, một thành viên của đội ngũ kỹ thuật tại OpenAI, cũng lên tiếng bảo vệ quan điểm của công ty: "Chúng tôi không hề thấy bất kỳ công trình nào của họ cho đến khi họ công khai phát hành vào đêm qua. Nhìn lại, có thể thấy các chứng minh của chúng tôi khác biệt đáng kể và thậm chí các kết quả chính xác được chứng minh cũng khác nhau."
Cuộc chiến mới trong kỷ nguyên AI
Tuy nhiên, Buckmaster không chấp nhận lời giải thích này. Trong một bài đăng trên mạng xã hội Mastodon, ông cáo buộc OpenAI "công khai thừa nhận họ đã sử dụng dữ liệu huấn luyện từ một khoảng thời gian sau khi chúng tôi đã tìm ra kết quả của mình". Điều này tạo nên một tình thế "tiến thoái lưỡng nan" khi các mô hình AI ngày càng được huấn luyện trên một lượng dữ liệu khổng lồ, bao gồm cả các nghiên cứu chưa được công bố, ranh giới giữa việc "học hỏi" hợp pháp và "sao chép" ý tưởng ngày càng trở nên mong manh.
Về phần mình, OpenAI tuyên bố sẽ không nhận giải thưởng 1 triệu USD cho lời giải này. Đáng chú ý, khi cuộc tranh cãi vẫn chưa có hồi kết, giới công nghệ và toán học quốc tế đang dõi theo sát sao vụ việc. Với sự phát triển thần tốc của các mô hình AI như GPT-6 Astra hay các đối thủ từ Anthropic, vụ việc lần này có thể trở thành tiền lệ pháp lý và đạo đức quan trọng cho các nghiên cứu khoa học có sự tham gia của AI trong tương lai. Đây không chỉ là câu chuyện về một bài toán, mà là hồi chuông cảnh tỉnh về cách chúng ta quản lý dữ liệu, bản quyền và sự minh bạch trong các công cụ AI đang ngày càng trở nên mạnh mẽ và phổ biến hơn bao giờ hết.

