Tranh cãi xoay quanh dữ liệu huấn luyện của OpenAI trong nghiên cứu toán học

Các nhà toán học đang công khai chỉ trích OpenAI vì nghi ngờ rằng công ty này có thể đã sử dụng trái phép công trình chưa công bố của họ trong dữ liệu huấn luyện. Mặc dù OpenAI khẳng định không trực tiếp dùng dữ liệu cụ thể của người dùng, nhưng sự thiếu minh bạch tiếp tục gây lo ngại trong giới học thuật, làm dấy lên mối quan ngại về sự minh bạch và công bằng trong nghiên cứu AI.

Tranh cãi xoay quanh dữ liệu huấn luyện của OpenAI trong nghiên cứu toán học
Ảnh: www.theverge.com

Cuộc tranh luận về nguồn gốc dữ liệu huấn luyện

Một trong các nhà toán học nổi tiếng, Andreas Thom, đã đưa ra những nghi vấn và chỉ trích OpenAI về tính trung thực trong cách xử lý dữ liệu huấn luyện. Thom, cùng với cộng sự Gábor Kun, cảm thấy công trình của họ có thể đã được OpenAI sử dụng mà không có sự thừa nhận đầy đủ. Điều gây tranh cãi là một trong 10 kết quả mà OpenAI công bố có liên quan trực tiếp đến lĩnh vực mà Thom chuyên nghiên cứu, đó là các nhóm non-sofic.

Tranh cãi xoay quanh dữ liệu huấn luyện của OpenAI trong nghiên cứu toán học
Ảnh: www.theverge.com

Phản hồi từ OpenAI và những câu hỏi chưa được trả lời

Thom đã liên lạc OpenAI để làm rõ liệu các tương tác của ông với ChatGPT có nằm trong dữ liệu huấn luyện hay không, nhưng câu trả lời nhận được không thuyết phục. OpenAI chỉ giải thích rằng các cuộc trò chuyện không được truy cập trực tiếp, mà không đề cập đến việc các tương tác này có thể nằm trong “một dòng chảy dữ liệu” mà công ty sử dụng để cải thiện mô hình.

Khả năng ảnh hưởng gián tiếp của dữ liệu

OpenAI đã tuyên bố không sử dụng dữ liệu cá nhân cụ thể trong một số vấn đề toán học nổi tiếng, nhưng không dứt khoát phủ nhận khả năng dữ liệu từ người dùng có thể đã ảnh hưởng gián tiếp. Việc sử dụng dữ liệu dưới dạng “vô danh hóa” được cho là có thể làm “mờ tên” nhưng vẫn giữ lại ý tưởng trí tuệ.

Mối quan ngại về đạo đức và công bằng

Theo Thom, nếu dữ liệu hoặc nghiên cứu chưa công bố của người dùng được dùng để cải thiện mô hình của OpenAI mà không có sự đồng ý và ghi nhận xứng đáng, thì điều này không chỉ thiếu đạo đức mà còn không công bằng với những nhà nghiên cứu đã cống hiến trí tuệ của họ.

Ảnh hưởng tiêu cực trong cộng đồng học thuật

Sự việc này đã tạo ra làn sóng lo ngại trong cộng đồng toán học rằng tương lai của nghiên cứu có thể trở nên bí mật hơn. Các nhà nghiên cứu lo ngại rằng ngay cả những tin đồn về một đột phá có thể dễ dàng trở thành cuộc đua với những công ty công nghệ lớn, những người không ngại săn đón vinh quang bằng các nguồn lực hùng hậu.

OpenAI chưa có phản hồi chính thức về các cáo buộc này. Cộng đồng toán học đang chờ đợi một sự minh bạch từ OpenAI để đảm bảo rằng các quy tắc đạo đức và công bằng trong nghiên cứu khoa học không bị phá vỡ.


Nguồn tham khảo: www.theverge.com. Nội dung được Media LAB biên tập và tổng hợp lại.

Nên đọc

Tin mới

spot_img

Related Articles

Popular Categories

spot_img