OpenAI cho biết một nhóm gồm 10.000 AI agent đã đưa ra lời giải đề xuất cho một trong bảy Bài toán Thiên niên kỷ của toán học, mỗi bài trị giá 1 triệu USD (USD). Giới toán học hiện đang tranh cãi về cách hệ thống này tìm ra đáp án. Điều này quan trọng vì nó kiểm chứng liệu AI có thể tạo ra đột phá thực sự hay chỉ đơn thuần lặp lại những gì con người đã biết.
Chuyện gì đã xảy ra
Theo CoinDesk, OpenAI cho biết một mô hình nội bộ, mạnh hơn cả hệ thống GPT-6 Astra, đã đưa ra lời giải đề xuất cho một bài toán lớn. Công ty đã sử dụng một nhóm phối hợp gồm 10.000 AI agent để thực hiện nhiệm vụ này. Mục tiêu là một trong bảy Bài toán Thiên niên kỷ, mỗi bài mang giải thưởng 1 triệu USD. Báo cáo không nêu rõ bài toán nào trong bảy bài đã được nhắm tới, cũng như không công bố toàn bộ tài liệu kỹ thuật. Các nhà toán học xem xét tuyên bố này đang đặt câu hỏi về mức độ độc lập của hệ thống AI khi đưa ra đáp án. Tranh cãi xoay quanh việc liệu các agent có tự mình giải quyết bài toán hay dựa nhiều vào các kỹ thuật chứng minh đã có sẵn của con người được tích hợp vào hệ thống.
Bối cảnh
OpenAI đã chạy đua để chứng minh các mô hình của mình có thể xử lý lập luận nâng cao, chứ không chỉ các tác vụ ngôn ngữ. GPT-6 Astra, được nhắc đến như mốc chuẩn mà hệ thống mới này vượt qua, là mô hình được đặt tên gần đây nhất của OpenAI trước khi hệ thống nội bộ này xuất hiện. Các công ty AI ngày càng chuyển sang sử dụng số lượng lớn agent phối hợp với nhau, thay vì một mô hình đơn lẻ, để giải quyết các vấn đề phức tạp. Tuyên bố lần này mở rộng cách tiếp cận đó sang một trong bảy Bài toán Thiên niên kỷ, nhóm bài toán được xem là khó nhất trong lĩnh vực toán học, theo CoinDesk.
Vì sao điều này quan trọng với bạn
Đối với những người xây dựng AI, tuyên bố này nâng cao tiêu chuẩn mà các hệ thống dựa trên agent phải chứng minh trước khi một kết quả được công nhận là đã kiểm chứng. Đối với các nhà toán học, nó tạo thêm áp lực phải xây dựng những cách nhanh hơn để kiểm tra các chứng minh do AI tạo ra. Đối với người dùng thông thường và những người nắm giữ tài sản liên quan đến AI, tranh cãi này là lời nhắc nhở rằng những tuyên bố năng lực táo bạo cần được xác minh độc lập trước khi chúng tác động đến thị trường hay danh tiếng. Nếu được xác nhận, kết quả này có thể thúc đẩy nhiều nghiên cứu hơn theo hướng đàn agent. Nếu bị bác bỏ, nó có thể làm giảm niềm tin vào các thông báo riêng lẻ của một công ty về những kết quả toán học đột phá.
Câu hỏi lớn hơn
Nếu một hệ thống AI không thể trình bày đầy đủ đường đi lập luận của mình, làm sao ai đó có thể đánh giá liệu một đột phá toán học là thật sự hay chỉ là vay mượn? Câu hỏi này vượt ra ngoài phạm vi của OpenAI. Khi các AI agent đảm nhận những vấn đề khoa học khó hơn, ngành này cần một cách để phân biệt khám phá độc lập thực sự với những công việc dựa vào đầu vào ẩn giấu của con người. Ai sẽ đặt ra tiêu chuẩn đó, và ai sẽ kiểm tra nó?
Những điều cần theo dõi
Các nhà toán học độc lập dự kiến sẽ xem xét lời giải đề xuất trước khi nó được công nhận là đã kiểm chứng. Chưa có mốc thời gian bình duyệt chính thức nào được công bố. Hãy theo dõi xem OpenAI có công bố thêm chi tiết kỹ thuật về mô hình nội bộ và bài toán Thiên niên kỷ cụ thể được nhắm tới hay không. Sự giám sát chặt chẽ hơn từ cộng đồng toán học trong những tuần tới có thể xác nhận, điều chỉnh, hoặc bác bỏ tuyên bố này.



