OpenAI ระบุว่ากลุ่ม AI agent จำนวน 10,000 ตัว ร่วมกันสร้างข้อเสนอวิธีแก้โจทย์หนึ่งในเจ็ดข้อของ Millennium Prize Problems ทางคณิตศาสตร์ ซึ่งแต่ละข้อมีเงินรางวัลสูงถึง 1 ล้านดอลลาร์สหรัฐ ทว่าขณะนี้นักคณิตศาสตร์กำลังตั้งคำถามว่าระบบดังกล่าวได้คำตอบมาด้วยตัวเองมากน้อยเพียงใด เรื่องนี้สำคัญเพราะเป็นบททดสอบว่า AI สามารถสร้างความก้าวหน้าที่แท้จริงได้หรือไม่ ไม่ใช่แค่ทำซ้ำสิ่งที่มนุษย์เคยทำไว้แล้ว
สิ่งที่เกิดขึ้นจริง
ตามรายงานของ CoinDesk OpenAI ระบุว่าโมเดลภายในบริษัทตัวหนึ่ง ซึ่งมีศักยภาพเหนือกว่าระบบ GPT-6 Astra ได้สร้างข้อเสนอวิธีแก้โจทย์คณิตศาสตร์ระดับสำคัญขึ้นมา โดยบริษัทใช้ AI agent จำนวน 10,000 ตัวทำงานประสานกันเพื่อรับมือกับภารกิจนี้ เป้าหมายคือหนึ่งในเจ็ดข้อของ Millennium Prize Problems ที่แต่ละข้อมีเงินรางวัล 1 ล้านดอลลาร์สหรัฐ อย่างไรก็ตาม รายงานไม่ได้ระบุว่าเป็นโจทย์ข้อใดในเจ็ดข้อนั้น และไม่มีการเผยรายละเอียดทางเทคนิคฉบับเต็ม นักคณิตศาสตร์ที่ตรวจสอบคำกล่าวอ้างนี้กำลังตั้งคำถามว่าระบบ AI ไปถึงคำตอบด้วยความเป็นอิสระมากแค่ไหน ข้อโต้แย้งหลักอยู่ที่ว่า agent เหล่านี้แก้โจทย์ได้ด้วยตัวเองจริง หรืออาศัยเทคนิคการพิสูจน์ที่มนุษย์เคยคิดไว้แล้วซึ่งถูกฝังอยู่ในระบบเป็นหลัก
เส้นทางที่นำมาสู่จุดนี้
OpenAI พยายามพิสูจน์มาโดยตลอดว่าโมเดลของตนสามารถรับมือกับการให้เหตุผลขั้นสูง ไม่ใช่แค่งานด้านภาษา GPT-6 Astra ซึ่งถูกกล่าวถึงในฐานะระบบพื้นฐานที่ระบบใหม่นี้ทำได้ดีกว่า ถือเป็นโมเดลล่าสุดที่ OpenAI ตั้งชื่อไว้ก่อนหน้าระบบภายในตัวนี้ ห้องแล็บด้าน AI หันมาใช้แนวทางการรวมกลุ่ม agent จำนวนมากทำงานร่วมกันมากขึ้นเรื่อยๆ แทนที่จะใช้โมเดลเดี่ยว เพื่อรับมือกับปัญหาที่ซับซ้อน คำกล่าวอ้างครั้งนี้ขยายแนวทางดังกล่าวไปสู่หนึ่งในเจ็ดข้อของ Millennium Prize Problems ซึ่งเป็นหมวดหมู่ที่ถูกมองว่ายากที่สุดในวงการคณิตศาสตร์ ตามรายงานของ CoinDesk
เหตุใดเรื่องนี้จึงสำคัญกับคุณ
สำหรับผู้พัฒนา AI คำกล่าวอ้างนี้ยกระดับมาตรฐานที่ระบบซึ่งใช้ agent ทำงานร่วมกันต้องพิสูจน์ ก่อนที่ผลลัพธ์จะได้รับการยืนยันว่าเป็นจริง สำหรับนักคณิตศาสตร์ มันเพิ่มแรงกดดันให้ต้องสร้างวิธีตรวจสอบบทพิสูจน์ที่ AI สร้างขึ้นได้เร็วขึ้น สำหรับผู้ใช้งานทั่วไปและผู้ถือสินทรัพย์ที่เกี่ยวข้องกับ AI ข้อโต้แย้งนี้เป็นเครื่องเตือนใจว่าคำกล่าวอ้างเรื่องศักยภาพที่ยิ่งใหญ่ต้องผ่านการตรวจสอบอย่างเป็นอิสระก่อนที่จะส่งผลต่อตลาดหรือชื่อเสียง หากได้รับการยืนยัน ผลลัพธ์นี้อาจผลักดันให้งานวิจัยหันไปใช้ฝูง agent มากขึ้น แต่หากถูกโต้แย้งจนล้มเหลว ก็อาจทำให้ความเชื่อมั่นต่อคำประกาศผลงานคณิตศาสตร์ครั้งใหญ่จากบริษัทเดียวลดลง
คำถามใหญ่ที่รออยู่
หากระบบ AI ไม่สามารถแสดงเส้นทางการให้เหตุผลทั้งหมดได้ แล้วใครจะตัดสินได้อย่างไรว่าความก้าวหน้าทางคณิตศาสตร์นั้นเป็นของแท้หรือยืมมาจากที่อื่น คำถามนี้ไม่ได้จำกัดอยู่แค่กรณีของ OpenAI เท่านั้น เมื่อ AI agent เริ่มรับมือกับปัญหาทางวิทยาศาสตร์ที่ยากขึ้นเรื่อยๆ วงการนี้จำเป็นต้องมีวิธีแยกแยะการค้นพบที่เป็นอิสระอย่างแท้จริง ออกจากงานที่พึ่งพาข้อมูลจากมนุษย์ที่ซ่อนอยู่เบื้องหลัง แล้วใครจะเป็นผู้กำหนดมาตรฐานนั้น และใครจะเป็นผู้ตรวจสอบ
สิ่งที่ต้องจับตา
นักคณิตศาสตร์อิสระคาดว่าจะเข้ามาตรวจสอบข้อเสนอวิธีแก้โจทย์นี้ ก่อนที่มันจะถูกนับว่าได้รับการยืนยันอย่างเป็นทางการ ขณะนี้ยังไม่มีการประกาศกรอบเวลาสำหรับการตรวจสอบโดยผู้เชี่ยวชาญอย่างเป็นทางการ จับตาดูว่า OpenAI จะเปิดเผยรายละเอียดทางเทคนิคเพิ่มเติมเกี่ยวกับโมเดลภายในตัวนี้ และโจทย์ Millennium Prize Problem ข้อที่ถูกนำมาใช้หรือไม่ การตรวจสอบเพิ่มเติมจากแวดวงคณิตศาสตร์ในอีกไม่กี่สัปดาห์ข้างหน้าอาจช่วยยืนยัน แก้ไข หรือปฏิเสธคำกล่าวอ้างนี้ในที่สุด



