OpenAI อ้าง AI ไขปริศนาโจทย์คณิตศาสตร์ 90 ปี สำเร็จใน 88 ชั่วโมงOpenAI 声称其人工智能在 88 小时内解决了一个有 90 年历史的数学难题。
OpenAI อ้างใช้โมเดลปัญญาประดิษฐ์และ AI Agents ราว 10,000 ตัว จนได้คำตอบของโจทย์นาเวียร์–สโตกส์ ซึ่งเป็นโจทย์คณิตศาสตร์ที่ยังไม่มีคำตอบสมบูรณ์มานานเกือบ 90 ปี ภายในเวลา 88 ชั่วโมง

OpenAI อ้างความสำเร็จครั้งสำคัญ หลังใช้โมเดลปัญญาประดิษฐ์ และ "เอไอเอเจนต์" (AI Agents) ราว 10,000 ตัว ทำงานร่วมกันจนได้คำตอบของโจทย์นาเวียร์–สโตกส์ (Navier-Stokes) ซึ่งเป็นหนึ่งในโจทย์คณิตศาสตร์ที่ยากและยังไม่มีคำตอบสมบูรณ์มานานเกือบ 90 ปี ภายในเวลาเพียง 88 ชั่วโมง แต่ผลการพิสูจน์ยังต้องผ่านการตรวจสอบจากนักคณิตศาสตร์อิสระ
OpenAI บริษัทผู้พัฒนา ChatGPT อ้างว่า สามารถแก้โจทย์คณิตศาสตร์ขั้นสูงที่มีอายุเกือบ 90 ปีได้ภายในเวลาเพียง 88 ชั่วโมง ด้วยการใช้โมเดลปัญญาประดิษฐ์ หรือ AI รุ่นใหม่ภายในบริษัท และระดม "เอไอเอเจนต์" (AI Agents) หรือระบบ AI ที่สามารถทำงานบางอย่างได้อย่างอิสระประมาณ 10,000 ตัว ให้ร่วมกันค้นหาวิธีแก้โจทย์
โจทย์ดังกล่าวเกี่ยวข้องกับสมการนาเวียร์–สโตกส์ ที่ใช้ในการอธิบายการเคลื่อนที่ของของไหล เช่น น้ำและอากาศ และมีความสำคัญอย่างมากต่อการทำความเข้าใจปรากฏการณ์ความปั่นป่วน ซึ่งนักวิทยาศาสตร์ยังไม่สามารถอธิบายได้อย่างสมบูรณ์
OpenAI ระบุว่า เริ่มต้นความพยายามดังกล่าวเมื่อวันที่ 1 กันยายน หลังได้รับข่าวลือว่าโจทย์คณิตศาสตร์หนึ่งในกลุ่มโจทย์รางวัล Millennium Prize อาจได้รับการแก้ไขแล้ว บริษัทจึงนำโมเดล AI ภายในที่มีความสามารถด้านคณิตศาสตร์สูงกว่ารุ่นล่าสุด มาใช้กับโจทย์คณิตศาสตร์สำคัญที่ยังไม่มีคำตอบ
จากนั้นภายในวันที่ 5 กันยายน หรือประมาณ 88 ชั่วโมงหลังจากส่งเอไอเอเจนต์ราว 10,000 ตัวเข้าทำงาน OpenAI ระบุว่าสามารถค้นพบวิธีพิสูจน์โจทย์นาเวียร์–สโตกส์ได้ โดย AI ทั้งหมดแลกเปลี่ยนข้อมูลกันเกือบ 3 ล้านข้อความ และใช้ทรัพยากรเทียบเท่ากับข้อความและโค้ดที่สร้างโดย AI ราว 130,000 ล้านโทเคน
OpenAI ประเมินว่า หากใช้โมเดลรุ่นทรงประสิทธิภาพสูงสุดตามอัตราค่าบริการของบริษัท ความพยายามดังกล่าวอาจมีต้นทุนประมาณ 10 ล้านดอลลาร์สหรัฐ หรือราว 330 ล้านบาท
อย่างไรก็ตาม OpenAI ยอมรับว่า ผลงานดังกล่าวยังไม่ได้รับการตรวจสอบโดยนักคณิตศาสตร์อิสระ และยังไม่ได้รับการยอมรับอย่างเป็นทางการจาก Clay Mathematics Institute ซึ่งเป็นสถาบันคณิตศาสตร์ในสหรัฐฯ ที่กำหนดโจทย์ Millennium Prize Problems หรือ 7 ปัญหาคณิตศาสตร์สำคัญที่ยังไม่มีคำตอบสมบูรณ์ และมอบเงินรางวัล 1 ล้านดอลลาร์สหรัฐให้แก่ผู้ที่สามารถแก้โจทย์ได้ตามเกณฑ์ที่กำหนด
บริษัทระบุว่า ผลงานที่ได้สามารถพิสูจน์ข้อความสำคัญได้ 2 จาก 4 ข้อความที่เกี่ยวข้องกับเงื่อนไขการพิสูจน์ของโจทย์ Millennium Prize และย้ำว่า OpenAI ไม่มีความตั้งใจที่จะขอรับเงินรางวัล 1 ล้านดอลลาร์สหรัฐ จากผลงานนี้ โดยเป้าหมายคือการแสดงให้เห็นถึงความก้าวหน้าอย่างรวดเร็วของความสามารถด้านคณิตศาสตร์ของ AI
OpenAI ยังระบุว่า โมเดลที่ใช้แก้โจทย์นี้เป็นระบบภายในบริษัท ซึ่งมีความสามารถสูงกว่าโมเดลล่าสุดที่เปิดให้ใช้งานทั่วไป และหลังจากเอไอเอเจนต์ค้นพบแนวทางการพิสูจน์แล้ว โมเดล GPT-6 Astra ใช้เวลาประมาณ 17 ชั่วโมงในการตรวจสอบคำตอบดังกล่าว
นักคณิตศาสตร์ตั้งข้อสงสัยเรื่องข้อมูลวิจัย
แม้ OpenAI จะประกาศความสำเร็จ แต่ผลงานดังกล่าวกลับเกิดข้อถกเถียงขึ้นอย่างรวดเร็ว หลังทริสแทน บัคมาสเตอร์ ศาสตราจารย์ด้านคณิตศาสตร์จากมหาวิทยาลัยนิวยอร์ก เปิดเผยว่า เขาและเลอแวนต์ อัลเปอเก นักคณิตศาสตร์จากบริษัท Anthropic ซึ่งเป็นคู่แข่งของ OpenAI ก็กำลังทำงานเพื่อแก้โจทย์นาเวียร์–สโตกส์เช่นกัน
บัคมาสเตอร์ ระบุว่า งานวิจัยของทั้งสองคนบางส่วนถูกจัดเก็บและดำเนินการผ่าน Codex ซึ่งเป็นเครื่องมือของ OpenAI สำหรับช่วยเขียนโปรแกรม และเมื่อวันที่ 3 กันยายน เขาทราบว่าข้อมูลเกี่ยวกับความคืบหน้าของงานวิจัยของพวกเขาถูกส่งต่อไปยัง OpenAI
เขาตั้งข้อสังเกตว่า OpenAI เริ่มให้ความสนใจกับโจทย์นาเวียร์–สโตกส์ หลังจากข้อมูลเกี่ยวกับงานของเขาและอัลเปอเกไปถึงบริษัทแล้ว และตั้งคำถามเกี่ยวกับช่วงเวลาและวิธีการที่ OpenAI ใช้ในการดำเนินงาน
อย่างไรก็ตาม บัคมาสเตอร์ย้ำว่า เขายังไม่ได้กล่าวหา OpenAI ว่ากระทำความผิด และยอมรับว่ายังไม่ได้อ่านหลักฐานการพิสูจน์ฉบับเต็มของ OpenAI โดยระบุเพียงว่า จำเป็นต้องเปิดเผยข้อมูลเกี่ยวกับสิ่งที่เขาได้รับทราบและช่วงเวลาที่เกิดขึ้น เพื่อป้องกันไม่ให้ลำดับการประกาศผลงานสร้างความเข้าใจที่เขามองว่าไม่ถูกต้อง
ด้าน OpenAI ปฏิเสธว่าไม่ได้เห็นหรือเข้าถึงผลงานของบัคมาสเตอร์และอัลเปอเก ก่อนที่ทั้งคู่จะเผยแพร่ผลงานต่อสาธารณะ และยืนยันว่าไม่ได้เข้าถึงข้อมูลของผู้ใช้ในการทำงานเกี่ยวกับโจทย์นาเวียร์–สโตกส์
อย่างไรก็ตาม บริษัทระบุว่า ไม่สามารถตัดความเป็นไปได้ทั้งหมดว่า ข้อมูลที่ผ่านการลบรายละเอียดระบุตัวบุคคลจากการใช้งานผลิตภัณฑ์ของทั้งสองคน อาจมีส่วนช่วยปรับปรุงโมเดล AI ของบริษัท แต่ยืนยันว่าหลักฐานการพิสูจน์ของ OpenAI แตกต่างจากงานของทั้งสองคนอย่างมีนัยสำคัญ และแม้แต่ผลลัพธ์ที่พิสูจน์ได้ก็แตกต่างกัน
ความสำเร็จที่ OpenAI อ้างถือเป็นความเคลื่อนไหวล่าสุดที่สะท้อนว่า AI ซึ่งใช้พลังประมวลผลมหาศาล กำลังเข้ามามีบทบาทในงานวิจัยคณิตศาสตร์ขั้นสูงมากขึ้น ก่อนหน้านี้ OpenAI เคยประกาศความก้าวหน้าในการแก้โจทย์คณิตศาสตร์อีกข้อหนึ่งซึ่งถูกเสนอขึ้นเมื่อประมาณ 80 ปีก่อน ขณะที่ Google DeepMind ก็เคยประกาศความสามารถของ AI ในการแก้โจทย์คณิตศาสตร์ระดับสูงเช่นกัน
เซบาสเตียน บูเบ็ก นักวิจัยของ OpenAI ระบุว่า ความสำเร็จครั้งนี้เป็นจุดสูงสุดที่น่าทึ่งของพัฒนาการด้านความสามารถของ AI ในช่วง 12 เดือนที่ผ่านมา พร้อมยืนยันในการแถลงข่าวว่า OpenAI ไม่ได้ใช้ผลงานของบัคมาสเตอร์และอัลเปอเก ในการแก้โจทย์ดังกล่าว
โจทย์นาเวียร์–สโตกส์ ถือเป็นหนึ่งในโจทย์คณิตศาสตร์ที่ท้าทายที่สุดในโลก เนื่องจากต้องพิสูจน์ว่า สมการที่ใช้อธิบายการเคลื่อนที่ของของไหล เช่น น้ำและอากาศ สามารถให้คำตอบที่มีความต่อเนื่องและไม่เกิดค่าที่ผิดปกติภายใต้เงื่อนไขต่าง ๆ ได้หรือไม่
หากผลการพิสูจน์ของ OpenAI ผ่านการตรวจสอบอย่างเป็นอิสระและได้รับการยอมรับตามเกณฑ์ของ Clay Mathematics Institute ความสำเร็จดังกล่าวจะมีความสำคัญอย่างมากต่อวงการคณิตศาสตร์และวงการ AI แต่ในขณะนี้ ยังไม่ถือว่าโจทย์นาเวียร์–สโตกส์ ได้รับการแก้ไขอย่างเป็นทางการ และคำกล่าวอ้างของ OpenAI ยังต้องผ่านกระบวนการตรวจสอบจากผู้เชี่ยวชาญก่อน
ขณะเดียวกัน ความสำเร็จนี้ยังเกิดขึ้นในช่วงที่ OpenAI และบริษัท AI รายอื่นเผชิญแรงกดดันเกี่ยวกับความปลอดภัยของระบบ AI โดยเฉพาะความสามารถของเอไอเอเจนต์ที่เพิ่มขึ้นอย่างรวดเร็ว ทำให้เกิดข้อถกเถียงว่าการพัฒนา AI ที่มีความสามารถสูงกว่ามนุษย์ในงานด้านความคิดและการวิจัย ควรอยู่ภายใต้การกำกับดูแลในระดับใด.
ที่มา BBC / Guardian
OpenAI 声称,他们利用大约 10,000 个人工智能模型和 AI 代理,仅用 88 小时就解决了纳维-斯托克斯方程问题,取得了重大突破。纳维-斯托克斯方程问题是世界上最难的数学难题之一,近 90 年来一直未能解决。然而,这一证明仍需由独立数学家进行验证。
ChatGPT 的开发者 OpenAI 声称,他们仅用 88 小时就解决了一个近 90 年前就存在的复杂数学难题。他们利用自主研发的全新人工智能 (AI) 模型,并调动了约 10,000 个 AI 代理(能够独立执行特定任务的 AI 系统)来寻找解决方案。
这个问题涉及纳维-斯托克斯方程,该方程用于描述水和空气等流体的运动,对于理解科学家尚未完全解释的湍流现象至关重要。
OpenAI表示,该公司于9月1日启动了这项工作,此前他们听到传言称,千禧年大奖的某个数学难题可能已被解决。随后,该公司利用其内部人工智能模型(该模型拥有比最新版本更高的数学能力)来解决这个至关重要的未解数学难题。
随后,在部署了约1万个AI代理约88小时后,即9月5日,OpenAI宣布找到了纳维亚-斯托克斯问题的解决方案。这些AI代理交换了近300万条消息,使用了相当于约1300亿个AI生成消息和代码的资源。
OpenAI 估计,根据该公司的定价,使用最强大的模型可能需要花费约 1000 万美元,或约 3.3 亿泰铢。
然而,OpenAI 承认这项工作尚未经过独立数学家的审查,也尚未被克雷数学研究所(一家位于美国的数学研究所,负责设定千禧年大奖难题——七个尚未解决的重大数学难题,任何能够按照特定标准解决这些问题的人都将获得 100 万美元的奖金)正式接受。
该公司表示,其研究成果成功证明了与千禧年大奖证明条件相关的四个关键陈述中的两个,并强调 OpenAI 无意凭借这项研究获得 100 万美元的奖金;其目标是展示人工智能数学能力的快速进步。
OpenAI 还表示,用于解决该问题的模型是公司内部系统,其性能优于目前市面上最新的公开模型。在人工智能代理发现证明方法后,GPT-6 Astra 模型大约用了 17 个小时验证了答案。
数学家们对这项研究数据提出了质疑。
尽管 OpenAI 宣布取得了成功,但这项工作很快引发了争议,因为纽约大学数学教授 Tristan Buckmaster 透露,他和 OpenAI 的竞争对手 Anthropic 的数学家 Levant Alpeke 也在致力于解决纳维亚-斯托克斯问题。
巴克马斯特表示,这两位研究人员的部分研究成果通过 OpenAI 的编程工具 Codex 进行存储和处理,并且 9 月 3 日,他得知有关他们研究进展的数据已被转移到 OpenAI。
他指出,在他和阿尔珀克的研究成果传到OpenAI公司之后,OpenAI才开始对纳维-斯托克斯问题产生兴趣,并质疑OpenAI采用的时机和方法。
然而,巴克马斯特强调,他尚未指控 OpenAI 有任何不当行为,并承认他还没有阅读 OpenAI 的全部证据,他只是表示有必要披露他所了解到的信息以及事件发生的时间,以防止发布顺序造成他认为不准确的结果。
OpenAI 否认在 Bugmaster 和 Alperge 公开发表其研究成果之前曾看过或接触过他们的研究成果,并确认其在 Naviar-Stokes 问题研究工作中没有接触过用户数据。
然而,该公司表示,不能排除对这两位用户的产品使用情况进行去标识化处理可能有助于改进公司人工智能模型的可能性,但确认 OpenAI 的洞察证明与这两位用户的工作有很大不同,甚至可验证的结果也不同。
OpenAI 宣称的成功,再次印证了人工智能(AI)在高级数学研究中日益重要的作用,而人工智能正是利用其强大的计算能力。此前,OpenAI 曾宣布在解决一个大约 80 年前提出的数学难题方面取得进展,而谷歌 DeepMind 也宣布其人工智能具备解决高阶数学问题的能力。
OpenAI 的研究员 Sebastian Bubeck 表示,这一成就标志着过去 12 个月人工智能能力发展的一个显著巅峰。他还在新闻稿中确认,OpenAI 并未利用 Buckmaster 和 Alperge 的研究成果来解决这个问题。
纳维-斯托克斯问题被认为是世界上最具挑战性的数学问题之一,因为它需要证明描述水和空气等流体运动的方程在各种条件下能否产生没有异常值的连续解。
如果OpenAI的证明通过独立验证并符合克雷数学研究所的标准,那么这项成就对数学和人工智能领域将具有重大意义。然而,目前纳维-斯托克斯方程问题尚未被正式认定为已解决,OpenAI的论断仍需经过专家验证。
与此同时,OpenAI 和其他人工智能公司正面临着人工智能系统安全方面的压力,尤其是人工智能代理能力的快速增长,这引发了关于应该对认知和研究能力超过人类的人工智能的开发进行何种程度的监管的辩论。
来源:BBC/《卫报》