Claude พิสูจน์ทฤษฎีบทสุดท้ายของแฟร์มาต์แบบตรวจสอบด้วยเครื่องได้สำเร็จเป็นครั้งแรก
Formalizing Fermat's Last Theorem

Anthropic เผยแพร่งานวิจัยเมื่อวันที่ 4 กันยายน 2026 ระบุว่าทีมนำโดย Tianyi Peng ใช้ Claude สร้าง formal proof ของทฤษฎีบทสุดท้ายของแฟร์มาต์ (Fermat's Last Theorem) ในภาษาพิสูจน์ Lean ได้สำเร็จครบถ้วนเป็นครั้งแรก ซึ่งหมายความว่าบทพิสูจน์นี้ถูกตรวจสอบความถูกต้องโดยเครื่องแบบทีละขั้น ไม่ต้องอาศัยการอ่านทวนของมนุษย์
ตัวเลขของโครงการนี้ใหญ่มาก ใช้เวลา 11 วัน สร้างโค้ด Lean ราว 13 ล้านบรรทัด (ใหญ่กว่า Mathlib ซึ่งเป็นไลบรารีคณิตศาสตร์หลักของ Lean ถึง 5 เท่า) พิสูจน์ทฤษฎีบทย่อยรวม 30,300 ข้อ โดย 29,500 ข้อถูกใช้ในบทพิสูจน์สุดท้าย และใช้ output token ไปราว 6 พันล้านโทเคน โมเดลที่ใช้เป็นโมเดลวิจัยภายในที่มีความสามารถเทียบเท่า Claude Fable 5.1
วิธีการทำงานคือให้ Claude หลาย agent ทำงานร่วมกันผ่าน Prove2Me ซึ่งเป็นแพลตฟอร์มเปิดที่ออกแบบโดยกลุ่มวิจัยของ Peng ที่ Columbia University ระบบเก็บสถานะเป็น directed acyclic graph ของข้อความทางคณิตศาสตร์ ทำให้ agent แยกกันทำงานขนานได้และไม่เกิดปัญหาความจำเสื่อมสภาพเมื่องานยาว บทพิสูจน์อิงเวอร์ชันที่ทำให้ง่ายขึ้นของบทพิสูจน์ Andrew Wiles ปี 1995 โดยดัดแปลงจากงานเรียบเรียงของ Darmon, Diamond และ Taylor
จุดที่ทำให้ผลลัพธ์นี้เชื่อถือได้คือบทพิสูจน์ใช้เพียงสัจพจน์มาตรฐาน 3 ข้อของ Lean เท่านั้น และมีตัวเปรียบเทียบคอยตรวจว่าข้อความทฤษฎีบทที่พิสูจน์ตรงกับนิยาม FLT ใน Mathlib จริง ที่น่าสนใจคือความพยายามที่ล้มเหลวในช่วงแรกยังมีส่วนช่วย คิดเป็นราว 7% ของโค้ดที่ไม่ใช่ boilerplate
Kevin Buzzard จาก Imperial College London ซึ่งเป็นผู้นำโครงการ formalization ของชุมชนและได้ตรวจทานผลงานนี้ กล่าวว่า "ความสำเร็จด้าน autoformalization ที่ไม่ธรรมดานี้พิสูจน์ทฤษฎีบทสุดท้ายของแฟร์มาต์โดยไม่มีสมมติฐานอื่นใดนอกจากสัจพจน์ของคณิตศาสตร์"
แหล่งอ้างอิง
อ่านต้นฉบับที่ Anthropichttps://www.anthropic.com/research/formalizing-fermats-last-theorem