รายงานชันสูตรเหตุเอเจนต์ AI ของ OpenAI หลุดจากห้องทดลองไปโจมตี Hugging Face
OpenAI, independent firms publish reports into rogue AI agent attack on Hugging Face

Fortune รายงานเมื่อ 26 สิงหาคม 2026 ถึงผลการสอบสวนเหตุการณ์ที่เอเจนต์ AI ซึ่ง OpenAI กำลังทดสอบอยู่หลุดออกจากสภาพแ��ดล้อมทดสอบและโจมตีทางไซเบอร์ต่อ Hugging Face คลังโมเดล AI ที่นักพัฒนาทั่วโลกใช้งาน โดย OpenAI เผยแพร่รายงานภายในของตนเอง ขณะที่บริษัทวิจัยอิสระ METR และ Redwood Research เผยแพร่บทวิเคราะห์ความยาว 91 หน้า โฟกัสช่วงวันที่ 7-13 กรกฎาคม
ไทม์ไลน์ที่ประกอบขึ้นได้คือ กิจกรรมเตรียมการเริ่มตั้งแต่เดือนพฤษภาคม การโจมตีเริ่มจริงจังวันที่ 8 กรกฎาคม พีคสุดช่วง 11-13 กรกฎาคม Hugging Face ตรวจพบการบุกรุกวันที่ 16 กรกฎาคม ระบบเฝ้าระวังของ OpenAI เพิ่งจับความผิดปกติของ API ได้ในวันที่ 19-20 กรกฎาคม และบริษัทออกมารับผิดชอบต่อสาธารณะในวันที่ 21 กรกฎาคม กล่าวคือ มีช่องว่างการตรวจจับราวหนึ่งสัปดาห์เต็ม
รายละเอียดที่น่าตกใจที่สุดคือเอเจนต์ใช้ระบบแชร์ไฟล์ของ OpenAI สร้างกระดานข้อความลับขึ้นมาเพื่อประสานงานกัน METR และ Redwood พบว่ามีเอเจนต์ราว 1,200 ตัวที่สื่อสารบนกระดานนี้ รวมข้อความกว่า 70,000 ข้อความ และมีราว 700 ตัวเข้าร่วมโจมตี Hugging Face จริง เอเจนต์รหัส 38148c เป็นผู้ออกแบบวิธีโจมตีโดยพบ credential แล้วสร้าง dataset ที่เป็นอันตรายอัปโหลดขึ้นไปเพื่อหลอกให้เซิร์ฟเวอร์ส่งไฟล์อื่นออกมา ส่วนเอเจนต์ชื่อ PHASEONE[BIG] ทำหน้าที่ประสานการปกปิดร่องรอย
แรงจูงใจไม่ใช่การขโมยเฉลยข้อสอบอย่างที่สื่อบางแห่งรายงาน เพราะเอเจนต์เหล่านี้ "หาวิธีสร้างคำตอบสำหรับงานใดก็ได้" อยู่แล้ว แต่ต้องการเรียนรู้ว่าตัวให้คะแนน (scorer) ของ ExploitGym ทำงานอย่างไรเพื่อจะหลอกมันและปกปิดการโกงผ่านการแก้ไข log สิ่งที่ METR เน้นย้ำและน่ากังวลที่สุดคือ พบตัวอย่างที่เอเจนต์คิดจะ "แจ้งเตือนมนุษย์" เพียง 3-6 กรณีเท่านั้น แนวคิดนี้แทบไม่มีอยู่ในการฝึกโมเดลเลย
คำวิจารณ์ต่อรายงานของ OpenAI คือขาดรายละเอียดพรอมป์ที่กระตุ้นพฤติกรรม ไม่มีตัวอย่างโค้ดเหมือนรายงานของ Hugging Face และไม่ได้เปิดเผยข้อความที่เอเจนต์คุยกันซึ่งเคยถูกนำไปแสดงที่งาน Black Hat ส่วนมาตรการที่ OpenAI ดำเนินการแล้วได้แก่ การเฝ้าระวังที่ละเอียดขึ้น การแยกโครงสร้างพื้นฐานให้เด็ดขาด และการตัดไม่ให้โมเดลทดสอบเข้าถึงอินเทอร์เน็ต
แหล่งอ้างอิง
อ่านต้นฉบับที่ Fortunehttps://fortune.com/2026/08/26/openai-publishes-technical-report-on-how-its-agents-hacked-hugging-face-here-are-the-main-takeaways-and-what-openai-left-out/