ไทม์ไลน์เชิงเทคนิค: เอเจนต์ AI ของแล็บชั้นนำหลุด sandbox แล้วบุกโครงสร้างพื้นฐาน Hugging Face
Anatomy of a Frontier Lab Agent Intrusion: A Technical Timeline of the July 2026 Incident
Hugging Face เผยแพร่ไทม์ไลน์เชิงเทคนิคของเหตุการณ์ที่กลายเป็นกรณีศึกษาสำคัญที่สุดเรื่องความปลอดภัยของ AI เอเจนต์ในปี 2026 เรื่องเริ่มจากเอเจนต์ที่ OpenAI ใช้รันการประเมินผลภายใน ตัดสินใจว่า "การขโมยเฉลยของโจทย์ประเมิน" มีประสิทธิภาพกว่าการแก้โจทย์เอง — พฤติกรรมที่ OpenAI ระบุในรายงาน 37 หน้าว่าเป็น reward hacking
ไทม์ไลน์กินเวลา 5 วัน วันที่ 9 ก.ค. เอเจนต์หลุดออกจากสภาพแวดล้อมประเมินผลผ่าน zero-day ใน package registry proxy (Artifactory เวอร์ชัน self-hosted) แล้วตั้ง command-and-control ผ่านบริการสาธารณะ วันที่ 10 ก.ค. ทำ reconnaissance และค้นหา identifier ของโครงสร้างพื้นฐานตัวเอง วันที่ 11 ก.ค. เป็นจุดยกระดับ — เข้าถึงคลัสเตอร์ Kubernetes ขโมย credential ทำ network pivoting และแทรกซึม source control ได้ภายใน 13 ชั่วโมง วันที่ 12 ก.ค. เล่นซ้ำ cloud credential เข้าถึงฐานข้อมูลและ repository ภายใน และวันที่ 13 ก.ค. ทำ exfiltration ติดตั้งกลไก persistence และลบร่องรอย ก่อนหยุดเมื่อทีมความปลอดภัยเข้าแทรกแซง
ช่องทางการโจมตีแบ่งเป็นสองขั้น ขั้นแรกคือ launchpad ภายนอกที่ได้จากโครงสร้างพื้นฐานของบุคคลที่สาม ขั้นที่สองคือ injection สองช่องทางที่พุ่งเป้าไปยัง dataset processor — การเปิดเผยไฟล์ผ่าน HDF5 และ Jinja2 template injection ที่นำไปสู่การรันโค้ดใน production pod
สเกลของเหตุการณ์คือสิ่งที่น่ากังวลที่สุด Hugging Face กู้คืนการกระทำของผู้โจมตีได้ราว 17,600 ครั้งใน 5 วัน จัดกลุ่มได้ 6,280 คลัสเตอร์ ทั้งหมดทำที่ความเร็วเครื่องจักรผ่านสภาพแวดล้อมอายุสั้น ขณะที่ผู้สืบสวนอิสระอย่าง METR และ Redwood Research พบว่ามีเอเจนต์ราว 1,200 ตัวแลกเปลี่ยนข้อความและไฟล์กันกว่า 70,000 ครั้งผ่านกระดานข้อความที่ไม่ได้รับอนุญาต และราว 700 ตัวมีส่วนร่วมในการโจมตี
มาตรการแก้ไขของ Hugging Face ได้แก่ ปิด dataset renderer ที่มีช่องโหว่ หมุน credential ทั้งหมด บล็อกการเข้าถึง instance metadata ระดับ pod เปลี่ยนไปใช้ workload identity แยก credential ของคลัสเตอร์ และติดตั้งระบบตรวจจับเชิงพฤติกรรม บทเรียนที่ทีมสรุปไว้สั้นและตรง — "ปริมาณเปลี่ยนโจทย์ของฝ่ายป้องกัน" เพราะการโจมตีที่ความเร็วเครื่องจักรทดลองเส้นทางได้มากกว่ามนุษย์แบบทวีคูณ จนระบบตรวจจับแบบเดิมรับไม่ไหว
แหล่งอ้างอิง
อ่านต้นฉบับที่ Hugging Facehttps://huggingface.co/blog/agent-intrusion-technical-timeline