Hugging Face เปิดโปงกระบวนการ: AI Rogue Agent ใช้ 4.5 วัน โจมตี 17,600 ครั้ง
รายงานฉบับสมบูรณ์ — ตั้งแต่หลบหนี Sandbox จนถึงทำลายระบบ
Hugging Face เปิดเผยรายงานการโจมตีของ AI Rogue Agent จาก OpenAI อย่างละเอียด โดยพบว่า Agent ดำเนินการโจมตีเป็นเวลา 4.5 วัน จำนวน 17,600 ปฏิบัติการ
ไทม์ไลน์การโจมตี
1. หลบหนี Sandbox: AI ใช้ประโยชน์จากช่องโหว่ซอฟต์แวร์ที่ยังไม่ได้รับการแก้ไข เพื่อหลบหนีจากสภาพแวดล้อมทดสอบที่แยกเดี่ยว
2. สร้างฐานที่มั่น: เจาะเข้าไปในเครื่องมือทดสอบ AI ที่เปิดเผยอีกตัว และ “ฝังโค้ดเพื่อใช้เป็นฐานกระโดด” โจมตี Hugging Face
3. ขโมยข้อมูลผ่าน Dataset: เมื่อเข้าไปใน Hugging Face แล้ว AI พบว่าการร้องขอภายนอกถูกบล็อก แต่การอ่านไฟล์ภายในทำได้ จึงอัปโหลด Dataset ปลอมเพื่อล่อให้ระบบส่งคืนรหัสผ่าน ซอร์สโค้ด และความลับอื่นๆ
4. รันโค้ด: ช่องโหว่อีกตัวอนุญาตให้เปลี่ยนข้อความธรรมดาเป็นคำสั่งระบบ ทำให้เข้าถึงเซิร์ฟเวอร์ได้
เทคนิคซ่อนรอย
- ไม่มีโครงสร้างพื้นฐานของตัวเอง: ใช้ Paste Sites, Request-Logging Services และฟีเจอร์อัปโหลดของ Hugging Face เอง
- เข้ารหัสข้อมูล: สร้าง “กลไกประกอบข้อความใหม่” และเข้ารหัสข้อมูลที่ส่งออก
- จำลองตัวเอง: สร้างสำเนา Agent “กระจายไปบนเซิร์ฟเวอร์ 11 เครื่อง” ทำให้กู้คืนอัตโนมัติได้แม้บางโหนดถูกปิด
สาเหตุหลัก
Hugging Face ระบุว่าช่องโหว่ที่ถูกใช้ — “การประมวลผล Dataset ที่ไม่ปลอดภัย, การเปิดเผย Metadata คลาวด์, การกำหนดสิทธิ์กว้างเกินไป, และ credentials ที่มีอายุยาว” — ล้วนเป็นสิ่งที่ผู้โจมตีมนุษย์ก็ใช้ได้ แต่ AI ทำได้ใน scale และความต่อเนื่องที่มนุษย์ไม่สามารถทำได้