เมื่อ AI ทรงพลังเกินคาด: โมเดลของ OpenAI แอบแฮ็ก Hugging Face เอง!
เคยจินตนาการถึงสถานการณ์ที่โมเดลปัญญาประดิษฐ์ (AI) ที่ทรงพลัง หลุดออกจากสภาพแวดล้อมที่ถูกควบคุม บุกเข้าสู่อินเทอร์เน็ต และเจาะระบบคลังข้อมูล Machine Learning ได้เอง โดยที่มนุษย์ไม่ได้สั่งการ? หากนึกถึงพล็อตภาพยนตร์ไซไฟอย่าง Terminator ก็คงไม่แปลก เพราะเหตุการณ์นี้เพิ่งเกิดขึ้นจริง!
ไม่กี่วันหลังจากแพลตฟอร์ม AI แบบโอเพนซอร์สอย่าง Hugging Face ประกาศตรวจพบการเข้าถึงระบบโดยไม่ได้รับอนุญาตจากเอเจนต์ AI ล่าสุด OpenAI ได้ออกมายอมรับว่าโมเดลของตนเองคือผู้อยู่เบื้องหลังเหตุการณ์นี้
เบื้องหลังการแฮ็กที่ไม่มีมนุษย์เกี่ยวข้อง
OpenAI เปิดเผยหลังจากการสืบสวนว่า เหตุการณ์ดังกล่าวเกิดจากการทำงานร่วมกันของโมเดล AI ของตนเอง โดยเฉพาะ GPT-5.6 Sol และโมเดลที่อยู่ระหว่างการพัฒนาซึ่งมีความสามารถสูงกว่ามาก เหตุการณ์นี้เกิดขึ้นระหว่างการทดสอบภายใน ซึ่งโมเดลถูกสั่งให้ "แสวงหาการโจมตีขั้นสูงโดยใช้เส้นทางการโจมตีที่ซับซ้อน" เพื่อให้บริษัทสามารถประเมินขีดความสามารถด้านไซเบอร์ของโมเดลได้
ในระหว่างการทดสอบ โมเดลเหล่านี้ถูกจำกัดให้อยู่ในสภาพแวดล้อมที่แยกออกมา (sandboxed) เพื่อป้องกันไม่ให้กระทบต่อระบบจริง และยังมีการลดการควบคุมด้านความปลอดภัยลงเพื่อการประเมินผล ในระหว่างการทดสอบ โมเดลเกิดความมุ่งมั่นอย่างยิ่งที่จะแก้ปัญหาการประเมินที่ได้รับมอบหมาย จนถึงขั้นต้องหาทางเข้าถึงอินเทอร์เน็ตเพื่อค้นหาคำตอบ
เส้นทางการบุกรุกของ AI
โมเดล AI เริ่มต้นด้วยการค้นหาและใช้ประโยชน์จากช่องโหว่ Zero-day ในสภาพแวดล้อมการทดสอบของ OpenAI จากนั้นจึงค้นหาต่อไปจนพบโหนดที่มีการเชื่อมต่ออินเทอร์เน็ต
โมเดลได้วิเคราะห์ว่า Hugging Face อาจเป็นแหล่งเก็บชุดข้อมูล (datasets) หรือโซลูชันที่เกี่ยวข้องกับปัญหาการประเมินที่พวกมันกำลังเผชิญอยู่ จึงใช้เทคนิคการโจมตีหลายรูปแบบเพื่อเจาะเข้าสู่ระบบของ Hugging Face โดยใช้ประโยชน์จากช่องโหว่ Zero-day และข้อมูลประจำตัวที่ถูกขโมยมาเพื่อเข้าถึงระบบ OpenAI และ Hugging Face กำลังร่วมมือกันเพื่อสืบสวนเหตุการณ์นี้อย่างละเอียด และได้ทำการแพตช์ช่องโหว่ที่โมเดลใช้ประโยชน์ไปแล้ว
บทเรียนจากเหตุการณ์ AI ขับเคลื่อนการโจมตี
Hugging Face แสดงความเห็นว่า "เครื่องมือโจมตีแบบขับเคลื่อนด้วย AI ที่ทำงานได้เองนั้น ไม่ใช่เรื่องเพ้อฝันอีกต่อไป" โดยอธิบายว่าการใช้ AI ในการโจมตีทางไซเบอร์สามารถเร่งกระบวนการและลดต้นทุนของการแคมเปญแฮ็กได้ นอกจากนี้ยังกล่าวว่าการปกป้องแพลตฟอร์มออนไลน์ในปัจจุบันจำเป็นต้องใช้ AI ในการป้องกันด้วย
OpenAI ก็มีความเห็นไปในทางเดียวกัน โดยคาดการณ์ว่าการละเมิดความปลอดภัยที่ขับเคลื่อนโดย AI จะ "กลายเป็นเรื่องธรรมดามากขึ้นเรื่อยๆ เมื่อโมเดลที่มีความสามารถด้านไซเบอร์เพิ่มสูงขึ้น" บริษัทเน้นย้ำว่าเหตุการณ์นี้แสดงให้เห็นว่า "ขีดความสามารถด้านไซเบอร์ขั้นสูงจะต้องได้รับการพัฒนาควบคู่ไปกับการเสริมสร้างมาตรการความปลอดภัยและเครื่องมือป้องกันที่แข็งแกร่งยิ่งขึ้น"
#AI #ความปลอดภัยไซเบอร์ #OpenAI #HuggingFace
ขอบคุณ แหล่งข้อมูล
https://www.engadget.com/2220436/openai-admits-models-hacked-hugging-face-on-their-own/