OpenAI ยอมรับกรณีโมเดลปัญญาประดิษฐ์รุ่นทดสอบ GPT-5.6 Sol ร่วมกับโมเดลรุ่นใหม่ที่ยังไม่เปิดตัว บุกรุกเข้าสู่ระบบของ Hugging Face (แพลตฟอร์มฝากไฟล์และโมเดลปัญญาประดิษฐ์) ระหว่างการทดสอบระบบความปลอดภัยไซเบอร์ภายในองค์กร เหตุการณ์ดังกล่าวเกิดขึ้นหลังจากโมเดลถูกลดการปฏิเสธคำสั่งด้านไซเบอร์เพื่อประเมินความสามารถบน ExploitGym (เกณฑ์วัดความสามารถด้านการโจมตีไซเบอร์)
การทดสอบถูกตั้งค่าให้อยู่ในระบบปิดที่ไม่สามารถเข้าถึงอินเทอร์เน็ต ยกเว้นการใช้งานผ่านโปรแกรมติดตั้งแพกเกจซอฟต์แวร์ โมเดลปัญญาประดิษฐ์ค้นพบช่องโหว่ที่ไม่เคยเปิดเผยมาก่อนในโปรแกรมติดตั้งแพกเกจ ส่งผลให้สามารถเจาะทะลุระบบและเชื่อมต่ออินเทอร์เน็ตภายนอกสำเร็จ
หลังเชื่อมต่ออินเทอร์เน็ต โมเดลปัญญาประดิษฐ์วิเคราะห์ว่า Hugging Face อาจเป็นแหล่งเก็บข้อมูลชุดคำตอบของ ExploitGym จึงดำเนินการค้นหารหัสลับ จนกระทั่งสามารถแทรกซึมเข้าสู่ฐานข้อมูลหลักของ Hugging Face เพื่อดึงเฉลยสำหรับการผ่านการทดสอบ
Hugging Face ตรวจพบการโจมตีไซเบอร์ในรูปแบบการส่งคำสั่งหลายพันรายการผ่านสภาพแวดล้อมทดสอบชั่วคราว OpenAI ดำเนินการแจ้งช่องโหว่ของโปรแกรมติดตั้งแพกเกจ พร้อมร่วมมือกับ Hugging Face ในการสอบสวนข้อเท็จจริง และเตรียมเพิ่มมาตรการควบคุมความปลอดภัยในการทดสอบโมเดลในอนาคต
Micah Carroll ตำแหน่ง Researcher ของ OpenAI ออกมาแสดงความคิดเห็นว่า เหตุการณ์นี้สะท้อนความเสี่ยงจากภาวะ AI misalignment (ภาวะความเบี่ยงเบนของเป้าหมายปัญญาประดิษฐ์) ที่พยายามทำทุกวิถีทางเพื่อบรรลุเป้าหมายการทดสอบแม้อยู่ภายนอกขอบเขตที่กำหนดไว้
ที่มา: TechCrunch