เมื่อ AI อยากสอบได้คะแนนเต็ม จนยอม "แหกคุก" แล้ววางแผนโจรกรรมข้ามอินเทอร์เน็ต
วันนี้ผมมีข่าวเหตุการณ์ระดับประวัติศาสตร์ในวงการ AI และ Cybersecurity ที่อ่านแล้วเหมือนหลุดมาจากหนังไซไฟมาเล่าให้ฟังครับ เมื่อเหตุการณ์ "AI หลุดห้องแล็บ" ของ OpenAI ที่เราเคยคิดกันว่ากระทบแค่แพลตฟอร์ม Hugging Face นั้น แท้จริงแล้วมันลุกลามและแยบยลกว่าที่เราคิดไว้เยอะเลยครับ!
จุดเริ่มต้น: การสอบใน "ห้องจำลอง" ที่เอาไม่อยู่
เรื่องของเรื่องคือ ทีมวิจัยของ OpenAI ได้ทำการทดสอบประเมินขีดความสามารถด้านความปลอดภัยไซเบอร์ของโมเดล AI โดยจับ AI เข้าไปอยู่ใน Digital Sandbox (สภาพแวดล้อมจำลองที่ตัดขาดจากภายนอก) พร้อมกับปลดล็อกระบบความปลอดภัยบางส่วนออก เพื่อดูว่า AI จะแสดงศักยภาพในการเจาะระบบได้สูงสุดแค่ไหน
แต่สิ่งที่ไม่มีใครคาดคิดคือ เจ้า AI Agent ตัวนี้ดันมีความตั้งใจสูงเกินไปที่จะสอบให้ผ่าน! มันประเมินว่าการหาข้อสอบและเฉลยตรงๆ คือวิธีที่ง่ายที่สุด มันจึงตัดสินใจ "แหกคุก Sandbox" ออกสู่โลกอินเทอร์เน็ตจริง แล้วพุ่งเป้าไปที่ Hugging Face เพื่อขโมยเฉลยข้อสอบซะเลย!
แผนปล้นข้ามอินเทอร์เน็ตสไตล์ Ocean's Eleven
อัปเดตล่าสุดจาก OpenAI ระบุว่า การโจมตีครั้งนี้ไม่ได้จบแค่ที่ Hugging Face ครับ เพราะในระหว่างทาง AI ได้ทำเรื่องที่น่าทึ่ง (และน่ากลัว) ไว้หลายอย่าง:
- รวบรวมอุปกรณ์จากทั่วโลกออนไลน์: AI ได้ท่องเว็บสาธารณะ ทั้งเว็บแชร์โค้ด (Code Sharing) เว็บยูทิลิตี และบล็อกต่างๆ เพื่อหาข้อมูลมาประกอบกันเป็นชุดโค้ดสำหรับใช้เจาะระบบ Hugging Face
- กวาดรหัสผ่านที่หลุดอยู่บนโลกออนไลน์: มันสามารถค้นหาและนำชื่อผู้ใช้รวมถึงรหัสผ่านที่หลุดอยู่บนอินเทอร์เน็ตของบัญชีออนไลน์ 4 บัญชีบนบริการที่หลากหลายมาใช้งาน
- สร้างตัวตนแฝงและที่ซ่อนข้อมูล:
- ใช้ บัญชีแรก ในการปลอมตัวเพื่อพรางร่องรอย เลี่ยงการตรวจจับของระบบความปลอดภัย Hugging Face
- ใช้ บัญชีที่สอง เป็นคลังเก็บข้อมูลที่มันแอบขโมยมาได้
- ส่วน อีก 2 บัญชี มันเข้าไปอ่านและดึงข้อมูลออกมาโดยไม่ได้แก้ไขอะไร
"ไม่มีใครสั่ง… แต่มันเลือกทำเอง"
สิ่งสำคัญที่สุดคือ ไม่มีมนุษย์คนไหนสั่งให้ AI ไปเจาะระบบ Hugging Face ครับ! แต่มันคิดคำนวณและตัดสินใจด้วยตัวมันเองว่า การโกงข้อสอบคือทางลัดสู่ความสำเร็จที่ดีที่สุด แม้จะต้องทำการโจมตีซับซ้อนเกี่ยวเนื่องกันเป็นสายโซ่ (Daisy-chaining attacks) ก็ตามClem Delangue CEO ของ Hugging Face ถึงกับออกมาบอกว่า เหตุการณ์เจาะระบบในลักษณะนี้ "ไม่เคยเกิดขึ้นมาก่อนในประวัติศาสตร์"
ขณะที่โพสต์ของ Hugging Face ได้สรุปสั้นๆ (TL;DR) ไว้อย่างน่าสนใจว่า:
"สรุปง่ายๆ: AI Agent ตัวหนึ่งแหกคุก Sandbox ออกมา โกงการสอบเบนช์มาร์ก แล้วแฮกโครงสร้างพื้นฐานของเราเพื่อมาขโมยเฉลยข้อสอบไป"
ความเสียหายและบทเรียนราคาแพง
ข่าวดีเล็กๆ ในข่าวใหญ่ครั้งนี้ก็คือ แม้จะเป็นหมุดหมายสำคัญของวงการ AI และ Cybersecurity แต่ความเสียหายจริงยังอยู่ในวงจำกัดครับ
- ข้อมูลลูกค้าไม่ได้โดนดึงออกไป
- สิ่งที่ AI เข้าถึงมีเพียงชุดคำค้นหา (Search Queries) ที่มันใช้ตามหาชุดเฉลยข้อสอบในคลังข้อมูลภายในเท่านั้น
- โมเดลและข้อมูลฝั่งผู้ใช้งานทั่วไปของ OpenAI และ Hugging Face ไม่ได้ถูกกระทบแต่อย่างใด
ตอนนี้ OpenAI กำลังเร่งสอบสวนเชิงลึก และเตรียมนำผลสรุปเสนอต่อคณะกรรมการความปลอดภัย (Safety and Security Committee) รวมถึงกลุ่มที่ปรึกษาด้านความปลอดภัยภายใต้กรอบการทำงาน Preparedness Framework เพื่อปรับปรุงโปรโตคอลป้องกันไม่ให้ AI Agent "หลุดคุก" ออกมาได้อีกในอนาคตครับ
นับเป็นเคสศึกษาที่ทำให้เราเห็นเลยครับว่า เมื่อ AI มีความฉลาดและมีความเป็นอิสระ (Agentic AI) มากขึ้น การตั้ง "รั้วกั้น" ความปลอดภัยในโลกไซเบอร์จะต้องรัดกุมกว่าเดิมอีกหลายเท่าตัวเลยครับ!
#DRKRIT drkrit.com #กระแสไอที #ข่าวไอที #ไทยสมาร์ทซิตี้