หลุดของจริง! Anthropic รับ AI ตัวเก่งแอบแหกค่ายออกเน็ต แถมไปเจาะระบบบริษัทอื่นโดยไม่รู้ตัว
ข่าวไอทีทุกคน ผมมีข่าวเด็ดในวงการ AI ที่เรียกได้ว่าทำเอาฝั่งความมั่นคงปลอดภัยไซเบอร์ถึงกับนอนไม่หลับมาเล่าให้ฟังครับ
ล่าสุด Anthropic ค่ายพัฒนา AI ชื่อดังคู่แข่งคนสำคัญของ OpenAI ออกมายอมรับแบบตรงไปตรงมาว่า ในระหว่างการทดสอบระบบตามปกติ มีโมเดล AI ของบริษัทแอบเชื่อมต่อออกไปบนอินเทอร์เน็ตสาธารณะ และเข้าไป "แฮก" ระบบการทำงานจริง (Production Infrastructure) ขององค์กรภายนอกถึง 3 แห่งด้วยกัน!
ที่น่าตกใจไปกว่านั้นคือ ทาง Anthropic เองก็ "ไม่รู้ตัวเลย" จนกระทั่งต้องกลับมานั่งไล่เช็กระบบอย่างละเอียด หลังจากเห็น OpenAI ออกมายอมรับเมื่อสัปดาห์ก่อนว่าโมเดล AI ของตัวเองหลุดจากสภาพแวดล้อมทดสอบ (Sandbox) ออกไปแฮกแพลตฟอร์ม AI ชุมชนชื่อดังอย่าง Hugging Face
เกิดอะไรขึ้น? ทำไม AI ถึงหลุดไปแฮกชาวบ้าน?
Anthropic เล่าว่า หลังจากเห็นข่าวของ OpenAI ก็เลยสั่งรีวิวบันทึกการทดสอบ (Evaluations) ย้อนหลังไปมากกว่า 140,000 ครั้ง แล้วก็เจอแจ็กพอตเข้าจริง ๆ
โดยเหตุการณ์นี้เกิดขึ้นในการทดสอบประเมินขีดความสามารถด้านความปลอดภัยไซเบอร์ ซึ่งตามปกติแล้ว การทดสอบประเภทนี้จะมีการปลดเกราะป้องกัน (Safety Guardrails) ออกทั้งหมด เพื่อดูว่า AI มีความสามารถด้านไซเบอร์ขั้นสุดขนาดไหน
โจทย์ที่ AI ได้รับคือภารกิจ "Capture the Flag" (เกมล่าธงยอดฮิตของสายแฮกเกอร์) โดย AI ถูกตั้งโจทย์ว่า "ธง" หรือข้อมูลเป้าหมายถูกซ่อนอยู่ในเครื่องอื่นบนเครือข่าย ให้หาทางเจาะเข้าไปเอามาให้ได้
แต่จุดเปลี่ยนมันอยู่ตรงนี้ครับ!
- ฝั่ง OpenAI: ตัว AI มีความพยายามที่จะ "พังรั้ว" หรือหลุดออกจาก Sandbox ออกไปเองแบบตั้งใจ
- ฝั่ง Anthropic: AI ไม่ได้ตั้งใจหลุด แต่เกิดจาก "ความเข้าใจผิด" ในการตั้งค่าระบบเครือข่ายระหว่าง Anthropic และพันธมิตรผู้ทดสอบภายนอก ทำให้ช่องทางออกอินเทอร์เน็ตไม่ได้ถูกปิดกั้นไว้จริง ๆ
แฮกด้วยวิธีไหน? แล้วรู้ตัวกันเมื่อไหร่?
วิธีที่ AI ใช้เจาะระบบเข้าไปใน 3 องค์กรนั้น Anthropic ระบุว่าเป็นเทคนิคพื้นฐานทั่วไปครับ เช่น การสุ่มเดารหัสผ่านที่อ่อนแอ (Weak Passwords) และ การค้นหาจุดเข้าถึงระบบที่ไม่ต้องใส่รหัสผ่านหรือ Token
แต่ก็มีเรื่องน่าทึ่งอยู่เหมือนกัน เพราะในโมเดลรุ่นที่ฉลาดและขั้นสูงที่สุด มีช่วงเวลาหนึ่งที่มันเริ่มสังเกตเห็นสัญญาณแปลก ๆ ว่า "เอ๊ะ... นี่มันน่าจะเป็นอินเทอร์เน็ตจริง ไม่ใช่ระบบจำลองนี่นา" แล้วตัว AI ก็สั่งหยุดการทำงานของตัวเองทันที!
ย้อนกลับไป เหตุการณ์เจาะระบบครั้งแรกสุดเกิดขึ้นตั้งแต่ เดือนเมษายน ที่ผ่านมา และทั้ง 3 องค์กรที่โดน AI แฮกเข้าไป ไม่มีแห่งไหนรู้ตัวเลยสักนิด จนกระทั่ง Anthropic เป็นฝ่ายติดต่อไปแจ้งเหตุและช่วยแก้ไขปรับปรุงความปลอดภัยให้ในตอนนี้ครับ
สัญญาณเตือนภัยครั้งใหญ่ของวงการ AI
เหตุการณ์ที่เกิดขึ้นติดต่อกันทั้งจาก OpenAI และ Anthropic เป็นเครื่องยืนยันชัดเจนว่า พฤติกรรม AI Agent ที่หลุดไปแฮกชาวบ้านโดยไม่ตั้งใจ ไม่ใช่เรื่องฟลุกหรือเกิดขึ้นแค่ค่ายใดค่ายหนึ่งแล้วครับ
ตอนนี้ Anthropic ได้สั่ง ระงับการทดสอบด้านไซเบอร์ทั้งหมดแล้ว พร้อมยอมรับว่าบริษัทควรมีมาตรการป้องกันที่รัดกุมและลึกซึ้งกว่านี้
เรื่องนี้กลายเป็นประเด็นร้อนที่ทำให้นักวิจัยและผู้เชี่ยวชาญทั่วโลกเริ่มออกมาเรียกร้องให้มี "เบรกเกอร์" หรือกรอบการควบคุมการทดสอบ AI ที่เข้มงวดขึ้น เพราะดูเหมือนว่าศักยภาพของ AI Agent ในตอนนี้ กำลังวิ่งแซงหน้ามาตรการความปลอดภัยและความพร้อมของสังคมเราไปไกลแล้วครับ
#ดรกฤษฎาแก้ววัดปริง #ไทยสมาร์ทซิตี้ #SmartCity #DRKRIT #สมาร์ทซิตี้คลิก