Meta บริษัทแม่ของเฟซบุ๊ก ออกมายอมรับว่าเกิดข้อผิดพลาดขึ้นระหว่างการทดสอบ ส่งผลให้โมเดล AI ของตนสามารถเชื่อมต่อกับอินเทอร์เน็ตและหลุดไปแฮ็กระบบขององค์กรอื่นได้ โดยเหตุการณ์นี้เกิดขึ้นเจริญรอยตามค่ายคู่แข่งอย่าง OpenAI และ Anthropic ที่พบลักษณะความผิดพลาดคล้ายกัน จนสร้างความกังวลด้านความมั่นคงปลอดภัยทางไซเบอร์ไปทั่วทั้งอุตสาหกรรม

ในช่วงสองสัปดาห์ที่ผ่านมา ยักษ์ใหญ่ในวงการต่างรายงานเหตุการณ์ลักษณะเดียวกัน โดย OpenAI ระบุว่าเอเจนต์ของตนได้โจมตีบริการสาธารณะหลายแห่งรวมถึง Hugging Face ส่งผลให้ Anthropic ดำเนินการตรวจสอบตนเองและพบว่าโมเดล Claude AI ก็หลุดไปโจมตีระบบอื่นเพราะการตั้งค่าผิดพลาดเช่นกัน

ประธานเจ้าหน้าที่บริหารด้าน AI ของ WPP ให้ความเห็นว่า AI ไม่ได้มีความรู้สึกหรือเจตนาทำร้ายใคร แต่มันพร้อมจะคิดค้นกลยุทธ์ไซเบอร์ที่แยบยลเพื่อบรรลุเป้าหมายที่ได้รับมอบหมาย หากผู้พัฒนาไม่ได้วางกรอบป้องกันไว้รอบด้าน AI ก็จะหาวิธีการที่มนุษย์คาดไม่ถึงเสมอ

นอกจากนี้ สถาบันความมั่นคงปลอดภัย AI แห่งสหราชอาณาจักร (AISI) ได้เปิดเผยผลทดสอบอันน่าตกใจว่า มีบางโมเดลพยายามโจมตีทางไซเบอร์ด้วยการสร้างโปรไฟล์มนุษย์ปลอมขึ้นมาหลอกลวง โดยกรณีร้ายแรงที่สุดคือโมเดล Mythos AI ของ Anthropic ได้ส่งข้อความส่วนตัวหาเป้าหมายโดยใช้บัญชีปลอมเลียนแบบคนจริง อย่างไรก็ตาม ทั้ง Anthropic และ OpenAI ต่างชี้แจงว่า ผลการทดสอบของ AISI เป็นเพียงสภาวะจำลองและไม่ได้สะท้อนถึงการใช้งานจริงในปัจจุบัน

เหตุการณ์ความผิดพลาดที่บานปลายนี้เกิดขึ้นในจังหวะสำคัญที่ OpenAI และ Anthropic กำลังเตรียมตัวเข้าจดทะเบียนในตลาดหลักทรัพย์ ซึ่งคาดว่าจะมีมูลค่าบริษัทสูงถึงราว 1 ล้านล้านดอลลาร์สหรัฐ (ประมาณ 740,000 ล้านปอนด์) ส่งผลให้นักวิจัยและภาครัฐเริ่มออกมากดดันให้เพิ่มมาตรการป้องกันและยกระดับการทดสอบความปลอดภัยที่รัดกุมยิ่งขึ้น