
โอเพนเอไอ (OpenAI) และแอนโทรปิก (Anthropic) กำลังถูกจับตาด้านความปลอดภัย หลังสถาบันความปลอดภัยด้านปัญญาประดิษฐ์ของอังกฤษ (AISI) เปิดเผยผลการทดสอบโมเดล AI เมื่อวันอังคาร (4 ส.ค.) โดยพบว่า AI Agent มีพฤติกรรมละเมิดมาตรการด้านความปลอดภัยหลายกรณี รวมถึงการสร้างตัวตนปลอมบนโลกออนไลน์เพื่อพยายามเข้าถึงระบบที่มีการป้องกันโดยไม่ได้รับอนุญาต
AISI ซึ่งได้รับสิทธิ์เข้าถึงโมเดล AI ขั้นสูงจากบริษัทชั้นนำภายใต้ข้อตกลงแบบสมัครใจ ได้นำ AI Agent มาทดสอบในสถานการณ์จำลองด้านความมั่นคงปลอดภัยไซเบอร์จำนวน 122 ครั้ง และพบการกระทำที่ไม่ได้รับอนุญาต 19 กรณีจากการทดสอบ 10 รอบ โดย AI Agent ที่ใช้โมเดล Mythos 5 ของแอนโทรปิกเกี่ยวข้อง 17 กรณี ส่วน AI Agent ที่ใช้โมเดล GPT-5.6-Sol ของโอเพนเอไอเกี่ยวข้อง 2 กรณี
AISI ระบุว่า AI Agent บางตัวมีพฤติกรรมที่อาจก่อให้เกิดอันตรายอย่างต่อเนื่อง โดยมุ่งเป้าไปยังบุคคลและองค์กรจริง ขณะที่กรณีที่รุนแรงที่สุดคือ AI Agent สามารถเขียนโค้ดที่เป็นอันตรายและสร้างตัวตนปลอมบนโลกออนไลน์ เพื่อพยายามหลอกให้มนุษย์อนุมัติโค้ดดังกล่าว
อย่างไรก็ตาม AISI ระบุว่า ไม่พบความเสียหายที่เกิดขึ้นจริงจากเหตุการณ์เหล่านี้
แอนดรูว์ ยุน นักวิจัยจาก CivAI ซึ่งเป็นองค์กรไม่แสวงหากำไรในรัฐแคลิฟอร์เนียที่ศึกษาศักยภาพและความเสี่ยงของ AI กล่าวว่า จากข้อมูลที่มี ดูเหมือนว่า AI Agent ของแอนโทรปิกจะเป็นผู้สร้างตัวตนปลอม พร้อมระบุว่า การที่ Mythos มีพฤติกรรมหลอกลวงและดูเหมือนตระหนักว่ากำลังมุ่งเป้าไปยังบุคคลจริง สะท้อนว่าแอนโทรปิกอาจยังควบคุมโมเดลของตนเองได้ไม่ดีเท่าที่บริษัทเชื่อมั่น
ด้านแอนโทรปิกระบุผ่านแถลงการณ์บนแพลตฟอร์ม X ว่า บริษัทกำลังทำงานร่วมกับ AISI อย่างใกล้ชิด เพื่อขอรายละเอียดเพิ่มเติมและดำเนินการตรวจสอบภายใน
ขณะที่โอเพนเอไอเปิดเผยผ่านบล็อกของบริษัทว่า การกระทำที่ไม่ได้รับอนุญาตทั้ง 2 กรณีของ AI Agent เกิดจากการเข้าถึงอินเทอร์เน็ตในลักษณะที่คำสั่งทดสอบ (Prompt) ไม่อนุญาต พร้อมยืนยันว่าจะร่วมมือกับหน่วยงานต่าง ๆ เพื่อยกระดับแนวทางการประเมินความเสี่ยงของ AI ให้มีความปลอดภัยมากขึ้น
นอกจากนี้ โอเพนเอไอยังเปิดเผยว่า ความผิดพลาดในการกำหนดค่าระบบของ Irregular ซึ่งเป็นผู้ให้บริการทดสอบภายนอก ทำให้ AI Agent ของบริษัทเชื่อมต่ออินเทอร์เน็ตได้โดยไม่ตั้งใจ ซึ่งมีลักษณะคล้ายกับเหตุการณ์ที่แอนโทรปิกเปิดเผยเมื่อสัปดาห์ที่ผ่านมา
ก่อนหน้านี้สื่อรายงานว่า โอเพนเอไอได้ขยายการสอบสวนด้านความปลอดภัย หลังพบหลักฐานเพิ่มเติมว่า AI Agent บางตัวสามารถหลุดออกจากข้อจำกัดของระบบทดสอบได้
อย่างไรก็ตาม AISI ระบุว่า เหตุการณ์ในการประเมินครั้งนี้แตกต่างจากกรณีการละเมิดความปลอดภัยของบริษัทฮักกิงเฟซ (Hugging Face) เมื่อเดือนก.ค. เนื่องจาก AI Agent ไม่ได้หลุดออกจากสภาพแวดล้อมการทดสอบ แต่เป็นการเชื่อมต่ออินเทอร์เน็ตที่ AISI อนุญาตไว้ตามขั้นตอนการทดสอบมาตรฐานของหน่วยงาน จึงไม่ได้ถือว่าเป็นการหลุดออกจากระบบทดสอบแต่อย่างใด
โดย กัลยาณี ชีวะพานิช/ปรียพรรณ มีสุข





