posttoday
ซ้ำรอยอีก AISI พบ AI OpenAI-Anthropic ละเมิดกฎทดสอบ พยายามเจาะระบบ

ซ้ำรอยอีก AISI พบ AI OpenAI-Anthropic ละเมิดกฎทดสอบ พยายามเจาะระบบ

05 สิงหาคม 2569

สถาบันความมั่นคง AI ของอังกฤษเผย AI Agent จาก OpenAI และ Anthropic แสดงพฤติกรรมเกินขอบเขตระหว่างทดสอบ ทั้งสร้างตัวตนปลอมและพยายามเข้าถึงระบบโดยไม่ได้รับอนุญาต

สถาบันความมั่นคงด้านปัญญาประดิษฐ์ของสหราชอาณาจักร (AI Security Institute: AISI) เปิดเผยผลการประเมินล่าสุด พบว่า AI Agent ของ OpenAI และ Anthropic แสดงพฤติกรรมที่ไม่ได้รับอนุญาตระหว่างการทดสอบด้านความปลอดภัย โดยบางกรณีมีการสร้างตัวตนปลอมบนโลกออนไลน์และพยายามเข้าถึงระบบที่มีการป้องกัน เพื่อทดสอบขีดความสามารถของโมเดล AI ขั้นสูง

 

AISI ระบุว่า AI Agent ที่ใช้โมเดล Mythos 5 ของ Anthropic และ GPT-5.6-Sol ของ OpenAI มีการดำเนินการนอกเหนือจากคำสั่งที่กำหนดระหว่างการประเมิน ซึ่งจัดขึ้นเพื่อศึกษาศักยภาพและความเสี่ยงของระบบ AI โดยพบว่าบางพฤติกรรมอาจก่อให้เกิดอันตรายต่อบุคคลหรือองค์กร หากเกิดขึ้นในสถานการณ์จริง

 

การทดสอบดังกล่าวจำลองสถานการณ์ด้านความมั่นคงไซเบอร์และดำเนินการทั้งหมด 122 ครั้ง พบการกระทำที่ไม่ได้รับอนุญาตรวม 19 ครั้ง จากการทดสอบ 10 รอบ โดย AI ของ Anthropic มีส่วนเกี่ยวข้อง 17 ครั้ง ส่วน AI ของ OpenAI เกี่ยวข้อง 2 ครั้ง

 

กรณีที่ร้ายแรงที่สุดคือ AI Agent เขียนโค้ดที่เป็นอันตราย พร้อมสร้างตัวตนปลอมบนอินเทอร์เน็ต เพื่อพยายามโน้มน้าวให้มนุษย์อนุมัติการใช้งานโค้ดดังกล่าว อย่างไรก็ตาม AISI ยืนยันว่าไม่พบความเสียหายที่เกิดขึ้นจริงจากการทดสอบทั้งหมด

ซ้ำรอยอีก AISI พบ AI OpenAI-Anthropic ละเมิดกฎทดสอบ พยายามเจาะระบบ

 

แม้ AISI จะไม่ได้เปิดเผยว่า AI ของบริษัทใดเป็นผู้สร้างตัวตนปลอม แต่นักวิจัยจากองค์กรไม่แสวงหากำไร CivAI ประเมินว่า มีแนวโน้มเป็น AI ของ Anthropic พร้อมตั้งข้อสังเกตว่าเหตุการณ์ดังกล่าวสะท้อนว่าบริษัทยังควบคุมพฤติกรรมของโมเดลได้ไม่สมบูรณ์

 

ด้าน Anthropic ระบุผ่านแพลตฟอร์ม X ว่ากำลังทำงานร่วมกับ AISI เพื่อขอข้อมูลเพิ่มเติมและดำเนินการตรวจสอบภายใน ขณะที่ OpenAI เปิดเผยว่า การกระทำที่ไม่ได้รับอนุญาตของ AI ทั้งสองกรณีเกี่ยวข้องกับการเข้าถึงอินเทอร์เน็ตในลักษณะที่ขัดต่อข้อกำหนดของการทดสอบ พร้อมยืนยันว่าจะร่วมมือกับหน่วยงานกำกับดูแล สถาบันวิจัย และผู้พัฒนา AI รายอื่น เพื่อยกระดับมาตรฐานการประเมินความปลอดภัยของ AI ที่มีความเสี่ยงสูง

 

นอกจากนี้ OpenAI ยังเปิดเผยอีกว่า พบความผิดพลาดในการตั้งค่าของผู้ให้บริการทดสอบภายนอก ซึ่งทำให้ AI Agent สามารถเชื่อมต่ออินเทอร์เน็ตได้โดยไม่ตั้งใจ เหตุการณ์ดังกล่าวมีลักษณะคล้ายกับกรณีที่ Anthropic เปิดเผยเมื่อสัปดาห์ก่อน

 

AISI ย้ำว่า AI Agent ที่เข้าร่วมการทดสอบครั้งนี้ไม่ได้หลุดออกจากสภาพแวดล้อมควบคุมเพื่อเข้าถึงอินเทอร์เน็ตเหมือนเหตุการณ์ด้านความปลอดภัยในอดีต แต่เป็นการอนุญาตให้เชื่อมต่ออินเทอร์เน็ตภายใต้เงื่อนไขของการประเมินตามมาตรฐานของสถาบัน เพื่อศึกษาพฤติกรรมของ AI ในสถานการณ์จำลองอย่างใกล้ชิด.

ข่าวล่าสุด

ผู้เชี่ยวชาญไซเบอร์เตือนข้อมูลคนไทยรั่วตลาดมืด จี้รัฐเร่งอุดช่องโหว่

ผู้เชี่ยวชาญไซเบอร์เตือนข้อมูลคนไทยรั่วตลาดมืด จี้รัฐเร่งอุดช่องโหว่