
บริษัท AI รวมตัวกันดึงคนนอกช่วยความปลอดภัย แต่จะได้ผลแค่ไหน?
Anthropic เสนอให้ผู้ประเมินอิสระเข้าตรวจสอบ AI ภายในบริษัท แต่ผู้เชี่ยวชาญชี้ว่าต้องมีกฎหมายคุ้มครองความเป็นอิสระ เพื่อให้การตรวจสอบโปร่งใส
Dario Amodei ซีอีโอของ Anthropic บริษัท AI ยักษ์ใหญ่อย่าง Anthropic ได้เสนอแนวคิดในการดึงตัว ผู้ประเมินความปลอดภัยจากหน่วยงานภายนอก เข้ามาร่วมปฏิบัติงานภายในบริษัท เพื่อให้ช่วยประเมินความปลอดภัยของโมเดล AI ชั้นนำ เพื่อประเมินความปลอดภัยและรายงานผลลัพธ์สู่สาธารณะอย่างตรงไปตรงมา
แน่นอนแนวคิดนี้เคยได้รับการต่อต้านจากบริษัท AI หลายแห่ง แต่ภายหลังเหตุการณ์ AI Agent ถล่ม Hugging Face แนวคิดของพวกเขาก็เริ่มเปลี่ยนไป Sam Altman ซีอีโอของ OpenAI ก็เริ่มออกมาสนับสนุนแนวคิดนี้ และมองว่าจะช่วยเพิ่มความปลอดภัยและโปร่งใสให้แก่วงการ
อย่างไรก็ตามในกลุ่มผู้ตรวจสอบอิสระทั้งหลายกลับมองในทางตรงข้าม หากต้องการให้พวกเขาเข้ามาทำหน้าที่เป็นผู้เฝ้าระวังอิสระ ควรมีกฎหมายและกรอบกำหนดควบคุมมารองรับ เพื่อให้พวกเขาสามารถทำงานได้อย่างเป็นอิสระ โดยไม่มีข้อจำกัดของบริษัท AI มากำหนด
สาเหตุสำคัญมาจากโมเดล AI ในปัจจุบันมีความฉลาดมากขึ้นเรื่อยๆ หลายตัวรับรู้ว่าตัวเองกำลังถูกทดสอบจึงปฏิบัติตามคำสั่งภายในกรอบเพื่อซ่อนปัญหาเอง จึงต้องอาศัยการตรวจสอบที่ลึกและละเอียดยิ่งขึ้น นอกจากนี้โมเดลที่พวกเขาทดสอบก็มักเป็นรุ่นที่พัฒนาเสร็จสมบูรณ์ แต่ไม่มีโอกาสเข้าถึงระหว่างการพัฒนาที่อาจเป็นต้นตอปัญหา
ประเด็นพัฒนาคือในเงื่อนของเวลา ในการเปิดตัว GPT-6 Astra พวกเขามีเวลาทดสอบเพียง 3 วันล่วงหน้า หรือในเหตุการณ์ที่ OpenAI โจมตี Hugging Face ทาง METR สถาบันวิจัย AI อิสระก็ออกมาเปิดเผยว่า พวกเขามีเวลาตรวจสอบเพียง 1 อาทิตย์ ทำให้ไม่สามารถตรวจสอบได้อย่างละเอียดถี่ถ้วนเพียงพอ
นอกจากนี้ยังเป็นไปได้ว่า โมเดล AI รุ่นที่ถูกส่งมาให้ทดสอบ กับโมเดล AI ที่จะถูกนำไปเปิดให้เข้าถึงและใช้งานจริงอาจเป็นคนละตัวกัน บริษัท AI อาจมีการพัฒนาโมเดลออกมาอีกรุ่นเพื่อเข้ารับการทดสอบโดยเฉพาะ หรืออาจมีการเปลี่ยนแปลงกฎเกณฑ์หรือระเบียบข้อบังคับ เพื่อผลประโยชน์ของบริษัทเมื่อไหร่ก็ได้
นั่นทำให้ทีมตรวจสอบมองว่า ทางที่ยั่งยืนอาจต้องเป็นการออกกฎและร่วมกำกับดูแลด้วยกฎหมายมากกว่า
ที่มา
https://techcrunch.com/2026/09/16/anthropic-and-openai-want-to-embed-safety-evaluators-will-they-really-be-independent/







