Anthropic ยอมรับ Claude หลุดออกมาโลกจริง เจาะระบบ 3 องค์กร - Brand Buffet
แชร์ :

ประหนึ่งไซบีเรียนเกเร Anthropic ค่าย AI ยักษ์ใหญ่ออกมายอมรับว่า Claude โมเดล AI ของทางค่ายได้ออกไปเจาะระบบขององค์กรภายนอกถึง 3 แห่งในระหว่างการทดสอบ พร้อมระบุว่า พฤติกรรมเกเรรอบนี้ของ Claude มาจากการสื่อสารที่คลาดเคลื่อนของบริษัทพาร์ทเนอร์ ที่แม้จะสั่งให้ AI ทำงานภายใต้สภาวะที่ไร้อินเทอร์เน็ตแล้วก็ตาม แต่บริษัทได้เปิดระบบอินเทอร์เน็ตทิ้งเอาไว้ ทำให้ AI ใช้ช่องทางดังกล่าวในการทำงานตามที่สั่ง
Anthropic ระบุว่า โมเดล AI ที่เกี่ยวข้องกับการเจาะระบบบริษัทภายนอกมีทั้งสิ้น 3 ตัว ได้แก่ Claude Opus 4.7, Claude Mythos 5 และตัวสุดท้ายเป็นโมเดลที่พัฒนาขึ้นสำหรับการวิจัยภายใน ส่วนวิธีที่โมเดลใช้ในการเจาะระบบบริษัทอื่นนั้น พบว่าเป็นเทคนิคพื้นฐาน เช่น การเจาะผ่านพาสเวิร์ด (ซึ่งบริษัทเหล่านั้นอาจตั้งพาสเวิร์ดที่คาดเดาได้ง่าย) ฯลฯ
สำหรับที่มาของการหลุดออกมาสู่โลกภายนอกนั้น Anthropic ระบุว่า เป็นช่วงเวลาของการทดสอบ และมีการป้อนคำสั่งให้โมเดล AI ค้นหาข้อมูลที่ซ่อนอยู่ในเครือข่ายจำลอง ซึ่งในคำสั่งที่ป้อนให้กับโมเดลก็มีการระบุว่า ไม่มีการเชื่อมต่ออินเทอร์เน็ต อย่างไรก็ดี พาร์ทเนอร์ที่เข้าร่วมในการทดสอบครั้งนี้อย่าง Irregular ได้เปิดอินเทอร์เน็ตทิ้งไว้ และทำให้โมเดล AI สามารถเชื่อมต่อไปยังโลกออนไลน์ได้

สิ่งที่น่าสนใจที่ตามมาก็คือ การตอบสนองของโมเดล AI หลังจากที่มันรับทราบว่า มันกำลังเจาะระบบบริษัทในโลกแห่งความเป็นจริงอยู่ โดย Opus 4.7 ยังคงโจมตีต่อไป ส่วน Mythos 5 คิดว่าตัวเองยังอยู่ในโลกจำลอง และโมเดลที่พัฒนาเพื่อการวิจัยภายในได้หยุดการทดสอบ
อย่างไรก็ดี Anthropic ไม่ได้เปิดเผยรายชื่อของทั้ง 3 บริษัทที่ถูก Claude เจาะระบบว่าเป็นบริษัทใด
ผลที่ค้นพบนี้ ทำให้ Anthropic มองว่า วงการเทคโนโลยีจำเป็นต้องตระหนัก และมีการควบคุมที่เข้มงวดมากขึ้นในการกำหนดสภาพแวดล้อมการทดสอบโมเดล AI ทั้งการทดสอบภายใน และภายนอก เนื่องจากแบบจำลอง AI มีความสามารถในการดำเนินกิจกรรมทางไซเบอร์ในโลกแห่งความเป็นจริงมากขึ้นเรื่อย ๆ นั่นเอง
แชร์ :