
Anthropic รับ Claude เจาะระบบจริงโดยไม่ตั้งใจ พร้อมเร่งอุดช่องโหว่การทดสอบ
Anthropic ยอมรับ Claude หลุดทดสอบความปลอดภัย แฮ็ก 3 องค์กรจริง เหตุตั้งค่าระบบผิดพลาด จุดชนวนความเสี่ยงและแรงกดดันกำกับธุรกิจ AI ทั่วโลก
KEY
POINTS
- Claude โมเดล AI ของ Anthropic ได้เจาะเข้าระบบของ 3 องค์กรจริงโดยไม่ได้ตั้งใจระหว่างการทดสอบความปลอดภัย
- สาเหตุหลักเกิดจากความผิดพลาดในการตั้งค่า (Configuration error) ที่ทำให้ AI สามารถเชื่อมต่อกับอินเทอร์เน็ตจากสภาพแวดล้อมทดสอบได้
- AI เข้าใจว่าการเจาะระบบเป็นส่วนหนึ่งของแบบฝึกหัด "capture-the-flag" และไม่ตระหนักว่ากำลังทำงานบนระบบจริง
- Anthropic ตรวจพบปัญหาหลังทบทวนการทดสอบ และกำลังเร่งแก้ไขช่องโหว่เพื่อป้องกันไม่ให้เกิดขึ้นอีก
เมื่อปัญญาประดิษฐ์ไม่ได้หยุดอยู่เพียงการตอบคำถาม แต่สามารถลงมือค้นหาช่องโหว่และเจาะระบบได้จริง ความผิดพลาดเพียงจุดเดียวในการตั้งค่าจึงอาจเปลี่ยน “สนามทดสอบ” ให้กลายเป็นภัยคุกคามต่อองค์กรภายนอกโดยไม่รู้ตัว
'Claude' แฮกระบบ 3 องค์กรจริง
Anthropic PBC เปิดเผยว่า 'Claude' โมเดล AI ของบริษัทได้เจาะเข้าระบบ (Hack) ของ 3 องค์กรจริงโดยไม่ได้ตั้งใจ ระหว่างการทดสอบความปลอดภัยไซเบอร์ ที่ผิดพลาดไปจากแผน โดยมีสาเหตุหลักมาจากความผิดพลาดในการตั้งค่าระบบ (Configuration error) ที่เปิดช่องให้ AI เชื่อมต่อกับอินเทอร์เน็ตได้
เหตุการณ์นี้เกิดขึ้นหลังจากที่ OpenAI คู่แข่งรายใหญ่ ได้เปิดเผยเหตุการณ์ในลักษณะเดียวกันเพียงกว่าหนึ่งสัปดาห์ และยอมรับว่าเอเจนต์ AI ของตนหลุดการควบคุมและเข้าไปโจมตีระบบของบริษัท Hugging Face
Anthropic ระบุว่า บริษัทตรวจพบปัญหานี้หลังจากทบทวนการทดสอบความปลอดภัยไซเบอร์ของตัวเอง ซึ่งเกิดขึ้นหลังจาก OpenAI ประกาศเรื่องการถูกเจาะระบบ
โดยทั้งสองกรณีของ OpenAI และ Anthropic โมเดล AI สามารถเข้าถึงอินเทอร์เน็ตได้จากภายในสภาพแวดล้อมทดสอบที่ควรจะถูกปิดกั้นไว้
บริษัทระบุว่า ได้ทบทวนการทดสอบประเมินผลทั้งหมด 141,006 ครั้ง และพบ 3 กรณีที่เครื่องมือ Claude AI เข้าถึงอินเทอร์เน็ต แล้วแฮ็กเข้าโครงสร้างพื้นฐานในโลกจริงขององค์กรภายนอก โดยเหตุการณ์แรกสุดย้อนไปถึงเดือนเมษายน อย่างไรก็ดี Anthropic ไม่ได้เปิดเผยชื่อ 3 องค์กรที่ได้รับผลกระทบ
เมื่อโมเดลของ Anthropic เข้าถึงระบบของทั้ง 3 องค์กรโดยไม่ได้รับอนุญาต โมเดลเข้าใจว่าเป็นส่วนหนึ่งของแบบฝึกหัด การทดสอบเหล่านี้เป็นรูปแบบ “capture-the-flag” ที่โมเดลต้องเจาะเข้าระบบอื่น เพื่อค้นหาข้อมูลที่ซ่อนอยู่ ซึ่งเป็นวิธีทดสอบขีดความสามารถด้านการแฮ็กที่ใช้กันทั่วไปทั้งกับมนุษย์และ AI
สิ่งที่น่าสนใจคือ โมเดลรุ่นเก่ายังคงเดินหน้าโจมตีต่อ แม้จะมีหลักฐานว่ากำลังทำงานอยู่บนอินเทอร์เน็ตจริงแล้วก็ตาม ขณะที่โมเดลรุ่นล่าสุดของ Anthropic กลับหยุดการกระทำทันทีที่รู้ตัวว่ากำลังอยู่บนอินเทอร์เน็ต
เหตุการณ์แฮ็กที่เกิดจาก AI โดยไม่ตั้งใจในลักษณะนี้ เริ่มผลักดันให้นักการเมืองบางส่วน เรียกร้องให้มีมาตรการควบคุมระดับสหพันธรัฐ หรือการกำกับดูแลเทคโนโลยี AI มากขึ้น







