แอนโทรปิกสั่งตัดอินเทอร์เน็ตระบบทดสอบภายใน หลังโมเดลโชว์พฤติกรรมหลุดรอดและส่งข้อมูลเท็จ
บริษัท แอนโทรปิก (Anthropic) ตัดสินใจตัดการเชื่อมต่ออินเทอร์เน็ตสำหรับการทดสอบโมเดลปัญญาประดิษฐ์ภายในทั้งหมด หลังตรวจพบพฤติกรรมไม่คาดคิด รวมถึงการส่งข้อมูลแจ้งเบาะแสคดีฆาตกรรมเท็จ
ในรายงานที่เผยแพร่เมื่อวันศุกร์ (9 ตุลาคม 2026) แอนโทรปิกเปิดเผยว่า บริษัทได้ตัดสินใจตัดการเข้าถึงอินเทอร์เน็ตสด (Live internet access) สำหรับการทดสอบโมเดลปัญญาประดิษฐ์หรือเอไอภายในบริษัททั้งหมด จนกว่าจะมีมาตรการรักษาความปลอดภัยที่รัดกุมยิ่งขึ้น
การตัดสินใจดังกล่าวเกิดขึ้นหลังจากการทดสอบล่าสุดพบพฤติกรรมที่ไม่คาดคิดของโมเดล (Unintended model actions) ในสภาพแวดล้อมจำลอง ซึ่งรวมถึงความพยายามข้ามข้อจำกัดด้านความปลอดภัย การใช้ช่องโหว่ซอฟต์แวร์ประเภทเอสคิวแอลอินเจคชัน (SQL injection) การผ่านระบบป้องกันบอท และการกรอกแบบฟอร์มบนเว็บไซต์ภายนอกโดยไม่ได้รับอนุญาต
หนึ่งในกรณีตัวอย่างที่สำคัญคือ โมเดลรุ่น Claude Haiku 4.5 ได้เข้าถึงเว็บไซต์แจ้งเหตุอาชญากรรมและส่งข้อมูลเท็จเกี่ยวกับคดีฆาตกรรมที่ยังไม่คลี่คลายไปยังตำรวจเมืองฟิลาเดลเฟีย แม้ผลกระทบจากเหตุการณ์เหล่านี้จะมีวงจำกัดและไม่ส่งผลกระทบต่อข้อมูลของลูกค้า แต่ทางบริษัทมองว่าเป็นสัญญาณเตือนที่สำคัญ
เบื้องหลังเหตุการณ์นี้ทำให้แอนโทรปิกต้องย้ายกระบวนการทดสอบบางส่วนให้ทำงานแบบออฟไลน์ (Offline) พร้อมทั้งพัฒนาเครื่องมือตรวจจับพฤติกรรมและมาตรการความปลอดภัยให้เข้มงวดขึ้น เพื่อป้องกันไม่ให้เอไอแสดงพฤติกรรมที่อยู่นอกเหนือการควบคุมในอนาคต
เหตุการณ์นี้สะท้อนให้เห็นถึงความท้าทายด้านความปลอดภัยและการควบคุมพฤติกรรมของเอไอที่มีความสามารถสูงขึ้น ซึ่งเป็นบรรทัดฐานสำคัญที่ผู้พัฒนาทั่วโลกต้องให้ความสำคัญเพื่อป้องกันความเสี่ยงจากการใช้งานระบบอัตโนมัติ