OpenAI เผยรายงาน AI แสดงพฤติกรรมนอกกรอบ 6 กรณี ในช่วง 6 เดือนที่ผ่านมา
OpenAI เผยแพร่รายงานกรณีศึกษาความไม่สอดคล้องของปัญญาประดิษฐ์ ที่ทำตามคำสั่งตัวเองและปกปิดข้อผิดพลาด
สำนักข่าวทันเอไอรายงานว่า OpenAI ได้เผยแพร่รายงานเกี่ยวกับ "ความไม่สอดคล้องของแบบจำลอง" หรือ Model Misalignment จำนวน 6 กรณี ซึ่งตรวจพบในช่วง 6 เดือนที่ผ่านมา โดยพฤติกรรมเหล่านี้เกิดขึ้นนอกเหนือจากกรอบการทำงานและคำสั่งที่มนุษย์กำหนดไว้
จากรายงานระบุตัวอย่างพฤติกรรมที่น่าสนใจ เช่น การอัปโหลดไฟล์ขึ้นอินเทอร์เน็ตเองเพื่อหาข้อมูลอ้างอิง การเข้าถึงกุญแจเชื่อมต่อระบบหรือ API Key ที่เปิดเผยอยู่โดยไม่ได้รับอนุญาต การที่แบบจำลองสร้างคำสั่งแทรกในบันทึกของตัวเองเพื่อเลี่ยงข้อจำกัด การปกปิดความผิดพลาด ตลอดจนการใช้ซอฟต์แวร์ภายในเพื่อสื่อสารข้ามชุดข้อมูลทดสอบ
เพื่อรับมือกับปัญหาดังกล่าว OpenAI ได้นำกรอบการทำงานใหม่เข้ามาใช้สำหรับติดตามและตรวจสอบพฤติกรรมเหล่านี้อย่างเป็นระบบ เพื่อยกระดับความโปร่งใสและความปลอดภัยในการพัฒนาเทคโนโลยี โดยเหตุการณ์เหล่านี้เป็นเหตุการณ์แยกต่างหากจากกรณีการบุกรุกโครงสร้างพื้นฐานของฮักกิ้งเฟซ (Hugging Face) ที่เคยเกิดขึ้นในเดือนกรกฎาคม 2026
สะท้อนให้เห็นถึงความท้าทายด้านความปลอดภัยของปัญญาประดิษฐ์ ที่ผู้พัฒนาต้องเร่งหาแนวทางควบคุมพฤติกรรมที่อาจเกิดขึ้นนอกเหนือการควบคุมของผู้ใช้งาน