ทันเอไอ

ข่าว AI & ไอที ระดับโลก แปลเป็นไทย อ่านสบายตา · ตรวจสอบแหล่งทุกข่าว

🌐ติดตาม
← กลับหน้าข่าว
LINE Facebook X
โมเดล & วิจัย AIยืนยันแล้ว

งานวิจัยชี้ LLM เขียนอัตชีวประวัติพลาดสูงถึง 96.7% พบปัญหาแต่งเรื่องเท็จและบิดเบือนความจริง

งานวิจัยชิ้นใหม่เผยการใช้โมเดลภาษาขนาดใหญ่สร้างอัตชีวประวัติมีอัตราการสร้างเรื่องเท็จสูงเกือบทั้งหมดเมื่อเทียบกับบันทึกชีวิตจริง

📅 28 ส.ค. 2569 03:55 น.
งานวิจัยชี้ LLM เขียนอัตชีวประวัติพลาดสูงถึง 96.7% พบปัญหาแต่งเรื่องเท็จและบิดเบือนความจริง

งานวิจัยล่าสุดในชื่อ "Auditing the Synthetic Memoir: Measuring Scene-Level Confabulation in LLM-Generated Autobiography Against the Documented Record of the Life It Describes" ซึ่งเผยแพร่บน arXiv ในเดือนสิงหาคม 2026 ได้ทำการตรวจสอบเชิงปริมาณเป็นครั้งแรกเกี่ยวกับการสร้างเรื่องเท็จ (Confabulation) ของโมเดลภาษาขนาดใหญ่หรือ LLM (Large Language Model) เมื่อต้องเขียนอัตชีวประวัติของบุคคล

ผู้เขียนงานวิจัยคือ เฮเทอร์ เรนเซ (Heather Renze) ได้ทดลองให้ LLM สนทนาร่างอัตชีวประวัติแบบวันต่อวันรวม 366 วัน โดยป้อนข้อมูลตั้งต้นเพียงแม่แบบ ตัวอย่าง 2 วัน และคำคมประจำวัน จากนั้นนำเนื้อหาแต่ละวันมาตรวจสอบความถูกต้องอย่างละเอียดเทียบกับบันทึกเหตุการณ์จริง (Ground-truth corpus) ผ่านเกณฑ์การประเมิน 4 ระดับที่กำหนดไว้ล่วงหน้า

ผลการศึกษาพบว่า อัตราความล้มเหลวในการตรวจสอบความถูกต้อง (Verification-failure rate) สูงถึง 96.7% หรือคิดเป็น 354 จาก 366 วันที่ไม่ผ่านเกณฑ์การยืนยัน โดยมีเพียง 12 วันเท่านั้นที่เหตุการณ์สอดคล้องกับความจริง นอกจากนี้ยังมีเหตุการณ์ที่ขัดแย้งกับความเป็นจริงโดยตรงถึง 19 วัน หรือคิดเป็น 5.2%

รูปแบบความผิดพลาดที่พบส่วนใหญ่คือ "Grounded drift" ซึ่งเป็นการนำบุคคล สถานที่ หรือนายจ้างที่มีตัวตนอยู่จริง มาผสมผสานเข้ากับเหตุการณ์ที่โมเดลสร้างขึ้นมาเอง งานวิจัยนี้จึงสรุปว่าการใช้โมเดลปัญญาประดิษฐ์ในปัจจุบันสร้างเรื่องราวชีวิตยังคงมีความเสี่ยงสูงที่จะให้ข้อมูลที่ไม่ถูกต้อง หากปราศจากการวางรากฐานข้อมูลหรือ Grounding ที่เหมาะสม

ทำไมถึงสำคัญ
สะท้อนข้อจำกัดสำคัญของปัญญาประดิษฐ์ในการประมวลผลความทรงจำและชีวประวัติบุคคล ซึ่งเตือนใจผู้ใช้งานให้ระมัดระวังความคลาดเคลื่อนและการสร้างข้อมูลเท็จของโมเดลเมื่อต้องนำไปใช้ในงานที่ต้องการความถูกต้องสูง
#LLM#AI Safety#งานวิจัย AI#Confabulation
ที่มา (เรียบเรียง+สรุปจาก): arXiv cs.AI · arxiv.org · arxiv.org · arxiv.org · arxiv.org · ainewsforyou.com

ความคิดเห็น

กำลังโหลดความคิดเห็น…

ไม่ต้องสมัครสมาชิก · ระบบกรองคำหยาบอัตโนมัติ และผู้ดูแลลบความคิดเห็นได้