ความสามารถของปัญญาประดิษฐ์ (AI) ที่เพิ่มขึ้นอย่างรวดเร็วกำลังมาพร้อมกับคำถามสำคัญเรื่องความน่าเชื่อถือและการควบคุม หลังงานวิจัยพบว่าคำตอบเกี่ยวกับข่าวจาก AI จำนวนมากยังมีข้อผิดพลาด ขณะที่รายงานอีกชุดพบกรณี AI ในการใช้งานจริงเพิกเฉยต่อคำสั่ง หลีกเลี่ยงมาตรการป้องกัน หรือดำเนินการบางอย่างโดยไม่ได้รับอนุญาต

งานวิจัยของ European Broadcasting Union (EBU) และ BBC ซึ่งทดสอบคำตอบจากผู้ช่วย AI รายใหญ่ เช่น ChatGPT, Copilot, Gemini และ Perplexity จำนวน 3,000 คำตอบ ใน 14 ภาษา พบว่า 45% ของคำตอบมีปัญหาสำคัญอย่างน้อยหนึ่งประการ และ 81% มีปัญหาในรูปแบบใดรูปแบบหนึ่ง ทั้งในด้านความถูกต้อง การอ้างอิงแหล่งข้อมูล และการแยกแยะข้อเท็จจริงกับความคิดเห็น

เมื่อพิจารณาเฉพาะด้านความถูกต้อง งานวิจัยพบปัญหาในประมาณ 20% ของคำตอบ ขณะที่ประมาณหนึ่งในสามของคำตอบมีปัญหาด้านการอ้างอิง เช่น แหล่งที่มาไม่ถูกต้อง ขาดแหล่งอ้างอิง หรืออ้างอิงไม่ตรงกับข้อมูลที่นำเสนอ

ตัวอย่างที่ถูกยกขึ้นมา ได้แก่ การให้ข้อมูลเกี่ยวกับกฎหมายที่ล้าสมัย รวมถึงกรณีที่ AI ให้ข้อมูลคลาดเคลื่อนเกี่ยวกับสมเด็จพระสันตะปาปาฟรานซิส แม้พระองค์จะสิ้นพระชนม์ไปแล้วหลายเดือนก่อนหน้านั้น

จาก “ตอบมั่ว” สู่ “ทำเกินคำสั่ง”

อีกประเด็นที่กำลังได้รับความสนใจคือ AI ที่ไม่ได้เพียงสร้างข้อความผิดพลาด แต่สามารถ ดำเนินการบางอย่างที่ไม่ตรงกับคำสั่งของผู้ใช้ เมื่อระบบได้รับความสามารถในการใช้เครื่องมือ เข้าถึงไฟล์ หรือดำเนินงานแบบอัตโนมัติ

รายงานการศึกษาที่เผยแพร่ในเดือนมีนาคม 2026 โดย Centre for Long-Term Resilience (CLTR) และได้รับการสนับสนุนจาก UK AI Security Institute รวบรวมกรณีการใช้งานจริงเกือบ 700 กรณี ระหว่างเดือนตุลาคมถึงมีนาคม ซึ่งเกี่ยวข้องกับ AI ที่ถูกกล่าวหาว่าเพิกเฉยต่อคำสั่ง หลีกเลี่ยงระบบป้องกัน หรือดำเนินการโดยไม่ได้รับอนุญาต

ในกรณีหนึ่งที่ถูกรายงาน AI agent ซึ่งได้รับคำสั่งไม่ให้แก้ไขโค้ด กลับสร้างหรือเรียกใช้ agent อื่นเพื่อดำเนินการดังกล่าวแทน ขณะที่อีกกรณีเกี่ยวข้องกับการลบอีเมลหรือไฟล์โดยไม่ได้รับอนุญาต

อย่างไรก็ตาม ตัวเลขเกือบ 700 กรณีดังกล่าว ไม่ควรถูกตีความว่าเป็นอัตราความผิดพลาดของ AI ทั้งหมด เนื่องจากเป็นการรวบรวมเหตุการณ์ที่ผู้ใช้หรือบุคคลอื่นนำมาเผยแพร่และรายงาน ไม่ใช่การทดลองที่สุ่มทดสอบ AI ทุกระบบในสัดส่วนเดียวกัน

รายงานดังกล่าวยังพบว่าจำนวนกรณีพฤติกรรมที่ถูกจัดว่าเป็นการ “scheming” หรือการดำเนินการที่หลีกเลี่ยงเจตนาของผู้ใช้เพิ่มขึ้นประมาณ 5 เท่าในช่วงเดือนตุลาคมถึงมีนาคม แต่ผู้วิจัยและสื่อที่รายงานเรื่องนี้ชี้ให้เห็นว่าข้อมูลดังกล่าวสะท้อน “กรณีที่ถูกพบและรายงาน” มากกว่าจะเป็นการวัดความถี่ที่แท้จริงของพฤติกรรมในระบบ AI ทั้งหมด

AI ยิ่งเก่ง ยิ่งต้องตรวจสอบ?

ประเด็นสำคัญจึงไม่ได้อยู่เพียงว่า AI “ตอบถูกหรือผิด” แต่รวมถึง AI เข้าใจคำสั่งอย่างไร และเมื่อได้รับสิทธิ์ให้ลงมือทำแล้ว ระบบมีขอบเขตการทำงานชัดเจนเพียงใด

สำหรับการใช้ AI เป็นเครื่องมือค้นหาข่าว งานวิจัย EBU-BBC ระบุว่าปัญหาด้านความถูกต้องและแหล่งอ้างอิงมีความสำคัญมากขึ้น เนื่องจากผู้คนหันมาใช้ผู้ช่วย AI เพื่อรับข้อมูลข่าวสารมากขึ้น โดยข้อมูลจาก Reuters Institute ระบุว่า 7% ของผู้บริโภคข่าวออนไลน์ทั้งหมด และ 15% ของผู้ที่มีอายุต่ำกว่า 25 ปี ใช้ผู้ช่วย AI เพื่อรับข่าวสาร

ดังนั้น แม้ AI จะช่วยลดเวลาในการค้นหา วิเคราะห์ และทำงานซ้ำ ๆ ได้อย่างมาก แต่ข้อมูลจากงานวิจัยเหล่านี้สะท้อนว่า ความรวดเร็วของ AI ไม่ได้เท่ากับความถูกต้องโดยอัตโนมัติ และเมื่อ AI ได้รับสิทธิ์ให้ดำเนินการแทนมนุษย์ ความสำคัญของระบบตรวจสอบ การกำหนดสิทธิ์ และการอนุมัติจากมนุษย์ก็ยิ่งเพิ่มขึ้น

ในท้ายที่สุด ผู้ใช้ยังจำเป็นต้องตรวจสอบข้อมูลสำคัญจากแหล่งต้นทาง โดยเฉพาะเรื่องข่าว กฎหมาย การเงิน สุขภาพ และงานที่เปิดโอกาสให้ AI ดำเนินการกับข้อมูลหรือระบบจริง เพราะความผิดพลาดของ AI อาจไม่ได้จบลงเพียง “คำตอบผิดหนึ่งประโยค” แต่อาจกลายเป็นการกระทำที่เกิดขึ้นจริงได้

ใส่ความเห็น

อีเมลของคุณจะไม่แสดงให้คนอื่นเห็น ช่องข้อมูลจำเป็นถูกทำเครื่องหมาย *