Dictionary · Agent · 113 / 291

Approval fatigue

อาการที่คนกดอนุมัติคำสั่งของ AI agent ซ้ำๆ จนเลิกอ่านก่อนกด ทำให้คำสั่งอันตรายหลุดผ่านได้ง่ายกว่าที่คิด

Approval fatigue คืออาการที่คนเสื่อมความระมัดระวังลงเรื่อยๆ เมื่อต้องกดอนุมัติคำสั่งของ agent ซ้ำแล้วซ้ำเล่า จนถึงจุดที่เลิกอ่านเนื้อหาของคำสั่งจริงจัง แล้วกดผ่านไปเป็นความเคยชิน ปรากฏการณ์แบบนี้ไม่ใช่เรื่องใหม่ในงานความปลอดภัย มีอาการใกล้เคียงที่รู้จักกันมานานคือความชาจากการเห็นสัญญาณเตือนถี่เกินไป แต่สิ่งที่ทำให้เรื่องนี้กลับมาเป็นประเด็นชัดในเดือนสิงหาคม 2026 คือ AI coding agent อย่าง claude-code ทำให้ permission-request เด้งขึ้นถี่กว่าระบบงานเดิมมาก บางคนเจอคำถามขออนุมัติหลายสิบถึงหลายร้อยครั้งต่อวัน

ข้อมูลชุดที่ถูกอ้างถึงมากที่สุดมาจากเกมบนเบราว์เซอร์ของ Alex Wauters นักพัฒนาซอฟต์แวร์ชาวเบลเยียมที่ระบุประวัติตัวเองว่าเคยเป็น staff engineer ที่ Uber และปัจจุบันทำงานอยู่กับบริษัทด้านความปลอดภัย Aikido Security เกมนี้ให้ผู้เล่นสวมบทเป็นคนกดอนุมัติคำสั่งแทน AI agent ภายใต้เวลาจำกัด เขาเผยแพร่ผลวิเคราะห์เมื่อ 5 ส.ค. 2026 จากข้อมูลกว่า 40,000 รอบเล่น คิดเป็นการตัดสินอนุมัติหรือปฏิเสธ 409,000 ครั้ง ผู้เขียนสรุปว่าผู้เล่นโดยเฉลี่ยพลาดปล่อยคำสั่งอันตรายผ่านไปราวหนึ่งในสาม และรายงานค่าความแม่นยำเฉลี่ยไว้ที่ 66.3% ตัวเลขที่มีค่ากว่าค่าเฉลี่ยคือการแจกแจงตามประเภทคำสั่ง คำสั่งทำลายล้างชัดเจนอย่าง rm -rf คนจับได้ดีที่สุด พลาดแค่ 11.7% แต่คำสั่งที่ขอบเขตเกินงานจริง เช่น การอ่านไฟล์ credential หรือ config พลาดถึง 35.0% และกลุ่มคำสั่งที่ดูดข้อมูลออกหรือสั่งรันโค้ดพลาดถึง 33.4% ตัวอย่างที่ชัดที่สุดคือคำสั่ง npm run analyze ที่แฝงโค้ดส่งข้อมูลออกไปเซิร์ฟเวอร์ภายนอก ผู้เล่นกดอนุมัติผ่านไป 64.7% ของครั้งที่เจอ ทั้งที่ log ของ agent แสดงเนื้อหาคำสั่งให้เห็นอยู่ตรงหน้าแล้ว สะท้อนว่าด่านนี้อ่อนที่สุดตรงจุดที่อันตรายที่สุดพอดี เพราะคนไม่ได้พลาดคำสั่งที่หน้าตาน่ากลัว แต่พลาดคำสั่งที่หน้าตาเหมือนงานประจำ ข้อจำกัดที่ต้องกำกับไว้คือ Wauters ระบุเองว่านี่เป็นเกม ไม่ใช่งานวิจัยเชิงวิชาการ ผู้เล่นเลือกเข้ามาเล่นเอง ส่วนใหญ่ตามลิงก์มาจาก Hacker News ไม่ได้คัดมาเป็นตัวแทนนักพัฒนา งานนี้ยังไม่ผ่าน peer review และตัวบล็อกก็ไม่ได้อธิบายว่าค่า 66.3% คิดจากการตัดสินทุกครั้งหรือเฉพาะคำสั่งอันตราย ตัวเลขชุดนี้จึงเป็นค่าที่ผู้เขียนรายงานเอง ไม่ใช่ข้อสรุปที่ยุติแล้ว

Anthropic รายงานอาการเดียวกันจากข้อมูลการใช้งานของผลิตภัณฑ์ตัวเอง โดยเขียนไว้ในประกาศ 7 ส.ค. 2026 ว่าผู้ใช้ claude-code กดอนุมัติ permission-request ถึง 97% ของทุกครั้งที่เจอ ตัวเลขนี้เป็นข้อมูลภายในที่บริษัทเปิดเผยเอง ยังไม่มีบุคคลที่สามตรวจสอบ ขณะที่เมื่อระบบขอให้ตรวจแผนงานทั้งก้อนแทนคำสั่งเดี่ยวๆ คนกลับปฏิเสธถึง 39% ซึ่งแปลว่าคนยังตัดสินใจอย่างมีวิจารณญาณได้เมื่อคำถามมีน้ำหนักพอ แต่พอเป็นคำถามที่ถี่และดูซ้ำก็เลิกอ่านไปเอง ในประกาศฉบับเดียวกัน Anthropic ยังเปิดผลการทดลองที่บริษัทจ้างผู้ทดสอบ 1,053 คนผ่านบริษัทวิจัยมาทำเอง โดยแทรกคำสั่งอันตรายหนึ่งคำสั่งเข้าไปกลาง session ของแต่ละคน ผลคือคนสกัดคำสั่งอันตรายได้ราว 17% ในช่วงต้น session แต่พอผ่านคำถามไปเกิน 50 ครั้ง อัตราสกัดลดเหลือราว 5% ข้อควรระวังคือการทดลองนี้ Anthropic เป็นทั้งคนออกแบบ คนจ่ายเงิน และคนเผยแพร่เองในประกาศที่ใช้เปิดตัวฟีเจอร์ ยังไม่มีการเปิดชุดข้อมูลหรือให้บุคคลที่สามตรวจซ้ำ จึงควรอ่านเป็นตัวเลขของผู้ขาย ไม่ใช่ผลวิจัยที่เป็นกลาง บริษัทจึงประกาศเปลี่ยนค่าเริ่มต้นของ Claude Code บนแพ็กเกจ Pro, Max และ Team ให้ใช้ระบบจำแนกอัตโนมัติ (auto mode) กรองคำสั่งแทนการถามทุกครั้ง มีผลกับ session ใหม่ตั้งแต่ 14 ส.ค. 2026 ส่วนคนที่เคยตั้งค่าเริ่มต้นของตัวเองไว้จะไม่ถูกเปลี่ยนให้อัตโนมัติ พร้อมเขียนกำกับไว้เองว่าวิธีนี้ยังพึ่งระบบจำแนกอัตโนมัติ จึงไม่ได้ตัดความเสี่ยงให้เป็นศูนย์ จุดที่ต้องระวังเวลาอ้างตัวเลขชุดนี้คือห้ามเอางาน 40,000 รอบของ Wauters กับงาน 1,053 คนของ Anthropic มาบวกหรือเทียบตรงๆ กัน เพราะเป็นคนละงาน คนละวิธีวัด คนละบริษัท และตัวเกมของ Wauters เองก็เตือนไว้ว่าสัดส่วนคำสั่งอันตรายในเกม (ราว 34%) สูงกว่าที่เจอในงานจริงมาก ตัวเลขจึงบอกทิศทางของปัญหาได้ ไม่ใช่อัตราพลาดที่จะเกิดขึ้นจริงในทุกทีม auto mode เองก็ไม่ใช่คำตอบที่จบปัญหา นักพัฒนา Simon Willison เขียนเมื่อ 8 ส.ค. 2026 ว่าอาการล้าจากการกดยืนยันมีจริง และมองว่าการให้ระบบกรองแทนย่อมดีกว่าการให้คนกดอนุมัติทุกขั้นตอน แต่เขาตั้งข้อสังเกตว่าแพ็กเกจภายนอกที่จงใจหลอกให้ agent รันคำสั่งอันตรายโดยห่อมาในรูปขั้นตอนดึงไฟล์หรือรันเทสต์ตามปกติ เป็นกรณีที่เขาบอกว่าไม่แน่ใจว่า auto mode รูปแบบไหนจะกันได้ และระบุว่าอยากเห็นการยืนยันจากภายนอกมากกว่านี้

ตัวอย่างจากบทสนทนาจริง

หัวหน้าทีมพัฒนา: "เราตั้งให้ Claude Code ถามอนุมัติทุกคำสั่งอยู่แล้ว แบบนี้ปลอดภัยสุดแล้วใช่ไหม จะไปเปิด auto mode ทำไม"

ฝ่ายความปลอดภัยข้อมูล: "ไม่แน่ครับ Anthropic เปิดข้อมูลของตัวเองว่าผู้ใช้กดอนุมัติถึง 97% ของคำถามที่เด้งขึ้น ซึ่งชี้ว่าด่านนี้อาจกลายเป็นความเคยชินมากกว่าการตรวจจริง เพราะถามถี่เกินไปจนคนล้าและเลิกอ่าน อาการนี้เรียกว่า approval fatigue สิ่งที่ช่วยได้จริงไม่ใช่การถามทุกครั้ง แต่คือจำกัดสิทธิ์ที่ agent เข้าถึงได้ตั้งแต่ต้น แล้วเก็บการอนุมัติของคนไว้ใช้กับสิ่งที่ออกนอกขอบเขตจริงๆ เท่านั้น"

ระวังสับสนกับ

  • permission-request : permission request คือคำถามขออนุมัติครั้งหนึ่งๆ ที่เด้งขึ้นมา ส่วน approval fatigue คืออาการเสื่อมความระมัดระวังของคนที่เกิดจากการเจอคำถามแบบนั้นซ้ำๆ เป็นผลลัพธ์เชิงพฤติกรรม ไม่ใช่ตัวกลไกที่เด้งคำถามขึ้นมา
  • human-in-the-loop : เป็นแนวทางออกแบบระบบภาพกว้างที่กำหนดให้คนเข้ามาตรวจหรืออนุมัติ ส่วน approval fatigue คือข้อจำกัดเฉพาะของมนุษย์ที่ทำให้แนวทางนี้อ่อนลงเมื่อใช้บ่อยเกินไป
  • guardrails : เป็นชั้นป้องกันที่ระบบกรองเองโดยไม่ต้องพึ่งคนกดทุกครั้ง องค์กรที่เจอ approval fatigue มักแก้ด้วยการเพิ่ม guardrails หรือจำกัดขอบเขตสิทธิ์ตั้งแต่ต้น ไม่ใช่แก้ด้วยการเพิ่มจำนวนคำถามให้คนตอบ

ดูคำนี้ใน Knowledge Atlas →

■ ไม่อยากพลาดของใหม่

อ่านจบแล้วอยากตามเรื่อง AI แบบนี้ต่อทุกวัน เรามีสรุปข่าวภาษาไทยส่งทาง LINE ทุกเช้า กดเพิ่มเพื่อนไว้ได้เลย ไม่มีค่าใช้จ่าย

เพิ่มเพื่อนใน LINE →
QR เพิ่มเพื่อน LINE ของ TRAINIAC AIคอมพิวเตอร์สแกนด้วยมือถือได้เลย

AGENTS.mdComputer use