ระบบจริงอาจได้รับค่าหมวดหมู่ที่ไม่เคยปรากฏในชุดฝึก ควรออกแบบขั้นตอนแปลงข้อมูลอย่างไร

แทนค่าที่ไม่รู้ด้วยหมวดที่พบบ่อยที่สุด โดยไม่ติดตามอัตราการเกิด
ปรับ encoder ใหม่จากข้อมูลจริงทุกครั้งก่อนทำนายแต่ละระเบียน
ตัดระเบียนที่มีหมวดใหม่ออกทั้งหมด โดยไม่รายงานจำนวนที่ถูกตัด
กำหนดวิธีรองรับ unknown category ไว้ใน encoder และทดสอบกรณีดังกล่าวก่อนใช้

เฉลยอธิบาย

AI RMF 1.0 pp. 23, 28, 32-38 สนับสนุนหลักว่า กรอบ NIST กำหนดให้ตรวจ representativeness, bias, data quality, ผลกระทบแยกกลุ่ม และติดตามความเสี่ยงหลังใช้งานพร้อมกลไกรับ feedback ดังนั้นคำตอบที่ตรงที่สุดคือ “กำหนดวิธีรองรับ unknown category ไว้ใน encoder และทดสอบกรณีดังกล่าวก่อนใช้”

ข้อสอบอื่นในวิชาวิทยาการข้อมูล (Data Science)

ดูข้อสอบวิชานี้ทั้งหมด →