โรงพยาบาลกำลังสร้างระบบคัดกรองผู้ป่วย: ทำ K-means ด้วยรายได้หน่วยแสนและจำนวนครั้งใช้บริการหน่วยหลักหน่วย ผลใดน่ากังวล
กK-means ปรับสเกลให้อัตโนมัติทุกกรณี
ขฟีเจอร์สเกลใหญ่ครอบงำระยะทาง จึงควรพิจารณา scaling และความหมายของระยะทาง
คจำนวนคลัสเตอร์จะเป็น 2 เสมอ
งไม่มีผลต่อ centroid
เฉลยอธิบาย
K-means ลดผลรวมระยะทางกำลังสอง จึงไวต่อสเกลและ outlier ตัวเลือกอื่นละเลยลำดับเวลา การแยกข้อมูล ความหมายทางสถิติ หรือผลกระทบในการใช้งานจริง แหล่งอ้างอิงทางการ: https://scikit-learn.org/stable/modules/clustering.html