某模型使用 K-近鄰演算法(KNN)進行分類,K 設為 3。一筆新的測試資料輸入後,與其最接近的 3 筆資料的類別如下:鄰近樣本 1:類別 A;鄰近樣本 2:類別 B;鄰近樣本 3:類別 A。請問模型會將這筆資料預測為哪一類別?
答案 (A)
核心概念
K-近鄰演算法(K-Nearest Neighbors)的分類規則非常直觀。
就是問離你最近的三個鄰居各屬於哪一國,兩票贏一票,這樣而已。
找出離新資料最近的 K 個訓練樣本,然後由這 K 個鄰居「投票」,票數最多的類別就是預測結果。這題 K=3,三個鄰居中類別 A 有 2 票、類別 B 有 1 票。
答題技巧
快速判斷技巧:KNN 計算題就是數票數。 把 K 個鄰居的類別列出來、數哪個多,答案就出來了,不要想太多。
易錯陷阱:(D) 用「距離加權」這個進階變形動搖你。 題目沒給距離數值、也沒說要加權,就代表用預設的多數決。 考場原則:題目沒提到的機制,就不要自己加進去。