跳到主要內容
115-3 科目一考古題依梯次與科目瀏覽
29

交叉驗證結果可重現的做法

某保險公司建置理賠風險預測模型,主管要求模型驗證流程需具備可重現性,以符合模型治理與稽核要求。若模型驗證採用包含隨機資料切分的 k-fold 交叉驗證,下列何者最能確保每次執行時樣本分割結果一致?

請選擇一個答案

答案 B

核心概念

隨機切分要每次一樣,就把隨機數種子固定下來。 k-fold 交叉驗證的切分是隨機的,每次執行結果都不同,稽核就沒辦法重現。電腦的「隨機」其實是由一個種子(Random Seed)算出來的亂數序列,種子固定,序列就固定,切分結果也就完全一樣。這是模型治理裡「可重現性」最基本的做法。

答題技巧

快速判斷技巧:「可重現」「每次結果一致」,答案就是固定隨機數種子(Random Seed)。 ・要重現隨機過程 → 固定種子 ・要評估更穩定 → 多次重複取平均 ・要評估更細 → 提高 k 值

易錯陷阱:(D) 取平均聽起來很嚴謹,容易被「稽核」兩個字帶著走。 關鍵差異:平均是把不一致「攤平」,題目要的是根本不會不一致。