跳到主要內容
115-3 科目二考古題依梯次與科目瀏覽
39

開源模型部署的安全防護做法

在將開源的大語言模型應用於實際商業產品時,為降低模型產生敏感或不當內容的風險,下列哪一項安全防護措施最為合理且可行?

請選擇一個答案

答案 D

核心概念

開源模型上線前後都要有獨立的護欄,攔有害輸入、擋不當輸出。 想像餐廳用了別人做好的食材,你還是要在進貨時檢查、出菜前試味道,不能因為供應商說「已經檢驗過」就免檢。 開源模型也一樣:出廠的安全對齊(Safety Alignment)只是基礎,產品端要在模型前後部署獨立的安全防護網(Guardrails),輸入端攔惡意提示,輸出端過濾不當內容,有問題就阻斷或拒答。

本題詳解提到同卷第 7 題。

答題技巧

快速判斷技巧:模型安全題選「獨立護欄(Guardrails)、即時攔截」,講「無須監控」「徹底」「零風險」的排除。 ・前後端護欄、攔截、拒答 → 正解 ・信任出廠對齊不監控 → 把風險交給運氣 ・關鍵字全擋、每筆人工審 → 做不到或不可行

易錯陷阱:(C) 人工全審看起來最安全。 關鍵差異:題目問「合理且可行」,全審不可行;護欄是可行的自動化防線,本卷第 7 題也用同一個概念。