下列何者並非我國數位發展部 AI 產品與評測中心在評估大型語言模型安全性時,所指出的常見使用指標?
答案 (A) ※本題要選的是敘述有誤/不符合的那一個
核心概念
評估大型語言模型的「安全性」,關心的是模型輸出可能造成的危害風險。
想像你要判斷一個外送員可不可靠。你會問他會不會亂講、會不會看人臉色差別待遇、會不會拿你的東西去做壞事。你不會問他背的保溫箱結構多複雜。前三個是風險,最後那個只是規格。
常見面向包括:
・會不會胡說八道(事實正確性/幻覺)
・會不會歧視特定族群(偏見與歧視)
・會不會被拿去做壞事或產生有害內容(惡意與濫用可能性)
・以及隱私外洩、有害言論等
這些指標的共同點是。都在衡量「輸出對人的風險」。
答題技巧
快速判斷技巧:先圈「並非」。接著用一句話判斷: 這個指標是在衡量「輸出會不會傷害到人」嗎?(B)(C)(D) 都是,(A) 講的是資料本身的性質,不是輸出風險,答案就是它。
易錯陷阱:這題與第 23 題是同一組考點(數位發展部評測中心),建議一起記。 共通判準是。評測構面談的是風險與信任(正確、公平、安全、隱私、當責),凡是描述技術難度、系統效能或使用者體驗的,都不在名單上。