跳到主要內容
1.1 AI 治理概念
114-4 科目 49反向題・即非安全性指標

下列何者並非我國數位發展部 AI 產品與評測中心在評估大型語言模型安全性時,所指出的常見使用指標?

請選擇一個答案

答案 A ※本題要選的是敘述有誤/不符合的那一個

核心概念

評估大型語言模型的「安全性」,關心的是模型輸出可能造成的危害風險。 想像你要判斷一個外送員可不可靠。你會問他會不會亂講、會不會看人臉色差別待遇、會不會拿你的東西去做壞事。你不會問他背的保溫箱結構多複雜。前三個是風險,最後那個只是規格。 常見面向包括: ・會不會胡說八道(事實正確性/幻覺) ・會不會歧視特定族群(偏見與歧視) ・會不會被拿去做壞事或產生有害內容(惡意與濫用可能性) ・以及隱私外洩、有害言論等 這些指標的共同點是。都在衡量「輸出對人的風險」。
答題技巧

快速判斷技巧:先圈「並非」。接著用一句話判斷: 這個指標是在衡量「輸出會不會傷害到人」嗎?(B)(C)(D) 都是,(A) 講的是資料本身的性質,不是輸出風險,答案就是它。

易錯陷阱:這題與第 23 題是同一組考點(數位發展部評測中心),建議一起記。 共通判準是。評測構面談的是風險與信任(正確、公平、安全、隱私、當責),凡是描述技術難度、系統效能或使用者體驗的,都不在名單上。