跳到主要內容
115-3 科目二考古題依梯次與科目瀏覽
43

對話誘導繞過限制的越獄行為

某線上教育平台的 AI 助教系統,其系統提示詞(System Prompt)規定 AI 僅能回答課程相關問題,不得提供與課程無關的內容。某學生透過多次追問、情境設計與誘導式提問,使 AI 逐漸偏離原設定,開始回答與課程完全無關的問題。整個過程中,學生僅透過與 AI 的對話內容進行互動,未利用任何外部文件、網頁或第三方內容夾帶指令。請問此案例最符合下列何種情況?

請選擇一個答案

答案 D

核心概念

只靠對話一步步誘導,讓 AI 脫離系統設定的限制,這叫越獄。 越獄(Jailbreak)是使用者透過多次追問、角色扮演、情境設計,讓模型逐漸放下系統提示詞(System Prompt)的限制。題幹特別強調「未利用任何外部文件、網頁或第三方內容夾帶指令」,就是在跟間接提示注入(本卷第 36 題)劃清界線:這次指令全在對話裡。

本題詳解提到同卷第 36 題。

答題技巧

快速判斷技巧:「多次誘導、偏離系統設定、只靠對話」,答案是越獄(Jailbreak)。 ・對話裡誘導 → 越獄 ・資料裡藏指令 → 提示注入(Prompt Injection) ・自己編內容 → 幻覺(Hallucination) ・資料流出 → 資料外洩(Data Leakage)

易錯陷阱:(B) AI 回答了不該回答的內容,有人會覺得這算「亂講」。 關鍵差異:幻覺是內容不真,越獄是行為越界,題幹的 AI 回答的內容未必錯,錯的是它不該答。 警訊詞:題幹刻意寫「未利用任何外部文件」,就是在幫你排除提示注入。