跳到主要內容
115-3 科目一考古題依梯次與科目瀏覽
6

圖靈測試能評估的能力範圍

某壽險公司 AI 客服助理上線後進行測試。顧客與 AI 助理對話時,全程未察覺對方並非真人,回應自然且能適當安撫顧客情緒。然而,當顧客詢問「我同時符合兩項理賠條件,應優先申請哪一項?」時,AI 助理前後提供不同建議;進一步詢問原因時,也無法說明判斷依據,只能持續提供語意通順但未能回答問題的內容。技術主管認為,既然 AI 已具備足以讓人誤認為真人的對話能力,就代表其判斷結果值得信賴。依據圖靈測試(Turing Test)的設計理念,下列何者最適合評估上述技術主管的觀點?

請選擇一個答案

答案 D

核心概念

圖靈測試(Turing Test)只測「像不像人在講話」,不測「講得對不對」。 圖靈測試的設計是讓人跟機器隔著文字對話,如果分不出對方是機器,就算通過。它評估的是對話表現,跟專業判斷可不可靠、答案對不對、能不能說明理由都無關。 題目裡的 AI 客服正好示範了這個落差:對話自然到讓人誤認為真人,卻給不出一致的理賠建議,也說不出判斷依據。

答題技巧

快速判斷技巧:圖靈測試(Turing Test)只測對話表現,其他能力一律推不出來。 ・對話像不像人 → 圖靈測試能評估 ・判斷對不對、能不能解釋 → 圖靈測試評估不了

易錯陷阱:(C) 容易誤選,因為題幹描述 AI 答案前後不一致,讓人以為這是測試要抓的。 關鍵差異:不一致是題目用來凸顯「對話通過、判斷不可靠」的情境,測試本身不管正確性。 警訊詞:「通過測試即可推論」這種擴大解釋,就是要被否定的觀點。