跳到主要內容
115-3 科目二考古題依梯次與科目瀏覽
13

影像辨識加 RAG 的系統架構

某溫室農場已收集大量害蟲影像資料,並建立害蟲種類及對應防治方法的知識庫。農場希望建置一套 AI 系統,除了能辨識害蟲種類,還能依據知識庫提供最新的防治建議,並能引用知識來源作為依據,以降低生成不實資訊的風險。下列何者為最適合的系統架構?

請選擇一個答案

答案 B

核心概念

辨識歸辨識、查知識歸查知識,要引用來源又要最新,中間那段就是 RAG。 題幹三個需求:辨識害蟲(影像任務)、依知識庫給最新建議(知識會更新)、引用來源(可追溯)。拆成兩段最穩:電腦視覺模型專職辨識;辨識結果丟給檢索增強生成(RAG)去知識庫撈對應的防治方法,大型語言模型再依撈到的內容寫建議,來源自然帶得出來。

答題技巧

快速判斷技巧:「最新」加「引用來源」,一定有 RAG;「辨識影像」交給電腦視覺,兩段拼起來。 ・辨識影像 → 電腦視覺模型 ・查最新知識、附來源 → 檢索增強生成(RAG) ・寫成建議 → 大型語言模型

易錯陷阱:(A) 多模態模型很紅,「一次完成」聽起來最先進。 關鍵差異:題目要的是「引用知識來源」,沒有檢索就沒有來源可引。