某市政府建置智慧城市巡檢系統,希望利用路面監視器影像,自動分析道路、人行道及綠地等公共設施的分布情形,並進一步統計各類設施受損區域所占面積,以作為維護決策的依據。系統需將影像中的每個像素標示其所屬類別。請問最適合採用下列哪一種電腦視覺技術?
答案 (A)
核心概念
要「每個像素都標類別」還要「算面積」,就是影像分割。
電腦視覺四種常見任務,差在輸出的精細程度:
・影像分類(Image Classification):整張圖一個標籤
・物件偵測(Object Detection):框出物件位置,給方框加標籤
・影像分割(Image Segmentation):每個像素都標類別,能畫出精確輪廓
・人臉辨識(Face Recognition):認出是誰
題幹要統計受損區域「所占面積」,方框算不準面積,只有逐像素的分割算得出來。
本題詳解提到同卷第 41 題。
答題技巧
快速判斷技巧:「每個像素」加「面積」,答案是影像分割(Image Segmentation)。 ・整張圖一個答案 → 影像分類(Image Classification) ・框出位置 → 物件偵測(Object Detection) ・逐像素、算面積 → 影像分割
易錯陷阱:(C) 物件偵測也能「找出道路在哪」,容易覺得夠用。 關鍵差異:方框是長方形,受損區域有各種形狀,要算面積只能靠分割。 本卷第 41 題選物件偵測,第 37 題選影像分割,差別就在要不要算面積。