← 返回知識庫刷題首頁
P1 · 應會

AI 基礎初級中級

多模態圖像描述

是什麼

圖像描述需要把影像特徵與語言模型結合,使生成文字能以圖片內容為條件。

解決什麼問題

這題考如何把題幹線索與多模態圖像描述的定義、功能或適用情境正確配對。

考場 Trigger

  • 輸入影像、輸出文字描述 → 視覺編碼+語言生成的多模態設計

初級深度

掌握主要用途、考試線索與必要邊界即可。

中級深度

中級的要求與初級相同:中級只順帶考多模態模型遇到模態缺失時,應訓練能感知並適應缺失的模型,而不是填零、硬補或丟棄樣本。

Official Evidence

官方題目正在怎麼考

2 官方題2 考綱節點