P1 · 應會
AI 基礎
多模態圖像描述
是什麼
圖像描述需要把影像特徵與語言模型結合,使生成文字能以圖片內容為條件。
解決什麼問題
這題考如何把題幹線索與多模態圖像描述的定義、功能或適用情境正確配對。
考場 Trigger
- 輸入影像、輸出文字描述 → 視覺編碼+語言生成的多模態設計
初級深度
掌握主要用途、考試線索與必要邊界即可。
AI 基礎
是什麼
圖像描述需要把影像特徵與語言模型結合,使生成文字能以圖片內容為條件。
解決什麼問題
這題考如何把題幹線索與多模態圖像描述的定義、功能或適用情境正確配對。
考場 Trigger
初級深度
掌握主要用途、考試線索與必要邊界即可。
Official Evidence