← 返回知識庫刷題首頁
P1 · 應會

AI 基礎

多模態圖像描述

是什麼

圖像描述需要把影像特徵與語言模型結合,使生成文字能以圖片內容為條件。

解決什麼問題

這題考如何把題幹線索與多模態圖像描述的定義、功能或適用情境正確配對。

考場 Trigger

  • 輸入影像、輸出文字描述 → 視覺編碼+語言生成的多模態設計

初級深度

掌握主要用途、考試線索與必要邊界即可。

Official Evidence

官方題目正在怎麼考

1 官方題1 考綱節點
練習這個 Concept(1 題)