T01

多模態 AI

Multimodal AI

簡短答案

能同時處理並整合多種資料類型(文字、圖像、音訊、影片)的 AI 系統。

深入解釋

多模態模型突破了單一資料型態的限制,能進行跨模態理解與生成,如圖文問答、影片描述、語音轉文字等。

實際案例

GPT-4o 能同時接受文字與圖片輸入,回答「圖片中有什麼問題?」

本頁為 AIATCL 備考用非官方內容;考試資訊請以主辦單位公告為準。