文章名詞彙編
AI 名詞一詞一篇:定義、白話比喻、易混淆對照與實際用例,配酒Ann 的圖解。
Multimodal 多模態 AI 能同時理解、處理並整合文字、圖片、語音、影片等多種類型的資訊,讓理解更全面。
2026/8/28 多模態與應用 約 4 分鐘
Gems 是 Google Gemini 讓你打造專屬 AI 智能體的功能,設定角色、知識與指令後,就能有一個量身訂做的專業助理。
2026/8/28 多模態與應用 約 3 分鐘
在 AI 回答問題前,先補充更多有用的資訊、工具或上下文,讓結果更準確、更完整、更有價值。
2026/8/28 多模態與應用 約 3 分鐘
TTS 文字轉語音把文字轉換成自然流暢、帶有情感的人聲語音,應用在有聲書、語音助理、教育學習與無障礙服務。
2026/8/28 多模態與應用 約 4 分鐘
STT 是 Speech-to-Text 語音轉文字,把語音、錄音檔或會議音訊轉成可編輯的逐字稿,支援多語言與時間戳記。
2026/8/28 多模態與應用 約 4 分鐘
GPTs 是把角色、指令、知識與行為規則打包成一個專屬 AI 助理,之後直接叫它做事,不必每次重講。
2026/8/28 多模態與應用 約 4 分鐘
用少量影片與聲音樣本,學習並複製一個人的外貌、聲音、表情與說話風格,代替本人出鏡。
2026/8/28 多模態與應用 約 4 分鐘
內容浮水印是在 AI 產出的圖片、影片、聲音或文字裡嵌入標記,讓人或系統事後能辨識這份內容出自 AI。
2026/8/16 多模態與應用 約 4 分鐘
聲音複製是用語音樣本讓 AI 學會某個人的音色與說話方式,再用那個聲音唸出全新的文字。
2026/7/30 多模態與應用 約 4 分鐘
畫幅擴展是讓 AI 根據原圖的邊緣、光線與透視,往外延伸生成合理背景的影像技術。
2026/7/29 多模態與應用 約 3 分鐘
深偽是用深度學習合成或竄改人臉、聲音與影片的技術,看起來像真的,但內容並非真實發生。
2026/6/17 多模態與應用 約 4 分鐘
ControlNet 是加在擴散模型旁的條件控制網路,用邊緣、深度或人體姿勢等條件圖鎖住構圖再生成。
2026/6/15 多模態與應用 約 3 分鐘
以圖生圖是給 AI 一張原始圖與提示詞,讓它參考構圖、姿勢或風格,改寫出一張新的圖片。
2026/5/31 多模態與應用 約 3 分鐘
電腦視覺是讓電腦看懂圖片與影片內容的技術,從像素中擷取資訊、辨識物體、理解場景並做出判斷。
2026/5/8 多模態與應用 約 4 分鐘
T2I 是輸入文字描述,讓 AI 解析主體、場景、細節、風格與光影,再從零生成一張符合描述的圖片。
2026/5/2 多模態與應用 約 4 分鐘
OCR 圖片文字辨識,是把圖片裡的文字讀出來,變成可以編輯、複製、搜尋的文字。
2026/4/2 多模態與應用 約 4 分鐘
局部重繪是把圖片中的某個範圍塗成遮罩,讓 AI 只在該區域重新生成內容,實現局部修改與無痕融合。
2026/3/14 多模態與應用 約 4 分鐘
擴散模型是現代主流繪圖 AI 的核心原理,從一堆雜訊中一步步去噪,慢慢擦出清晰的圖像。
2026/2/20 多模態與應用 約 4 分鐘