多模態與應用
Text-to-Image 文字生成圖片是什麼?用一段描述換一張圖
Text-to-Image 文字生成圖片是什麼?用一段描述換一張圖
以前要一張圖,你得會畫,或者付錢請人畫。現在你只要把腦中的畫面用文字說清楚,AI 就替你畫出來。
這件事的門檻不在工具,在你會不會描述。這篇講清楚它怎麼運作,以及怎麼寫才會準。
你將學到什麼
定義
輸入文字描述,AI 從零生成一張符合描述的圖片。
白話比喻
文字是魔法,AI 是畫筆,想像力才是真正的限制。
跟誰容易搞混
T2I 從零開始生成,I2I 是拿一張既有的圖去改。
定義
Text-to-Image(T2I,文字生成圖片)是輸入一段文字描述,讓 AI 理解你的想像,自動生成獨一無二的圖片。
常見的工具有 Midjourney、DALL·E、Stable Diffusion、Adobe Firefly、Leonardo.Ai。它們各有擅長,藝術感、可客製化程度、生態整合都不太一樣。
白話比喻
把它想成一位聽描述作畫的插畫師。你講得越具體,他畫得越接近你腦中的畫面。
你只說「畫一隻狗」,他會憑自己的習慣決定品種、姿勢與背景。你說「戴帽子的柴犬坐在草地上微笑,手繪風格」,結果就完全不同了。
它怎麼運作
- 輸入文字描述:用文字說出你想要的畫面、風格、細節與氛圍。
- AI 理解語意:解析文字中的物件、場景、風格與光線資訊。
- 生成圖片:從零開始創作,輸出符合描述的高品質圖片。
第三步背後的技術多半是 擴散模型,它從一團雜訊出發,一步步去噪,最後長成一張圖。
寫出好描述的五個要素
| 要素 | 要回答的問題 | 範例 |
|---|---|---|
| 主體 | 畫的是什麼? | 一位女孩 |
| 場景 | 在哪裡? | 在櫻花樹下散步 |
| 細節 | 怎麼樣? | 微風中花瓣飄落 |
| 風格 | 什麼風格? | 日系插畫風格 |
| 氛圍與光影 | 什麼情緒感受? | 柔和的陽光,夢幻的氛圍 |
五個都寫齊,成功率會明顯提高。這也是 畫像生成提示詞 跟聊天用的提示詞最大的不同:它重描述而不重推理。
實際用例
最常見的是社群貼文與部落格配圖、廣告與行銷素材、簡報視覺、商品與包裝模擬、遊戲與角色設計。
對一般工作者最實用的其實是概念發想。在真的花錢做設計之前,先用 T2I 把幾個方向視覺化,溝通成本會低很多。
延伸學習
知識變現切割地圖(高清版下載,不含講義)
《知識變現切割地圖》的高清完整版。一張圖把語氣、心理、內容、產品、再利用五層模組攤在同一個平面上,讓你回頭盤點已有內容、規劃新的轉化節奏。課程附上地圖本身的完整解說與應用指南,教你怎麼讀這張圖、從哪一層開始用。完整版 PDF 可下載,放大看細節不會糊。
NT$ 680
ChatGPT 很強,但真正讓你下班的是 Google
六小時完整實錄。從「AI 很厲害,為什麼你還是每天加班」這個問題出發,把 Google Workspace 當成真正的工作平台重新設計一次流程 ── Sheets 的資料結構、Drive 與 Docs 的文件流、Gmail 與 Calendar 的通知系統,再用 Apps Script 讓它自己跑起來,最後收斂成一張屬於你自己的 AI 工作能力地圖。
NT$ 4,599

