AI 生圖
文生圖 vs 墊圖:兩種完全不同的事
以 Alice(AI Agent 桌面應用)為例:同樣是「生成一張 Alice 在書房的圖」,有沒有參考圖,產出的品質天差地別。這是產品經理在設計生圖功能時必須搞清的第一個決策。
兩種模式,用 Alice 來看
文生圖 (Text-to-Image)
輸入:只有文字
「愛麗絲在書房看書,溫暖燈光,書架背景,藍裙白圍裙」
模型憑想像力生成
模型按文字描述生成,但每次角色長什麼樣,全靠運氣
墊圖 (Image-to-Image)
輸入:參考圖 + 文字
參考圖 + 「Alice 在書房辦公,膝上型電腦,暖色調」
以參考圖為錨點生成
模型根據參考圖約束外貌,Alice 每次都長一樣
核心區別:文生圖是從無到有,模型每次對 Alice 的想像都不同;墊圖是以圖為錨,參考圖鎖定了 Alice 的外貌,模型只在這個約束下變換場景和動作。
什麼場景用哪種?
| 場景 | 推薦模式 | 原因 |
|---|---|---|
| 純背景/環境圖 | 文生圖 | 不涉及角色,純場景描述即可 |
| 食物、物品特寫 | 文生圖 | 無需人物一致性約束 |
| 角色出鏡(Alice 做某事) | 墊圖 | 必須保證還是 Alice,需要參考圖錨定 |
| 角色換裝 | 墊圖 | 臉不變衣服變,必須有臉部參考 |
| 多場景系列圖 | 墊圖 | 一組圖裡角色外貌需一致 |
| 創意發散/概念探索 | 文生圖 | 不需要鎖定形象,越多變越好 |
文生圖 = 無中生有,適合不需要一致性的場景;墊圖 = 以圖為錨,適合角色必須穩定的場景。在 Alice 這樣有固定形象的產品裡,絕大多數出圖都走墊圖,因為使用者不能接受「每次 Alice 長得不一樣」。