AI 生圖

文生圖 vs 墊圖:兩種完全不同的事

以 Alice(AI Agent 桌面應用)為例:同樣是「生成一張 Alice 在書房的圖」,有沒有參考圖,產出的品質天差地別。這是產品經理在設計生圖功能時必須搞清的第一個決策。

兩種模式,用 Alice 來看

文生圖 (Text-to-Image)

輸入:只有文字
「愛麗絲在書房看書,溫暖燈光,書架背景,藍裙白圍裙」
模型憑想像力生成
文生圖結果:愛麗絲在書房

模型按文字描述生成,但每次角色長什麼樣,全靠運氣

墊圖 (Image-to-Image)

輸入:參考圖 + 文字
Alice 角色參考圖
參考圖 + 「Alice 在書房辦公,膝上型電腦,暖色調」
以參考圖為錨點生成
墊圖結果:Alice 在書房辦公

模型根據參考圖約束外貌,Alice 每次都長一樣

核心區別:文生圖是從無到有,模型每次對 Alice 的想像都不同;墊圖是以圖為錨,參考圖鎖定了 Alice 的外貌,模型只在這個約束下變換場景和動作。
什麼場景用哪種?
場景 推薦模式 原因
純背景/環境圖 文生圖 不涉及角色,純場景描述即可
食物、物品特寫 文生圖 無需人物一致性約束
角色出鏡(Alice 做某事) 墊圖 必須保證還是 Alice,需要參考圖錨定
角色換裝 墊圖 臉不變衣服變,必須有臉部參考
多場景系列圖 墊圖 一組圖裡角色外貌需一致
創意發散/概念探索 文生圖 不需要鎖定形象,越多變越好
文生圖 = 無中生有,適合不需要一致性的場景;墊圖 = 以圖為錨,適合角色必須穩定的場景。在 Alice 這樣有固定形象的產品裡,絕大多數出圖都走墊圖,因為使用者不能接受「每次 Alice 長得不一樣」。