AI 生成人像時,很多人只會堆疊「美女、高清、真實、精緻」等詞彙,結果往往只是「好看」,卻缺乏真人照片的質感。有創作者分享一套實用的五層提示詞結構,強調提示詞不是堆詞,而是描述一張真人照片成立的邏輯。
一、五層提示詞結構
1. 人物身份
先確定「這個人是誰」以及畫面距離。
- 年齡、氣質、種族特徵
- 構圖與景別(近景、半身、全身)
2. 皮膚狀態
真實感來自細節,而非磨皮。
- 可見毛孔
- 輕微泛紅或膚色變化
- 唇紋、細微瑕疵
- 避免過度平滑
3. 光影關係
光從哪裡來,決定臉部是否有立體感。
- 自然窗光、側光
- 高光位置與臉頰陰影
- 避免平面打光
4. 鏡頭質感
不要只寫「高清」,要說明它像什麼設備拍的。
- 手機原相機、抓拍感
- 淺景深
- RAW 質感或特定鏡頭焦段
5. 反向限制(Negative)
提前排除不想要的效果。
- 不要磨皮
- 不要塑料皮膚
- 不要網紅臉
- 不要 CG 感
二、核心觀念
提示詞的本質是「描述真人照片成立的邏輯」:
- 這個人是誰
- 皮膚處於什麼狀態
- 光線如何打在臉上
- 鏡頭呈現什麼質感
- 哪些效果必須避免
結構清楚,遠比單純加長提示詞更有效。
三、實用建議
- 先寫清楚主體與光線,再補細節
- 皮膚描述要具體,避免「完美皮膚」
- 善用反向提示詞排除常見 AI 問題
- 可針對不同模型微調用詞(Midjourney、Flux、Stable Diffusion 等)
結語
AI 人像要看起來像真人,關鍵不在堆砌華麗形容詞,而在於用結構描述真實世界的視覺邏輯。掌握人物、皮膚、光影、鏡頭與反向限制五層,生成結果會明顯更自然、更有照片質感。