AI 背景怎麼做?PixAI 桌布、VTuber、遊戲背景教學
AI 背景和角色圖的提示詞邏輯不同。三條基本規則,加上 VTuber 直播、視覺小說、電影感場景各自的做法。
PixAI/背景製作指南
背景提示詞跑不出想要的結果,原因通常只有一個:模型還以為你要畫角色。你寫「沒有人的教室」,它給你一間教室,裡面坐著一個女生。背景和角色圖的提示詞邏輯本來就不一樣,只要把底下三條規則抓穩,剩下的都只是換道具而已。
這篇會從能直接當桌布的平塗圖樣背景,講到 VTuber 直播和視覺小說要用的 AI 背景,最後到有景深的電影感場景。所有提示詞都可以複製後直接使用。
PART ONE — 三條基本規則
乾淨的背景都靠這三條規則
複雜的先放一邊。成品好不好,八成取決於這三條,少掉任何一條,畫面通常就開始亂。
| 規則 | 要加什麼 | 解決什麼 |
|---|---|---|
| 1. 先清場 | no humans / no people | 模型不會自己塞角色進來 |
| 2. 定調畫風 | flat、flat color、no lineart | 從有陰影的插畫變成平塗圖形 |
| 3. 清掉剩下的 | 負面提示詞 | 去掉浮水印、模糊、亂入的人影 |
規則一:先告訴模型「這裡沒有人」
no human,沒有人會走進畫面。背景提示詞裡最有效的一個字是 no humans 或 no people。動漫系底模的訓練資料裡角色圖佔絕大多數,只寫地點的話,它會讀成「這個地點+一個人」。
放在最前面。這張圖能不能當素材用,多半在這裡就決定了。這個偏好是怎麼來的,可以看AI 為什麼預設都在畫女生。
規則二:想要平面感就加 flat
想要那種色塊乾淨、像海報的質感,就加 flat。如果要一次做一整組風格一致的圖,用平塗色系的 LoRA 會比單靠標籤穩。第一次接觸 LoRA 的話,先看LoRA 使用指南,強度怎麼抓可以參考LoRA 疊加實戰。平塗類的權重通常要比角色 LoRA 再低一點。
同一個題材,差三個標籤就變成兩種素材。
no human, bubble background, colorful soap bubbles floating, iridescent spheres, dreamy atmosphere
no human, bubble background, colorful soap bubbles floating, iridescent spheres, dreamy atmosphere, flat, flat color, no lineart
※ 提示詞維持英文標籤直接貼上最保險。想用中文句子寫的話,選原生支援自然語言的 Tsubaki.2(後面會講)。
規則三:剩下的交給負面提示詞
提示詞負責「我要什麼」,負面提示詞負責「講了還是會冒出來的東西」。做背景的話,三類就差不多夠了。
- 人物類:
1girl, 1boy, people, human, crowd - 雜訊類:
blurry, low quality, text, watermark - 曝光類:
overexposed, underexposed, distorted
一組每張背景都能重複用的負面提示詞:
1girl, 1boy, people, blurry, low quality, text, watermark, overexposed, underexposed, distorted
存成預設值比較省事,這串你會貼上幾十次。
到這裡底子就打完了。提示詞本身的組裝順序,可以接著看PixAI 提示詞六段公式。
三組可以直接拿走的圖樣背景
結構單純、好量產,拿來當手機桌布或直播疊圖都合用。點開就有提示詞。
點點
no humans, dotted background, flat color, no lineart
水果印花
no humans, strawberry background, anime style, print, flat
愛心
no humans, heart pattern background, many small hearts scattered, repeating heart motif, pink and red hearts floating, print, flat color, no lineart
PART TWO — 依用途分開做
從用途回推的 AI 背景
桌布怎麼做都行。但直播背景得待在立繪後面不搶戲,視覺小說的背景下面三分之一還會壓一個對話框。條件不同,寫法就不同。
VTuber 直播背景
技巧一:把鏡頭位置寫出來
角色會坐在哪裡沒定下來,透視就定不下來。只寫「可愛的臥室」,是從哪個角度看的臥室就丟給模型決定了。直接指定視角:
soft pink kawaii bedroom from desk chair perspective, over-the-shoulder view angle, empty pink gaming chair in foreground
這裡真正在做事的是鏡頭位置,不是那些形容詞。
技巧二:數一下椅子
only 1 chair 之後。房間裡椅子散落一地,是 VTuber 背景最常見的失敗。加一句 only 1 chair 幾乎就能擋掉。解法直白成這樣,說實話有點掃興。
技巧三:借專門的 LoRA
在市集搜尋「VTuber background」,會找到專門用直播場景訓練的 LoRA。家具怎麼擺、燈光暖到什麼程度,這些通用提示詞不好寫的部分可以交給它。
- Vtuber background maker — 整間房規模的直播場景
- Vtuber room — 低權重疊上去做變化
底模用 Otome V2 很搭,偏柔、低飽和、浪漫感,剛好對上可愛系直播房的調性。同一系列的其他底模整理在SDXL 動漫模型指南。如果連立繪也要自己做,OC/VTuber 角色設定表指南可以接著看,想整個房間交給工具的話還有 VTuber Generator。
視覺小說與換裝遊戲背景
這裡規則反過來,資訊越少越好。背景是舞台,畫越滿就越會跟立繪和介面打架。提示詞列幾樣道具就夠了。
no people, living room, sofa, coffee table, books, plants, empty scene
四樣道具,提示詞就這樣而已。
換掉道具清單,就變成臥室、廚房、教室、社辦。骨架每次都一樣。
另外加兩件事:想更像遊戲畫面就掛Anime Game BG 這個 LoRA,還有每一句提示詞都別漏掉 no people 或 empty scene。之後還要疊對話框的話,Galgame UI Generator 負責那一層。想先把提示詞基本功補起來,可以看SDXL 模型提示詞寫法。
戶外的做法一樣
不用只做室內。外景步驟相同:先清場,再定三、四個地標,最後指定天氣。
no human, seaside pier, wooden boardwalk, distant lighthouse, seagulls in sky, peaceful coastal scene
no human, peaceful school courtyard, cherry blossom trees, stone pathway, blue sky with soft clouds, serene atmosphere
純風景要認真量產的話,還有另一套眉角。地平線、植被、建築怎麼處理,純風景與物件生成指南講得更細。
PART THREE — 景深與氛圍
用 Tsubaki 拍出有景深的背景
桌布和舞台是一回事,另一種是角色還沒進場、故事就已經開始的那一張。這種時候比較強的是自家模型 Tsubaki。它會把前後關係當成層保留下來,而不是把構圖指令平均掉。
- 前景、中景、遠景分得開,不會壓成一片
- 光不只是亮度,還有方向和衰減
- 標籤堆疊和整句描述都吃得下
先講清楚:現在的旗艦是 Tsubaki.2,細節更細,而且原生支援包含中文在內的自然語言。改了哪些可以看 Tsubaki.2 完整介紹;DiT 系為什麼吃整句描述比吃標籤堆更好,寫在 DiT 模型提示詞指南。
同一組提示詞:Otome V2 對上 Tsubaki
兩組提示詞,兩個模型同條件跑。自己看差在哪。
no human, bright Japanese high school classroom, afternoon sunlight through windows, empty desks arranged in rows, clean minimalist style, soft lighting
no human, Anime station platform low-angle, [Foreground: empty bench with newspaper] [Back: blurred city lights], peeling timetable posters, volumetric dust in sunset light, palette: rust orange/teal/cream
注意第二組裡的中括號。Tsubaki 把長椅留在前面、城市燈光留在後面,景深的指令一路撐到最後。想把這塊做深,接著看構圖指南和電影感光影與景深。
直接把場景寫成句子就行
Tsubaki 最好用的一點,是前面那些步驟可以跳過。不用 no humans,也不用背景 LoRA,把場景寫成一段話,它就知道你要的是環境。
寫法也跟著變。不是堆標籤,而是寫幾點鐘、這個房間剛剛發生過什麼、光從哪裡進來。那些敘事脈絡會直接被當成構圖指令。想用中文直接寫的話,選原生支援自然語言的 Tsubaki.2 會更順。
CHEAT SHEET
用途對照速查
| 你要做的 | 組合 | 不能少的條件 |
|---|---|---|
| 桌布、直播疊圖、圖樣 | flat 系提示詞+平塗 LoRA | no humans / no lineart |
| VTuber 直播房 | Otome V2+VTuber 背景 LoRA | 鏡頭位置 / only 1 chair |
| 視覺小說、換裝遊戲舞台 | Anime Game BG LoRA | 道具要少 / empty scene |
| 有景深的敘事場景 | Tsubaki 或 Tsubaki.2 | 前景與遠景分開寫 |
照用途挑,不要照截圖好不好看挑。AI 背景最容易評錯的就是這點——一張漂亮到把角色吃掉的圖,當背景就是失敗品。
QUESTIONS
常見問題
背景裡老是跑出角色怎麼辦?
底模預期畫面裡要有人。把 no humans 或 no people 放到提示詞前段,負面提示詞加上 1girl, 1boy, people, human, crowd,兩邊一起用,基本上就不會再冒出來。
flat 標籤和平塗 LoRA 差在哪?
標籤只是往那個方向推,LoRA 是鎖住。只做一張的話標籤就夠。要做六張同一套直播版面的圖,用平塗色 LoRA 才不會每張跑掉。
可以拿來當電腦桌布嗎?
可以。與其做成正方形再裁切,不如一開始就用寬幅比例生成,再用 Enhance 放大。生成介面還不熟的話,先看PixAI 快速上手指南。
用 Tsubaki 還需要寫 no humans 嗎?
多半不用。把場景寫成一句話,它會判斷這張圖裡沒有角色。習慣用標籤的話照樣能跑,兩種寫法都吃。
怎麼讓一整組背景風格一致?
先把模型和 LoRA 權重固定下來,道具和光線的用詞在各組提示詞之間保持一樣,每次只換地點那個名詞。要整組鎖得更死,用 Customize Style 把同一組風格碼重複套用最快。
先記三條規則,再從圖樣那段拿一組提示詞來改,每次只動一個變數。做法就這樣。
