多角色生成LoRA教學|一張圖畫出兩個角色的 3 種方法(2026)
把兩個角色 LoRA 塞進同一張圖,通常會得到兩個一模一樣的人。這篇用同場景實測三種做法,並附上可以直接複製的提示詞結構。
先講結論
這件事其實只有兩條路。走 SDXL,你得靠 right: / left: 區域語法把畫布切開,再把 LoRA 權重壓到 0.65 上下,才勉強撐住兩個角色。走 DiT,也就是 Tsubaki.2,這些繞路幾乎都不用做:同樣的雙人構圖,特徵混淆明顯少很多,用一般句子描述位置就會分得開。能選的話,多角色請直接走第二條。
本篇是 PixAI LoRA 系列 Part 4。如果 LoRA 本身還不熟,建議先看 Part 1:什麼是 LoRA?,再回來看這篇會順很多。
LoRA 完整系列
多角色 LoRA 為什麼特別難
單一角色的 LoRA,現在已經算是穩定的領域了。選底模、去市集找 LoRA、把觸發詞放進提示詞、按下生成,就這樣。
兩個角色同框是另一回事。它不只是「把兩個人放進同一個場景」,而是要讓兩組不同的身分特徵不互相汙染。而且兩個角色 LoRA 會同時拉扯潛在空間(latent space)。結果通常會掉進下面三種崩壞之一。
特徵混淆
髮色互換。瞳色混在一起。其中一個角色穿上另一個人的衣服。標誌性的配件安靜地消失。
其中一個 LoRA 吃掉全場
兩個人長得一樣。「比較強」的那個 LoRA 贏了,另一個像是根本沒載入。
人數對不上
指定兩個人,跑出三個。或者只剩一個。人數標籤被悄悄蓋掉。
三種都有解法。而解法有一半以上,在你選底模的那一刻就決定了。先從那裡看起。
底模決定天花板:DiT 贏在哪裡
在你開始調提示詞之前,底模已經先把上限畫好了。多角色生成尤其明顯,這個選擇造成的差距最大。
為了實際驗證,我用三種做法跑了同一個場景:《崩壞:星穹鐵道》的兩位角色,長夜月(Evernight)和三月七(March 7th),在晴天的街角討論週末行程。制服、明亮氛圍、兩位角色的原作特徵都要保留。結果如下。
三張圖擺一起,看得出什麼
做法 A(SDXL 原樣)兩個人根本分不出來。長夜月的紅瞳、黑手套、倒問號耳環、白色燕尾外套,全部不見。兩個角色 LoRA 互相搶奪,三月七那邊的訓練壓過去,於是輸出變成「兩個穿制服的三月七」。直接掛兩個角色 LoRA 再寫一段普通提示詞,多半就是這個下場。
做法 B(SDXL + 區域提示詞 + 權重調整)改善很明顯。用上 right: / left: 語法、把 LoRA 權重降到 0.65 之後,其中一位角色開始明確地變成另一個人,服裝的區隔也拉出來了。只是髮色還不夠準,特徵混淆仍在。這差不多就是 SDXL 能到的極限。
做法 C(Tsubaki.2 DiT)明顯是另一個層級。長夜月的紅瞳重現了,黑色髮飾留著,三月七的藍瞳也照舊。兩人被畫成不同的人,互動自然。而且完全沒有用 right: / left:,只是用句子把畫面描述出來而已。
「DiT 架構在模型層級就把多角色構圖處理掉了。SDXL 時代需要的那些繞路,大部分都不必再做。」
那什麼時候還是得用 SDXL
看完比較,留在 SDXL 還是有一個站得住腳的理由:角色 LoRA 的數量與涵蓋面。SDXL 生態走得久,冷門遊戲和動畫的角色 LoRA,絕大多數是在 Illustrious、NoobAI 這類 SDXL 系底模上訓練的。你想畫的角色如果只有 SDXL 版 LoRA,那就得走這條路。
所以兩條路這篇都會講。第 3 節是 SDXL 的區域提示詞,第 5 節是比較單純的 DiT 流程。看你手上的角色 LoRA 在哪一邊,挑對應的看就好。
PixAI 的模型陣容與適用場景,可參考 Tsubaki.2 完整指南。
區域提示詞 + LoRA 的組合公式(SDXL 路線)
走 SDXL 的話,區域提示詞是最可靠的手法。原理很單純:把畫布切成命名區塊,角色描述只寫在自己的區塊裡。模型就會把各自的描述套用到對應區域,特徵混淆大幅下降。
這套基本語法原本是 PixAI 社群創作者 ATone 為 BL/耽美題材整理出來的,完整版在 BL/耽美圖完整指南。下面是針對多角色 LoRA 調過的版本。
基本結構
多角色 LoRA 提示詞範本
# 全域區塊:套用到整張圖
2girls, [場景描述], [角色 A] at right, [角色 B] at left,
<lora:character_A_lora:0.65>, <lora:character_B_lora:0.65>
# 右側區域:只給角色 A
right: [角色 A 的觸發詞], [A 的特徵], [A 的動作]
# 左側區域:只給角色 B
left: [角色 B 的觸發詞], [B 的特徵], [B 的動作]
跟單一 LoRA 不同的三件事
LoRA 權重從 1.0 降到 0.6~0.7
兩個角色 LoRA 同時滿強度,會在潛在空間互相衝突,其中一個就被抹掉。兩邊都降下來,才留得出共存的空間。先用 0.65 跑,再以 ±0.05 微調。權重的運作方式在 Part 2:LoRA 權重設定 有完整說明。
觸發詞放進對應的區域區塊裡
不要把兩個角色的觸發詞一起丟到全域提示詞。那樣兩個 LoRA 都會作用在整張圖上。每個觸發詞只綁一邊。觸發詞該放在哪,可參考 Part 3:觸發詞指南。
在全域區塊先宣告位置
在區域區塊之前,先告訴模型誰在哪一邊:Acheron at right, Bronya at left。空間構圖先定下來,後面的區域指定才咬得住。省掉這步,區域指定的效果會明顯變弱。
實戰技巧:負面提示詞的份量變重了
在負面提示詞加上 feature mixing, features bleeding between characters, mixed hair colors, swapped outfits。這幾個是明確告訴模型避開常見的混淆模式。
實例:讓兩個角色 LoRA 在同一張圖共存
把第 2 節做法 B 的實際提示詞拆成區塊來看。場景是長夜月和三月七在街角一起看手機聊天。
為什麼這樣寫有效,逐行拆
全域區塊一次設定場景、位置、LoRA
人數(2girls)、共同動作、背景、光線。最關鍵的是位置宣告(Evernight at right, March 7th at left),它是後面區域指定能生效的地基。
兩個 LoRA 都給 0.65,不是 1.0
各給 1.0 就變成潛在空間的主導權之爭。0.65 讓兩邊都留得住自己的訓練成果。跑幾次之後如果覺得某一邊還是弱,就把那個 LoRA 拉到 0.7、另一邊降到 0.6 找平衡。
右側區域鎖住長夜月的身分
觸發詞(Evernight (Honkai: Star Rail))只放在這個區塊裡。再補上標誌性特徵(紅瞳、黑手套、倒問號耳環)當視覺錨點,LoRA 比較容易照訓練結果輸出。
左側區域把三月七留在另一邊
同樣的邏輯套到對面。她的觸發詞只寫在左側區塊,視覺描述(藍瞳、纖細身形、明亮表情)也關在這個區域裡,長夜月那邊就沒有被侵入的縫隙。
DiT 路線:自然語言取代區域語法
用 Tsubaki.2 的話,流程會整個改變,而且簡單很多。不用 right: / left: 語法,不用調權重平衡。很多時候連角色 LoRA 都可以不掛,Tsubaki.2 光靠自然語言就認得出不少熱門角色。
來看第 2 節做法 C 用的提示詞。同一個場景、同樣兩個角色,寫法完全不同。
跟 SDXL 不一樣的三個寫法
寫敘述句,不是列標籤
Tsubaki.2 是用自然語言訓練的。「一位紅瞳、穿黑裙的少女」的結果會比 1girl, red eyes, black skirt 更好。
「On the right/On the left」寫進句子裡
把空間配置當成句子的一部分寫出來。不需要 right: / left:,DiT 讀得懂句中的方位描述。
很多時候角色 LoRA 可以省掉
Tsubaki.2 認得出熱門遊戲和動畫角色。先不掛 LoRA 跑一次,準度不夠再補上去,比較省事。
實戰技巧:把提示詞助手打開
PixAI 的提示詞助手(Prompt Helper)會把你輸入的內容重組成適合 Tsubaki.2 的形式。生成後在「生成記錄」面板可以看到它改成什麼樣子,這是最快學會 DiT 偏好句構的方法。想再深入,看 DiT 模型提示詞撰寫指南。
角色 LoRA 疊加最常卡住的 4 個地方
就算模型和結構都挑對了,多角色還是會冒出單一角色不會遇到的問題。這四個最常見,連解法一起列。
狀況 01
「第二個角色不見了」
症狀:主導的那個角色變成兩個,另一個 LoRA 被無視。
解法:兩邊權重都降到 0.6,再把弱的那邊拉回 0.7。在消失角色的區域區塊補上更強的視覺錨點,例如標誌性服裝或特殊配件。
狀況 02
「明明指定兩個,跑出三個」
症狀:人數標籤被蓋掉,也就是俗稱的「多出一具身體」。
解法:在提示詞裡強化 2girls,負面加上 3girls, multiple girls, crowd。SDXL 上如果一直重現,有可能是 LoRA 本身被多角色資料過擬合,換一個 LoRA 常常就好了。
狀況 03
「兩個都變成女生,或都被畫得太小」
症狀:SDXL 的訓練偏誤壓過其中一邊的提示詞。
解法:強指令(2boys、male focus, tall male)搭配積極的負面(1girl, feminine, female)。要成年角色就加 mature, adult,並把 child, young 丟進負面。
狀況 04
「互動很僵,像罰站」
症狀:角色分離得很乾淨,但變成兩個人並排站著,沒有互動。
解法:在全域區塊加明確的互動標籤:looking at each other, eye contact, holding hands, sharing a phone。DiT 就直接用句子描述動作,例如「勾著手臂走路」、「把手機螢幕轉給朋友看」。
角色 LoRA 以外的疊加(例如搭配風格 LoRA),請看 LoRA 疊加實戰指南。
想畫三個人以上的時候
目前可靠的上限是兩個人。到三個以上,連 Tsubaki.2 都會開始出現看得見的混淆,SDXL 的區域指定則會更早就崩掉。
如果非要三人場景不可,依效果排序,實際可行的選項有這幾個。
先用 Tsubaki.2 跑,容忍一定程度的混淆
三人構圖下,Tsubaki.2 仍是現階段比較好的選擇。可能會有一位角色的特徵變淡,但稍微修一下,通常就能到可以發表的程度。
角色分開生成,之後再合成
每個角色用透明背景或單純背景分開生成,再合進同一個場景。可以用 PixAI Edit Pro 或外部工具。工序變多,但一致性會明顯提升。
用 Reference Pro 把第三個人加進去
先把兩個人一起生成好,再用 Reference Pro 以自然語言把第三個角色加進既有畫面。可以在保留前兩人特徵的前提下,追加新角色。
「用合成不是妥協。社群裡完成度最高的那批多角色作品,很多都是先用 AI 打好大架構,再用手工補 AI 不擅長的部分。」
常見問題
可以同時掛三個以上的角色 LoRA 嗎?
技術上可以,PixAI 允許多個 LoRA 欄位。但實務上超過兩個,品質會掉得很快。三個角色 LoRA 疊在同一張圖,就算是 Tsubaki.2 也幾乎一定會出現看得見的混淆。三個人以上,第 7 節的手動合成穩定得多。
單一角色時不用降權重,為什麼多角色要降?
角色 LoRA 開到權重 1.0 時,它會把潛在空間佔到「強迫整張圖都帶上這個角色特徵」的程度。兩個 LoRA 都 1.0,這種強迫就會對撞,強的贏。兩邊都降到 0.65 上下,各自只在局部生效、不會吃掉全場。背後的原理在 Part 2:LoRA 權重設定 有完整推導。
SDXL 訓練的角色 LoRA 可以拿到 Tsubaki.2 用嗎?
不行。LoRA 綁定底模。Illustrious 上訓練的 LoRA 在 Tsubaki.2 不會正常運作,反過來也一樣。想要的角色只有 SDXL 版時,你有三個選項:(a) 用 SDXL 加區域提示詞硬幹;(b) 先試試 Tsubaki.2 能不能純靠文字描述畫出來(熱門角色機率不低);(c) 自己訓練 DiT 版 LoRA,做法看 DiT LoRA 訓練指南。
兩個角色設定上就很像(姊妹、複製人)怎麼辦?
可能有點反直覺,這種情況更難。角色之間的視覺對比越少,模型越容易把兩人混在一起。髮色或服裝共通時,就要把其他差異拉出來:表情、配件、姿勢、髮型,都明確寫進提示詞。像是「留長髮的姊姊、綁雙馬尾的妹妹」這樣。
多角色大概要跑幾次才會出好圖?
比單一角色多。一個場景抓 4 到 8 次比較實際,一邊微調 Seed 和提示詞一邊跑。第一次就中的情況幾乎沒有。把首次輸出當成「看哪裡要修」的除錯素材,再依結果調整。其他人第一手的使用感受可以看 Tsubaki.2 使用心得。
帶走這幾條就好
多角色生成速查表
✓ 多角色用 Tsubaki.2(DiT)最順
✓ SDXL 走 right:/left: 區域區塊 + 權重 0.65
✓ 觸發詞只放在自己的區域區塊裡
✓ 把混淆相關的字詞寫進負面提示詞
✓ 三人以上:接受混淆,或改用手動合成
自己跑一次雙角色,差別最有感
在 PixAI 打開 Tsubaki.2,把這篇的雙角色提示詞貼進去就能看出差異。每天都有免費點數,夠你換好幾組 Seed 慢慢試。
免綁信用卡 · 每日免費點數 · 可商用
