-
Notifications
You must be signed in to change notification settings - Fork 2
Usage
このextensionは、Krea 2 Identity Edit LoRAに必要な2つの参照経路をForge Neoの txt2imgへ追加する。
- appearance path:参照画像をclean VAE latent tokenとしてDiTへ渡す
- semantic path:編集指示と参照画像をQwen3-VLへ同時に渡す
元になったComfyUI実装は
lbouaraba/comfyui-krea2edit
である。
- Krea 2 RawまたはKrea 2 Turbo
- Krea 2用Qwen3-VL text encoder
- Krea 2用VAE
krea2_identity_edit_v1_2.safetensors
Identity Edit LoRAはForgeの通常のLoRAフォルダーへ配置する。
- Forge NeoでKrea 2 RawまたはTurboを選択する。
- txt2imgの Krea 2 Identity Edit accordionを開いて有効にする。
- **Subject reference (required)**へ編集元画像をアップロードする。
- 通常のpositive promptへ編集指示を書く。
- positive prompt内でIdentity Edit LoRAを有効にする。
- 2MP以下の解像度で生成する。
<lora:krea2_identity_edit_v1_2:1>
開始設定の目安:
| Model | Steps | CFG | 用途 |
|---|---|---|---|
| Krea 2 Turbo | 8 | 1 | 通常の編集、短時間の試行 |
| Krea 2 Raw | 約20 | 約3 | 除去など、強いprompt追従が必要な編集 |
promptには完成画像の説明だけでなく、何を維持して何を変更するかを明示する。
Keep the person's identity and facial features. Change the jacket to a dark
green coat and place the person in a softly lit train station.
<lora:krea2_identity_edit_v1_2:1>
Forge UIではsubjectを必須、sceneを任意として入力する。2参照時は学習時の順序へ合わせる ため、extension内部でscene→subjectの順に並べ替える。
| Forge UI | 役割 | RoPE frame | ComfyUI版の入力 |
|---|---|---|---|
| Subject reference(必須) | 人物/主対象 | 単一時1、2参照時2 | 単一時main、2参照時_b
|
| Scene reference(任意) | 構図/背景 | 1 |
source_image, source_latent
|
UIではSubject referenceを先に選ぶが、2参照時のDiTとQwen3-VLには
[scene, subject]の順で渡される。
Place the person from the subject reference into the provided scene. Preserve
the person's face, hair, and clothing details.
<lora:krea2_identity_edit_v1_2:1>
Scene referenceを空にすると単一参照モードになる。2人を扱う場合も、別々の生成へ分ける よりA/Bを同じsamplingへ同時に渡す方が、参照間の関係を指示しやすい。ただし顔の 分離は完全には保証されない。
Qwen3-VLへ入力する参照画像の長辺上限。既定値は768。
- 小さくする:編集指示へ追従しやすい
- 大きくする:人物のidentityや細部を拾いやすいが、VRAMと処理時間が増える
まず768を使い、顔の保持が不足するときだけ1024前後を試す。
targetからsubject referenceへのattentionを強める。
- 単一/2参照ともSubject referenceへ適用
-
1.0:無効 -
1.0より大きい:参照の外見を強く保持 -
1.0より小さい:参照から離れやすくする
1.0から始め、1.5、2.0のように少しずつ上げる。高すぎる値では編集が弱く
なったり、参照内容が出力へbleedしたりする場合がある。
任意のScene referenceへ適用する。単一参照では効果がない。既定値1.0から、sceneの
構図や背景が失われる場合だけ上げる。
Subject reference内でSubject reference boostを適用する領域を指定する。
- 白:boost対象
- 黒:boost対象外
- 判定しきい値:おおむね50%
単一/2参照とも必須のSubject referenceに対応する。これは出力画像の編集領域maskでは なく、参照画像のどの情報を強く読むかを指定するattention maskである。 参照と同じcanvas/aspect ratioのグレースケール画像を推奨する。
Qwen3-VLが参照画像の何へ注目するかを調整する上級者向け設定。空欄ではForgeの標準 image-grounding templateを保持する。
Describe facial identity, hair, clothing, body pose, lighting, and spatial
relationships precisely.
通常は空欄のまま使用する。変更するとComfyUI版や既存seedとの一致度が変わる。
すべてのmodel LoRAは[text | reference | target]の同一DiT系列へ適用される。このため、
キャラクターLoRAやstyle LoRAはtargetだけでなくreferenceの解釈にも影響し得る。
追加LoRAのtext encoder weightが参照画像を変質させる場合は、TE strengthを0にする。
<lora:krea2_identity_edit_v1_2:1>
<lora:additional_lora:te=0:unet=0.8>
te=0でもDiT側の影響は残る。追加LoRAのunet値は低い値から調整する。
- SubjectとSceneの入力欄を取り違えていないか確認する
- Subject reference boostを少し上げる
- Scene reference boostを
1.0へ戻す - prompt内で「subject referenceの人物」と明記する
- Subject reference boostを
1.0へ戻す、または下げる - Grounding resolutionを下げる
- 強い除去編集ではRaw、CFG約3、約20 stepsを試す
- Grounding resolutionを上げる
- Subject reference boostを段階的に上げる
- 追加LoRAを弱め、必要なら
te=0にする - 出力を2MP以下にする
boostはsequence全体の加算attention biasを使用する。2参照・高解像度では消費量が 大きくなる。
- 出力解像度を下げる
- boostを
1.0へ戻す - 2参照が不要なら単一参照へ戻す
- まず単一参照で構図とpromptを確認する
bundled SageAttention 1.0.6は加算attention maskを無視するため、reference boostが効かない。
webui-user.batでSageAttentionを無効化し、Forgeを再起動する。
set COMMANDLINE_ARGS=--uv --api --disable-sage起動ログでUsing PyTorch Cross Attentionを確認する。Scene referenceがない場合、Scene
reference boostは効果がない。
- txt2imgのみ
- v1.2
fitgeometryのみ - batch size 1
- Hires. fix非対応
- 最大2,000,000 output pixels
- extension固有reference入力のWeb API対応なし
- 実モデルのgolden image regressionは未整備
- SageAttention 1.0.6ではreference boost無効。
--disable-sageが必要