同じMioの正面図から、後ろ向きに振り返るポーズを作ってみた
目次(5 節)
第2回では、Mioの正面図をそのまま動かしてみた。静止画を作り直すなら、同じポーズをもう一度描くより、元のMioを保ったまま別のポーズにして使いたい。
今回の比較は10月1日に追加した実験で、9月28日に採用したダンスMVより後の検証だ。
そこで今回は、同じ正面図を参照にして、後ろ向きから振り返るポーズを作ってみる。体は後ろを向き、顔だけ肩越しにこちらを見る全身の絵だ。ポーズが変わったかと、顔や衣装がMioのまま残ったかを分けて見比べる。
同じ元画像から、別のポーズを指定する
元画像は第2回と同じ、Mio原案から切り出した997×1577の正面図。三つの方式へ渡す参照画像は、これを切り取らずに512×896へ収め、余白を付けた同じPNGにそろえた。
指示するポーズは全部同じ。胴体・腰・脚は後ろ向き、顔は右肩越しにこちらへ振り返り、腕は自然に下ろす。全身と耳、靴、尾を画面内に収める。金髪、緑の目、耳と尾、緑の上衣とカーゴパンツ、緑とクリーム色の靴も保つように頼んだ。
比較するのは、手元のRTX 5090で動かすIllustrious系の amanatsuIllustrious_v11 と FLUX.1-dev のFP8版、それにCodexの内蔵画像生成。三つへ、同じ参照PNGと同じ英文のポーズ・特徴保持の指示を渡した。
元の正面図には、服の背中側は描かれていない。後ろ向きにしたときの背面デザインは生成側の補完になるので、そこを「元絵と一致した」とは判定できない。
元画像と、生成した3枚




ポーズが変わるかと、Mioが残るかは別だった
今回の1枚ずつでは、内蔵画像生成は後ろ向きに振り返る姿になった。Illustrious系とFLUXは、体も顔も正面のままだった。
| 方式 | 指定した振り返りポーズ | 元画像からの主な変化 |
|---|---|---|
| Illustrious系 | 正面のまま | 顔・髪型・肌色、パンツの色、腰の結び目、靴が変化。左上にマークと文字らしきものが追加 |
| FLUX.1-dev FP8 | 正面のまま | 顔と髪が簡略化され、上衣の形が変化。腰の交差した帯が消え、右下にサインのような線が追加 |
| 内蔵画像生成 | 後ろ向きで肩越しに振り返る | 緑の上下、耳・尾、靴の大きな特徴を維持。背面の髪と衣装は補完され、顔や線の細部も変化 |
Illustrious系は、金髪や耳、緑の上衣、カーゴ型のパンツといった要素は残った。ただ、パンツは黄土色に近いオリーブ色へ変わり、腰には大きな結び目ができた。肌色や顔つき、靴も元の絵とは違っている。追加されたマークは、指示したものではない。
FLUXは緑の上下やカーゴポケット、足首の紐、尾を残した一方で、目が大きくなり、髪の線や陰影がシンプルになった。元の腰の交差した帯はなくなり、上衣の形と丈も変わっている。
内蔵画像生成は、体・腰・足が後ろを向き、顔が肩越しに見える。腰の交差した帯や靴の配色も残った。背中側に結んだ髪、背中の開き、パンツの後ろポケットは、正面資料だけでは確かめられない補完だ。ポーズの指定に従っていても、顔や衣装の細部を確認する必要はある。
今回そろえた条件と、方式の違い
手元の二つは、元画像を入力にして描き直すimg2imgを使った。大きくポーズを変えるため、描き直す強さの denoise を今回は0.8に固定した。seedは20261001。補助のキャラクターLoRA、IP-Adapter、ポーズ制御は使っていない。
| 項目 | Illustrious系 | FLUX.1-dev FP8 | 内蔵画像生成 |
|---|---|---|---|
| 参照画像・ポーズ指示 | 同じ512×896 PNG、同じ英文 | 左と同じ | 左と同じ |
| 方式 | 通常のimg2img | 通常のimg2img | 参照画像を使った編集 |
| seed / denoise | 20261001 / 0.8 | 20261001 / 0.8 | 指定・取得できず |
| steps | 32 | 28 | 取得できず |
| sampler / scheduler | euler_ancestral / normal | euler / simple | 取得できず |
| CFGなど | CFG 4.5、CLIP skip 2、negativeあり | CFG 1.0、guidance 3.2、negative空 | 取得できず |
| 出力・生成数 | 512×896、1枚 | 512×896、1枚 | 948×1659、1枚 |
同じ参照と指示でも、内部の仕組みや設定は同一ではない。手元の二つは元画像の構図を入力にしているので、今回ポーズが変わらなかった理由をモデルだけへ切り分けることはできない。0.8が最適な設定だと確かめたわけでもなく、別の設定やポーズ補助を使った結果は今回調べていない。
この比較で分かったのは、今回使った方式と設定で、同じ資料から別ポーズを頼んだときの違いだ。各1枚の結果から、モデル全体の優劣や成功率までは決められない。
次は、指定ダンスの制作過程へ
自分が使いたかったのは、同じMioを別のポーズにしても、顔や服が保たれた素材だ。今回の結果では、ポーズの指示への追従と、キャラクターの特徴保持を両方確認する必要があった。
今後投稿する第3回では、Mioに似なくなった実際の動画も並べ、元のキャラクター資料へ戻って指定ダンスを作った過程を書く。読む順番ではこの補足編の後に置くが、ダンス制作は今回の比較より先に行っている。この補足編の比較画像は、採用済みのダンスMVには使っていない。