【LTX2.3】IC-LoRAアウトペイントを使ってみた話①【ローカルAI】
はじめに
LTX-videoには、動画を高度に制御するIC-LoRA(In-Context LoRA)機能があります。
その機能を利用した、アウトペイント用途のLoRAが公開されています。
商用動画AIサービスではおなじみの機能のひとつですが、ローカルでははじめて、または最も性能の良い本格的なものだと思います。
※ (LLMでも同じですが)クラウドでは、自分で作ったものでない限り入力データの許諾確認が必要になりますが、完全に閉じた私的用途のローカルでは、気軽に利用できる強みがあります。



ComfyUIワークフロー

利用したモデル






流れ
外挿範囲の指定に、VAN Vace用の(切り抜き)ツールVideo Outpaintを利用します。LTXでも利用できます。
※ 画像が表示されない場合は、一度RUNして画像が表示されれば中止ボタンを押します。

ic-lora-outpaintは、真っ黒の場所をAI生成で塗りつぶすように訓練されたLoRAです。つまり、これらのツールでなくとも、何らかの方法で周りを黒で塗りつぶせばOKです。


IC-LoRAのガイド設定を経由したあと、通常の生成を行います。アップスケール手法ではなくステップの多い最終解像度1回のみで生成するため、時間がかかります。25分程度かかりました。(241フレーム・RTX5060ti・解像度928x704)

出来たもの
※ 入力動画(LTX2.3 i2vで生成)
※ アウトペイントしたもの
まとめ
音声は参照される事無く再生成されるので、全くの別モノになります。
フレーム数、FPSは変更していないので、音声はポスト処理でそのまま差し替えられます。しかし画像はピクセルパーフェクトではないので、今後はそのあたりの対策・改善を考えたいと思います。
付録
本記事で利用したComfyUIのワークフローjsonファイルを支援者様(メンバーシップ)用に添付します。参考程度にご利用ください。
ここから先は
この記事が気に入ったらチップで応援してみませんか?
