LTX-2.3でリップシンク動画を生成(男女の会話編)
以前登場した、架空の俺と、架空の俺の嫁を、ChatGPTで二人並んだ画像にしてもらいました。
今回は、二人に会話させてみました。

ChatGPTで、このようにして二人並んだ画像を作ってもらいました。

以前の記事に添付した、ComfyUIのLTX-2.3 I2V(Image to Video、画像から動画)ワークフローを使用し、設定を変えて生成しました。
画面サイズ1280x960、10秒の動画です。
width: 1280
height: 960
length: 241
fps: 24
ノイズシード: 707980783957767
生成後の制御: fixed
プロンプトエンハンサーは無効に(バイパス)しています。
プロンプトのサンプルです。
“”(全角ダブルクォーテーション)の間にセリフを入れます。
架空の俺が架空の俺の嫁に話しかけ、架空の俺の嫁が架空の俺に答える会話の例です。
もとい、男性が女性に話しかけ、女性が答える会話の例です。
男性と女性の順番を入れ替えれば、女性が男性に話しかけ、男性が答える会話になります。
「?」マークや「!」をつけると、感情がこもった風になります。
A 20-year-old Japanese woman and a 20-year-old Japanese man are smiling.
He speaks to the woman, he slowly says in a calm voice, “〇〇〇、△△△、〇〇〇?”
She speaks to the man, she slowly says in a sweet voice, “〇〇〇?△△△!”なにわろとんねん
