SDXLのモデルをやめた——Stable Diffusion一筋だった俺がComfyUI×Animaに切り替えた話
はじめに
長らくStable Diffusion(A1111)とSDXL系モデルを使ってきた。
使い慣れたUIで、プロンプトの書き方も体に染み込んでいる。
「別に困ってないし、今さら乗り換える理由もないか」——そう思っていた。
そこに飛び込んできたのがAnimaだ。
ComfyUIと共同開発、「アニメ系でSDXL超え」という触れ込み。
正直半信半疑だったが、試してみたら思いのほか刺さったので記録しておく。
そもそもAnimaって何?
AnimaはComfyUI開発チームとcirclestone labsが共同開発したアニメ特化の画像生成モデル。
従来のSDXL系とはアーキテクチャからして違う。
テキストエンコーダーに**Qwen(中国発の大規模言語モデル)**を採用しており、プロンプト理解力が高い。VAEも専用品を使う構成になっている。
モデルファイルは3点セット構成で、HuggingFace(circlestone-labs/Anima)から無料で落とせる。
A1111との一番の違い:プロンプトが「別物」になる
これが乗り換えで最初に直面した壁だった。
A1111のプロンプトをそのままAnimaに持ち込んだら、品質が著しく落ちた。
A1111とComfyUIではプロンプトの処理が根本的に異なる。長年育ててきたプロンプト資産は「参考」にとどめて、Anima用に一から書き直す必要がある。
具体的に何が違うのか、何をどう書き直すべきかは後述の有料パートで詳しく解説する。
また、画質についてはSDXLより一段上に感じた。
特にアニメ系の顔・髪・肌の質感。「それっぽい絵」ではなく「ちゃんとした絵」が出る確率が上がった。
プロンプトへの素直さも高い。Qwenのテキスト理解力のおかげか、長めのプロンプトでも意図が通りやすい。
この記事で書いていること(有料パート概要)
セットアップ手順:モデルの配置からComfyUIのノード構成まで
A1111プロンプトとの具体的な違い:ウェイト、LoRA構文、タグの使い方
推奨パラメータ一覧:Steps・CFG・Sampler・解像度
実際に使ったプロンプトと所感
SDXLから乗り換える価値があるかの正直な評価
ここから先は
¥ 300
この記事が気に入ったらチップで応援してみませんか?
