見出し画像

SDXLのモデルをやめた——Stable Diffusion一筋だった俺がComfyUI×Animaに切り替えた話

はじめに

長らくStable Diffusion(A1111)とSDXL系モデルを使ってきた。
使い慣れたUIで、プロンプトの書き方も体に染み込んでいる。
「別に困ってないし、今さら乗り換える理由もないか」——そう思っていた。

そこに飛び込んできたのがAnimaだ。

ComfyUIと共同開発、「アニメ系でSDXL超え」という触れ込み。
正直半信半疑だったが、試してみたら思いのほか刺さったので記録しておく。


そもそもAnimaって何?

AnimaはComfyUI開発チームとcirclestone labsが共同開発したアニメ特化の画像生成モデル。

従来のSDXL系とはアーキテクチャからして違う
テキストエンコーダーに**Qwen(中国発の大規模言語モデル)**を採用しており、プロンプト理解力が高い。VAEも専用品を使う構成になっている。

モデルファイルは3点セット構成で、HuggingFace(circlestone-labs/Anima)から無料で落とせる。


A1111との一番の違い:プロンプトが「別物」になる

これが乗り換えで最初に直面した壁だった。

A1111のプロンプトをそのままAnimaに持ち込んだら、品質が著しく落ちた。

A1111とComfyUIではプロンプトの処理が根本的に異なる。長年育ててきたプロンプト資産は「参考」にとどめて、Anima用に一から書き直す必要がある。

具体的に何が違うのか、何をどう書き直すべきかは後述の有料パートで詳しく解説する。

また、画質についてはSDXLより一段上に感じた。
特にアニメ系の顔・髪・肌の質感。「それっぽい絵」ではなく「ちゃんとした絵」が出る確率が上がった。

プロンプトへの素直さも高い。Qwenのテキスト理解力のおかげか、長めのプロンプトでも意図が通りやすい。


この記事で書いていること(有料パート概要)

  • セットアップ手順:モデルの配置からComfyUIのノード構成まで

  • A1111プロンプトとの具体的な違い:ウェイト、LoRA構文、タグの使い方

  • 推奨パラメータ一覧:Steps・CFG・Sampler・解像度

  • 実際に使ったプロンプトと所感

  • SDXLから乗り換える価値があるかの正直な評価

ここから先は

2,064字

¥ 300

Amazon Payで支払うと最大2%還元のチャンス! 9/30まで

この記事が気に入ったらチップで応援してみませんか?