Animaとは?
Animaは、CircleStone LabsがComfy Orgと共同で開発した、2Bパラメータのテキストから画像を生成するモデルです。アニメのコンセプト、キャラクター、スタイルに重点を置き、写実的ではないさまざまなコンテンツも生成します。イラストや芸術的な画像向けのモデルであり、提供元は写実的な表現には適さないと明言しています。学習には数百万枚のアニメ画像と約80万枚のアニメ以外の芸術的な画像を使用し、合成データは使用していません。アニメに関する知識のカットオフは2025年9月です。
| 仕様 | Anima |
|---|---|
| パラメータ数 | 2B |
| モダリティ | テキストから画像 |
| テキストエンコーダー | Qwen3 0.6B base |
| VAE | Qwen-Image VAE |
| 解像度 | 512から1536ピクセル四方 |
| バージョン | Base, Aesthetic, Turbo |
| リリース日 | 2026年1月 |
| ライセンス | CircleStone Labs Non-Commercial |
Animaのバージョン
リポジトリでは3つのバリアントが提供されています。Anima-Baseは事前学習済みで追加調整を行っていないベースモデルです。柔軟性と多様性が最も高く、LoRAの学習にはこのバージョンを使用します。Anima-Aestheticは、一貫性を高め、デフォルトの画風の品質を向上させるためにファインチューニングされています。Anima-Turboは、CFG 1、8から12ステップで高速に生成するための蒸留版です。CircleStoneは、まずTurboから始めることを推奨しています。平均的にはAestheticよりわずかに劣る程度で、はるかに速く試行を重ねられるためです。
プロンプトはDanbooruの慣例に従います。タグは小文字にし、アンダースコアの代わりにスペースを使い、アーティスト名の先頭に@を付け、masterpieceやbest qualityなどの品質タグを冒頭に置きます。自然言語のキャプションも使用でき、タグとキャプションは任意の順序で組み合わせられます。提供元は、BaseとAestheticではCFG 4から5、30から50ステップを推奨しています。
Animaのハードウェア要件
画像モデルとしてはダウンロードサイズが小さめです。各拡散モデルのチェックポイントは4.18 GB、Qwen3 0.6Bテキストエンコーダーは1.19 GB、Qwen-Image VAEは0.25 GBで、一式のディスク容量は約5.6 GBです。このモデルはComfyUIでネイティブにサポートされており、512から1536ピクセル四方の画像を生成します。そのため、VRAMが8 GB以上の一般消費者向けGPUなら余裕を持って実行できます。
| ファイル | 配置先 | サイズ |
|---|---|---|
| anima-turbo-v1.0.safetensors | models/diffusion_models | 4.18 GB |
| qwen_3_06b_base.safetensors | models/text_encoders | 1.19 GB |
| qwen_image_vae.safetensors | models/vae | 0.25 GB |
Animaをローカルで実行する方法
AnimaはComfyUIでネイティブに動作します。circlestone-labs/Animaリポジトリから3つのファイルをダウンロードし、対応するComfyUIのモデルフォルダーに配置して、リポジトリ内のサンプルワークフロー画像を開きます。ComfyUIはその画像からグラフ全体を読み込みます。LoRAを学習する場合、デフォルトの画風の品質を最優先する場合、素早く試行を重ねる場合に応じて、チェックポイントをBase、Aesthetic、Turboの間で切り替えます。
併せて実行できる言語モデルについては、Atomic Chatのローカルで動作するモデルの全カタログをご覧ください。
Animaのライセンス
重みはCircleStone Labs Non-Commercial Licenseの下で提供されています。モデルの使用は非商用目的に限定され、モデル自体を商用利用するにはCircleStone Labsから別途ライセンスを取得する必要があります。このライセンスは出力の所有権を主張しないため、生成した画像は商用の制作を含むあらゆる目的に使用できます。収益が関わる環境に導入する前に、リポジトリ内のライセンスファイルを確認してください。
