Anima-3.8B:搭载 Qwen3.5 4B 与 ComfyUI 节点的 52 层动漫模型
ComfyUI Wikinews
lylogummy 发布 Anima-3.8B Pro52 / Qwen3.5 Edition,一款以 Anima 视觉风格搭配 Qwen3.5 4B 语言理解的 52 层动漫 DiT,并提供专用 ComfyUI 节点。
Anima-3.8B("Pro52 / Qwen3.5 Edition")是 lylogummy 发布的一款社区模型,它在 52 层 DiT 和 Qwen3.5 4B 文本编码器的基础上重建了 Anima 动漫模型,让 Anima 视觉风格拥有更强的自然语言理解能力(Hugging Face)。
Anima-3.8B 发布中的多角色对比图
发布内容
仓库提供三个模型文件以及一个现成的两阶段工作流:
Anima-3.8B.safetensors— 52 层扩散模型,放入ComfyUI/models/diffusion_models/qwen35_4b.safetensors— Qwen3.5 4B 文本编码器,放入ComfyUI/models/text_encoders/Anima-3.8B-expanded_adapter.safetensors— 渐进式交叉适配器,将 Qwen3.5 条件与原生 Anima 条件融合workflow_2_pass.json— 两阶段工作流,高分辨率阶段使用原生 CLIP 条件以避免伪影
ComfyUI 使用方法
Anima-3.8B 通过专用的 comfyui-anima-3-8B 自定义节点使用(另有 forge-anima-3.8B 移植版):
- 将
comfyui-anima-3-8B克隆到ComfyUI/custom_nodes/并安装依赖。 - 使用 AnimaQwen35Loader 加载
qwen35_4b.safetensors,再用 AnimaQwen35UnifiedPrompt 组合 Qwen3.5 模型、原生 Anima CLIP 与适配器来构建条件。 - 推荐起点为 832x1216(或其他任意 1MP 分辨率),适配器强度 1.0,CFG 7-8,28-50 步并使用 Beta 调度器。
提示词格式将 Danbooru 风格标签与 Description: 自然语言段落结合,多角色场景中每个主体应单独成句以保持区分。由于模型在低分辨率下训练,第二阶段的高分辨率采样建议使用原生 CLIP 条件。
评论
使用 GitHub 登录后即可参与讨论。