Comfy Cloud - 云端轻松访问ComfyUI
Comfy Cloud为用户提供便捷的ComfyUI云端访问,配备高性能GPU、主流模型和自定义节点。欢迎加入私测,免费体验云端ComfyUI。
ComfyUI 生态最新动态:开源模型发布、自定义节点、工作流与工具更新。
Comfy Cloud为用户提供便捷的ComfyUI云端访问,配备高性能GPU、主流模型和自定义节点。欢迎加入私测,免费体验云端ComfyUI。
图生 3D腾讯混元团队发布Voyager技术,能够从单张图片和用户定义的相机路径生成世界一致的3D点云序列视频,支持无限世界探索和直接3D重建
Open-Weights
文生图
生态工具MeiGen-AI团队开源InfiniteTalk模型,实现精准唇形同步和无限长度视频生成,支持图像到视频和视频到视频的转换,为数字人技术带来新突破。
MIT
ComfyUI 正式推出子图(Subgraph)功能,允许用户将复杂的节点组合打包成单个可重用的子图节点,大幅提升工作流的模块化和可管理性。
Qwen-Image 是 20B 参数 MMDiT 图像生成模型,主打复杂文本渲染与精细编辑,现已可在 ComfyUI 使用。本文概览其核心能力、许可与资源链接。
Open-Weights
文生图腾讯混元团队发布开源 MixGRPO 框架,首个集成滑动窗口混合 ODE-SDE 采样的 GRPO 框架,可将训练速度提升71%,适用于扩散模型和流模型的人类偏好对齐任务。
Open-Weights
Black Forest Labs 与 Krea 合作开发的 FLUX.1 Krea [dev] 模型正式开源发布,这是目前最好的开源权重 FLUX 模型。ComfyUI 已实现原生支持,用户可直接体验最新文本生成图像技术。
FLUX-1-dev-non-commercial
阿里云通义万相团队正式发布Wan2.2开源版本,采用创新的MoE架构,为视频生成带来显著质量提升。ComfyUI已实现原生支持,用户可直接体验最新视频生成技术。
Open-Weights
文生图字节跳动开源了专为翻译任务设计的Seed-X 7B模型,支持28种语言互译,方便AI图像生成等多场景集成。
Open-Weights
文生视频PUSA V1.0 通过创新的 VTA 技术,仅用极少的数据和成本,实现了高质量多任务视频生成,支持图像到视频、首尾帧生成、视频扩展、文生视频等功能。
Open-Weights
文生图AMAP 团队发布 FLUX-Text,一种基于扩散模型的场景文本编辑新方法,支持多语言、风格一致性与高保真文本编辑。
Open-Weights
OmniAvatar模型正式开源,支持音频驱动的全身虚拟人视频生成,具备自然动作与丰富表情,适用于播客、互动、动态场景等多种应用。
Open-Weights
语音合成通义实验室开源 ThinkSound,首个支持链式推理的 Any2Audio 统一音频生成与编辑框架,支持视频、文本、音频等多模态输入,具备高保真、强同步、可交互编辑能力。
Open-Weights
文生图字节跳动开源XVerse模型,实现多主体身份与语义属性(如姿态、风格、光照等)的高精度独立控制,提升AI图像生成的个性化与复杂场景表现力。
Open-Weights
Black Forest Labs 发布 Flux.1 Kontext Dev 开源版本,这是一个拥有 120 亿参数的开源扩散变压器模型,ComfyUI 已在第一时间提供原生支持
Open-Weights
多模态VectorSpaceLab发布OmniGen2,这是一个强大的多模态生成模型,支持通过自然语言指令实现精准的局部图像编辑,包括对象删除替换、风格转绘、背景处理等多种编辑任务
Open-Weights
NVIDIA 研究团队推出 UniRelight,这是一项基于扩散模型的通用重照明技术,能够仅通过单个图像或视频实现高质量的重照明效果
Open-Weights