Comfy Cloud - 클라우드에서 손쉽게 ComfyUI 사용하기
Comfy Cloud는 강력한 GPU, 인기 모델, 커스텀 노드를 통해 ComfyUI에 쉽게 접근할 수 있도록 지원합니다. 무료 클라우드 기반 ComfyUI 사용을 위한 프라이빗 베타에 참여해보세요.
ComfyUI 생태계 소식 — 오픈소스 모델 릴리스, 커스텀 노드, 워크플로, 이미지·비디오·오디오 생성 도구 업데이트.
Comfy Cloud는 강력한 GPU, 인기 모델, 커스텀 노드를 통해 ComfyUI에 쉽게 접근할 수 있도록 지원합니다. 무료 클라우드 기반 ComfyUI 사용을 위한 프라이빗 베타에 참여해보세요.
이미지→3D텐센트 훈유안 팀이 보이저 기술을 공개, 단일 이미지와 사용자 정의 카메라 경로로부터 세계 일관성 있는 3D 포인트 클라우드 시퀀스 비디오를 생성 가능, 무한 세계 탐색과 직접 3D 재구성을 지원
Open-Weights
텍스트→이미지바이트댄스가 USO 모델을 공개, 임의의 주체와 임의의 스타일을 자유롭게 조합하여 주체의 일관성을 유지하면서 고품질 스타일 전이 효과를 실현
Open-Weights
Wan2.2-S2V는 정적 이미지와 오디오를 비디오로 변환할 수 있는 AI 비디오 생성 모델로, 대화, 노래, 공연 등의 콘텐츠 제작 요구를 지원합니다.
Open-Weights
생태계첫 번째 ComfyUI 주간 챌린지에 참여하고 $100 상금을 받으세요! 제공된 깊이 맵을 사용하여 고양이 남자 캐릭터를 돌리는 비디오를 만드세요.
MeiGen-AI 팀이 InfiniteTalk 모델을 오픈소스로 공개하여 정밀한 입모양 동기화와 무제한 길이 비디오 생성을 실현했습니다. 이미지-비디오 및 비디오-비디오 변환을 지원하여 디지털 휴먼 기술에 새로운 돌파구를 마련했습니다.
MIT
ComfyUI가 서브그래프 기능을 공식 출시하여 사용자가 복잡한 노드 조합을 재사용 가능한 개별 서브그래프 노드로 패키징할 수 있게 되어 워크플로우의 모듈성과 관리가 크게 향상됩니다.
Qwen-Image는 200억 매개변수 MMDiT 이미지 생성 모델로, 복잡한 텍스트 렌더링과 정밀 편집에 강점이 있습니다. 이제 ComfyUI에서 네이티브로 사용할 수 있습니다. 이 글은 핵심 기능, 라이선스, 자료 링크를 간략히 정리합니다.
Open-Weights
텍스트→이미지Tencent Hunyuan 팀이 GRPO에 슬라이딩 윈도우 혼합 ODE-SDE 샘플링을 통합한 최초의 프레임워크인 MixGRPO를 오픈소스로 출시. 확산 모델과 플로우 모델의 인간 선호도 정렬에서 최대 71%의 훈련 가속화를 달성.
Open-Weights
Black Forest Labs와 Krea의 협업으로 FLUX.1 Krea [dev] 모델이 공식 출시되었습니다. 이는 텍스트-이미지 생성에 특화된 최고의 오픈소스 FLUX 모델입니다. ComfyUI가 네이티브 지원을 구현하여 사용자들이 최신 텍스트-이미지 생성 기술을 직접 체험할 수 있습니다.
FLUX-1-dev-non-commercial
WAN 팀이 혁신적인 MoE 아키텍처를 적용한 Wan2.2 오픈소스 버전을 공식 출시했습니다. 이로써 영상 생성 품질이 크게 향상되었으며, ComfyUI는 Day 0부터 네이티브 지원을 제공하여 사용자가 최신 영상 생성 기술을 직접 경험할 수 있습니다.
Open-Weights
텍스트→이미지바이트댄스가 번역 작업에 특화된 Seed-X 7B 모델을 오픈소스로 공개했습니다. 이 모델은 28개 언어 간 번역을 지원하며, AI 이미지 생성 등 다양한 분야에 통합하여 사용할 수 있습니다.
Open-Weights
텍스트→비디오PUSA V1.0은 혁신적인 VTA 기술을 활용하여 최소한의 데이터와 비용으로 고품질 멀티태스크 비디오 생성을 실현하며, 이미지-비디오 변환, 키프레임 생성, 비디오 확장, 텍스트-비디오 변환 등을 지원합니다.
Open-Weights
텍스트→이미지AMAP 팀이 FLUX-Text를 발표했습니다. 확산 모델 기반의 새로운 장면 텍스트 편집 방식으로, 다국어·스타일 일관성·고품질 텍스트 편집을 지원합니다.
Open-Weights
OmniAvatar 모델이 오픈소스로 공개되어, 자연스러운 움직임과 풍부한 표정을 가진 음성 제어 전신 가상 인물 동영상 생성이 가능해짐. 팟캐스트, 상호작용, 다이나믹한 장면 등 다양한 용도에 대응
Open-Weights
음성 합성통이 연구소가 체인 추론을 지원하는 최초의 통합 Any2Audio 생성 및 편집 프레임워크인 ThinkSound를 오픈소스로 공개했습니다. 비디오, 텍스트, 오디오를 포함한 멀티모달 입력을 지원하며, 높은 충실도, 강력한 동기화 및 대화형 편집 기능을 제공합니다.
Open-Weights
텍스트→이미지ByteDance가 XVerse 모델을 오픈소스로 공개. 다중 객체의 식별과 의미론적 속성(포즈, 스타일, 조명 등)을 정밀하게 독립적으로 제어할 수 있어 AI 이미지 생성의 개인화와 복잡한 장면 생성 능력을 향상
Open-Weights
Black Forest Labs가 120억 파라미터의 확산 트랜스포머 모델인 Flux.1 Kontext Dev 오픈소스 버전을 출시하고, ComfyUI에서 즉시 네이티브 지원 제공
Open-Weights
멀티모달VectorSpaceLab이 OmniGen2를 출시했습니다. 자연어 지시를 통한 정밀한 국소 이미지 편집을 지원하는 강력한 멀티모달 생성 모델로, 객체 제거 및 교체, 스타일 전환, 배경 처리 등 다양한 편집 작업을 수행할 수 있습니다
Open-Weights
NVIDIA 연구팀이 단일 이미지나 비디오를 통해 고품질 재조명 효과를 구현하는 확산 모델 기반 범용 재조명 기술 UniRelight를 발표
Open-Weights