텍스트→이미지Microsoft Asia releases Mage-Flow -- compact 4B generative stack for text-to-image and image editing, native resolution 512-2048, RL and 4-step Turbo variants, MIT license.
MIT
ComfyUI 생태계 소식 — 오픈소스 모델 릴리스, 커스텀 노드, 워크플로, 이미지·비디오·오디오 생성 도구 업데이트.
텍스트→이미지Microsoft Asia releases Mage-Flow -- compact 4B generative stack for text-to-image and image editing, native resolution 512-2048, RL and 4-step Turbo variants, MIT license.
MIT
Anima Control Pose Preview-2는 Anima에 포즈 제어 이미지 생성을 제공하며, 네이티브 ComfyUI 커스텀 노드, 512/768/1024 다중 해상도 지원, 개선된 포즈 정확도를 제공합니다.
Lightricks가 LTX-2.3용 Clean Plate IC-LoRA를 출시했습니다. 마스크 없이 영상에서 사람과 물체를 제거하고 빈 배경을 재구성하는 비디오 기반 비디오 생성 LoRA입니다.
tarn59가 Bernini-R용 스타일 전환 LoRA 두 개를 출시했습니다. 애니메이션 스타일과 실사 스타일로, ComfyUI에서 직접 비디오 간 스타일 변환을 가능하게 합니다.
Apache-2.0
DreamFast가 ComfyUI용 무검열 Qwen3-VL-4B 텍스트 인코더를 출시했습니다. BF16, FP8, INT8, NVFP4 및 MXFP8 형식에서 100% HarmBench ASR을 달성했습니다.
Apache-2.0
Lightricks에서 공식 LTX-2.3 Foley V2A LoRA를 출시했습니다. 발소리, 충격음, 타이핑, 환경 소리 등 현실적이고 시각과 동기화된 사운드 효과를 생성합니다.
ComfyUI v0.28.0에 네이티브 SeedVR2 업스케일링, NVIDIA PID 1.5 PixelDiT 지원, convrot int4 최적화, 새로운 Save 3D 및 Text Overlay 노드, sync.so sync-3, Seedream 5 Pro 등 파트너 노드 업데이트가 추가되었습니다.
텍스트→비디오Tongyi Lab(알리바바)이 Wan-Dancer-14B를 오픈소스로 공개했습니다. 이 모델은 음악과 참조 이미지로부터 720p/30fps의 댄스 비디오를 생성하며, 중국 고전 춤, K-Pop, 스트리트, 탭, 라틴 댄스 장르를 지원하여 1분 분량의 출력을 생성합니다.
Fal releases Ideogram V4 Fast (20-step FP4, 5s inference) and Ideogram V4 Instant (8-step BF16, 2s inference), speed-distilled variants with no-CFG support. Available in int8-convrot format for ComfyUI via Hippotes.
Open-Weights
Cseti가 LTX-Video 2.3용 새로운 IC-LoRA를 출시했습니다. 이 LoRA는 가상의 두 번째 카메라 역할을 하여 사용자가 간단한 텍스트 프롬프트를 사용해 새로운 카메라 각도로 비디오 장면을 다시 렌더링할 수 있게 해줍니다.
Apache-2.0
Cseti가 LTX-2.3용 개념 증명 IC-LoRA를 출시했습니다. 이 LoRA는 가상의 두 번째 카메라 역할을 하여, 기존 비디오 영상의 카메라 각도를 이산적인 프롬프트 어휘를 사용하여 변경할 수 있습니다.
LiconStudio가 커뮤니티 피드백을 기반으로 LTX-2.3용 인기 Multiple Subject Reference LoRA의 V2를 출시하여 일관성, 안정성 및 장면 로직을 개선했습니다.
텍스트→비디오Alaya Lab이 AlayaWorld를 출시했습니다. 이는 대화형 생성 세계를 구축하기 위한 풀스택 오픈 소스 프레임워크로, 1분을 초과하는 장기 비디오 일관성, 실시간 카메라 제어 및 프롬프트 기반 상호작용을 제공합니다.
rzgar가 Bernini-R-S2V를 출시했습니다. 이는 Wan2.2 S2V의 오디오 기반 립싱크 기능을 ByteDance의 Bernini-R 모델에 추가한 음성-비디오 파인튜닝 모델로, 전용 ComfyUI 커스텀 노드와 여러 정밀도 변형을 지원합니다.
Apache-2.0
Ant Group의 Robbyant가 LingBot-Video를 오픈소스로 공개했습니다. 30B-A3B MoE 비디오 생성 모델로 RBench에서 SOTA를 달성했으며 Apache 2.0 라이선스로 제공됩니다.
Apache-2.0
ostris의 새로운 LoRA를 통해 Krea 2 Turbo에서 스타일 참조 전이가 가능해졌습니다. AI Toolkit으로 수천 개의 수작업 선별 스타일 쌍을 학습했습니다.
Lightricks이 LTX-2.3용 Cinemagraph IC-LoRA를 출시했습니다. 이 오픈 웨이트 어댑터는 배경을 고정하면서 단일 요소만 움직여 모든 정지 이미지에서 자연스러운 루프를 생성합니다.
LTX-2 Community License
멀티모달SenseTime이 7B 파라미터 모델인 SenseNova-Vision-7B-MoT를 오픈소스로 공개했습니다. 이 모델은 감지, 분할, 깊이 추정, 노멀 예측, 다중 뷰 기하학을 단일 명령어 기반 프레임워크로 통합하며, 작업별 헤드가 필요하지 않습니다.
CC BY-NC 4.0
CircleStone Labs의 2B 애니메이션 텍스트 기반 이미지 생성 모델 Anima가 빠른 Turbo 버전과 품질 조정 Aesthetic 버전이라는 두 가지 새로운 공식 변형을 발표했습니다.
circlestone-labs-non-commercial-license
ComfyUI-Angelo가 이제 두 모델 워크플로를 지원합니다. 사용자는 하나의 통합 캔버스에서 Krea 2(또는 다른 모델)로 생성하고 FLUX 2 Klein 9B로 편집할 수 있으며, 수동 그래프 재배선이 필요하지 않습니다.