멀티모달쿤룬완웨이의 SkyReels 팀이 Diffusion Forcing 프레임워크를 사용하여 세계 최초의 무한 길이 영화 생성 모델인 SkyReels-V2를 출시하고 오픈 소스화했습니다. 이 모델은 고품질의 긴 동영상 콘텐츠를 생성할 수 있습니다.
Open-Weights
ComfyUI 생태계 소식 — 오픈소스 모델 릴리스, 커스텀 노드, 워크플로, 이미지·비디오·오디오 생성 도구 업데이트.
멀티모달쿤룬완웨이의 SkyReels 팀이 Diffusion Forcing 프레임워크를 사용하여 세계 최초의 무한 길이 영화 생성 모델인 SkyReels-V2를 출시하고 오픈 소스화했습니다. 이 모델은 고품질의 긴 동영상 콘텐츠를 생성할 수 있습니다.
Open-Weights
텍스트→이미지Shakker Labs가 제어 효과가 최적화되고, 다양한 제어 모드를 지원하며, 모델 크기가 더 작아진 새로운 FLUX.1-dev-ControlNet-Union-Pro-2.0 모델을 출시했습니다
Open-Weights
텍스트→이미지InstantCharacter는 단일 이미지에서 캐릭터 일관성을 유지하는 생성을 가능하게 하는 혁신적인 튜닝 불필요 방식으로, 다양한 다운스트림 작업을 지원합니다
Open-Weights
텍스트→비디오Lvmin Zhang이 개발한 FramePack 기술은 입력 프레임 컨텍스트를 압축하여 비디오 생성 작업량을 비디오 길이와 무관하게 만들어, 노트북 GPU에서도 수많은 프레임을 처리할 수 있게 합니다
Open-Weights
Seaweed-7B는 단 70억 개의 매개변수로 140억 매개변수 모델을 능가하는 성능을 달성하며, 업계 표준의 3분의 1 수준의 훈련 비용으로 비디오 생성 분야에 새로운 가능성을 제시합니다
Open-Weights
PixelFlow는 원시 픽셀 공간에서 혁신적으로 작동하여 사전 훈련된 변분 오토인코더 없이 이미지 생성 프로세스를 단순화하고 엔드투엔드 훈련 가능한 모델을 구현합니다
Open-Weights
텍스트→비디오새로운 비디오 복원 프레임워크 FloED가 코드와 가중치를 공개하여 광학 흐름 가이드 기술로 더 높은 비디오 일관성과 계산 효율성 달성
Open-Weights
이미지→3DHoloPart는 3D 모델을 완전하고 의미 있는 부품으로 분해하여 3D 콘텐츠 제작의 편집 문제를 해결합니다
Open-Weights
이미지→3DUniRig는 자기회귀 모델을 활용하여 다양한 3D 모델에 고품질 스켈레톤 구조와 스키닝 가중치를 생성, 애니메이션 워크플로우를 크게 간소화
Open-Weights
멀티모달OmniSVG는 텍스트, 이미지 또는 캐릭터 참조를 포함한 다양한 입력에서 복잡하고 편집 가능한 벡터 그래픽을 생성할 수 있는 새로운 통합 다중 모드 SVG 생성 모델입니다.
Open-Weights
텍스트→비디오연구진이 CogVideoX 5B 기반 Test-Time Training 기술을 활용한 TTT-Video 모델을 개발하여 최대 63초 길이의 일관된 비디오 생성 가능
MIT
텍스트→이미지바이트댄스 창의적 인텔리전스 팀이 맥락 내 생성을 통해 더 많은 제어 가능성을 제공하는 UNO 모델을 출시하여 단일 주체에서 다중 주체까지 고품질 이미지 생성 실현
Open-Weights
텍스트→이미지Tiamat AI 팀이 EasyControl 프레임워크를 출시하여 DiT 모델에 조건부 제어 기능을 추가하고, ComfyUI-easycontrol 플러그인을 통해 ComfyUI에서 지원됩니다
Open-Weights
텍스트→이미지HiDream.ai가 17B 매개변수를 가진 새로운 오픈소스 텍스트-이미지 모델 HiDream-I1을 출시. 여러 벤치마크에서 기존 오픈소스 모델을 능가하며 다양한 스타일의 고품질 이미지 생성 지원
Open-Weights
이미지→3DStable-X 팀이 노말 브리징 기술을 통해 기존 방법의 기하학적 세부 사항 부족 문제를 해결하는 이미지에서 고충실도 3D 모델을 생성하는 혁신적인 프레임워크 Hi3DGen을 발표
Open-Weights
이미지→3D혁신적인 SparseFlex 표현 방식을 기반으로 한 TripoSF는 최대 1024³ 해상도의 3D 모델 생성을 지원하며, 개방형 표면과 복잡한 내부 구조를 처리할 수 있어 3D 자산 품질을 크게 향상시킵니다
Open-Weights
텍스트→비디오쿤룬완웨이가 세계 최초의 상업용 등급의 제어 가능한 비디오 생성 프레임워크 SkyReels-A2를 출시했습니다. 이 프레임워크는 이중 분기 아키텍처를 통해 다중 요소 비디오 생성을 가능하게 하여 전자상거래, 영화 제작 등 새로운 가능성을 열어줍니다.
Open-Weights
멀티모달알리바바 그룹의 통이 연구소가 텍스트에서 영상 생성, 영상 편집, 복잡한 작업 조합을 아우르는 세계 최초의 통합 프레임워크 VACE를 소개합니다.
Open-Weights
멀티모달StarVector 프로젝트는 이미지와 텍스트에서 SVG 벡터 그래픽 코드를 자동으로 생성하는 기능을 구현하여 디자이너와 개발자에게 새로운 창의적 도구를 제공합니다.
Open-Weights
텍스트→이미지바이트댄스가 확산 트랜스포머를 기반으로 한 혁신적인 프레임워크 InfiniteYou(InfU)를 소개합니다. 이 기술은 정체성 유사성, 텍스트-이미지 정렬 및 생성 품질과 관련된 기존 방법의 한계를 해결하면서 사용자 정체성을 유지하는 유연한 사진 재창작을 가능하게 합니다
MIT