텍스트→이미지InstantCharacter는 단일 이미지에서 캐릭터 일관성을 유지하는 생성을 가능하게 하는 혁신적인 튜닝 불필요 방식으로, 다양한 다운스트림 작업을 지원합니다
Open-Weights
ComfyUI 생태계 소식 — 오픈소스 모델 릴리스, 커스텀 노드, 워크플로, 이미지·비디오·오디오 생성 도구 업데이트.
텍스트→이미지InstantCharacter는 단일 이미지에서 캐릭터 일관성을 유지하는 생성을 가능하게 하는 혁신적인 튜닝 불필요 방식으로, 다양한 다운스트림 작업을 지원합니다
Open-Weights
텍스트→비디오Lvmin Zhang이 개발한 FramePack 기술은 입력 프레임 컨텍스트를 압축하여 비디오 생성 작업량을 비디오 길이와 무관하게 만들어, 노트북 GPU에서도 수많은 프레임을 처리할 수 있게 합니다
Open-Weights
Seaweed-7B는 단 70억 개의 매개변수로 140억 매개변수 모델을 능가하는 성능을 달성하며, 업계 표준의 3분의 1 수준의 훈련 비용으로 비디오 생성 분야에 새로운 가능성을 제시합니다
Open-Weights
PixelFlow는 원시 픽셀 공간에서 혁신적으로 작동하여 사전 훈련된 변분 오토인코더 없이 이미지 생성 프로세스를 단순화하고 엔드투엔드 훈련 가능한 모델을 구현합니다
Open-Weights
텍스트→비디오새로운 비디오 복원 프레임워크 FloED가 코드와 가중치를 공개하여 광학 흐름 가이드 기술로 더 높은 비디오 일관성과 계산 효율성 달성
Open-Weights
이미지→3DHoloPart는 3D 모델을 완전하고 의미 있는 부품으로 분해하여 3D 콘텐츠 제작의 편집 문제를 해결합니다
Open-Weights
이미지→3DUniRig는 자기회귀 모델을 활용하여 다양한 3D 모델에 고품질 스켈레톤 구조와 스키닝 가중치를 생성, 애니메이션 워크플로우를 크게 간소화
Open-Weights
멀티모달OmniSVG는 텍스트, 이미지 또는 캐릭터 참조를 포함한 다양한 입력에서 복잡하고 편집 가능한 벡터 그래픽을 생성할 수 있는 새로운 통합 다중 모드 SVG 생성 모델입니다.
Open-Weights
텍스트→비디오연구진이 CogVideoX 5B 기반 Test-Time Training 기술을 활용한 TTT-Video 모델을 개발하여 최대 63초 길이의 일관된 비디오 생성 가능
MIT
텍스트→이미지바이트댄스 창의적 인텔리전스 팀이 맥락 내 생성을 통해 더 많은 제어 가능성을 제공하는 UNO 모델을 출시하여 단일 주체에서 다중 주체까지 고품질 이미지 생성 실현
Open-Weights
텍스트→이미지Tiamat AI 팀이 EasyControl 프레임워크를 출시하여 DiT 모델에 조건부 제어 기능을 추가하고, ComfyUI-easycontrol 플러그인을 통해 ComfyUI에서 지원됩니다
Open-Weights
텍스트→이미지HiDream.ai가 17B 매개변수를 가진 새로운 오픈소스 텍스트-이미지 모델 HiDream-I1을 출시. 여러 벤치마크에서 기존 오픈소스 모델을 능가하며 다양한 스타일의 고품질 이미지 생성 지원
Open-Weights
이미지→3DStable-X 팀이 노말 브리징 기술을 통해 기존 방법의 기하학적 세부 사항 부족 문제를 해결하는 이미지에서 고충실도 3D 모델을 생성하는 혁신적인 프레임워크 Hi3DGen을 발표
Open-Weights
이미지→3D혁신적인 SparseFlex 표현 방식을 기반으로 한 TripoSF는 최대 1024³ 해상도의 3D 모델 생성을 지원하며, 개방형 표면과 복잡한 내부 구조를 처리할 수 있어 3D 자산 품질을 크게 향상시킵니다
Open-Weights
텍스트→비디오쿤룬완웨이가 세계 최초의 상업용 등급의 제어 가능한 비디오 생성 프레임워크 SkyReels-A2를 출시했습니다. 이 프레임워크는 이중 분기 아키텍처를 통해 다중 요소 비디오 생성을 가능하게 하여 전자상거래, 영화 제작 등 새로운 가능성을 열어줍니다.
Open-Weights
멀티모달알리바바 그룹의 통이 연구소가 텍스트에서 영상 생성, 영상 편집, 복잡한 작업 조합을 아우르는 세계 최초의 통합 프레임워크 VACE를 소개합니다.
Open-Weights
멀티모달StarVector 프로젝트는 이미지와 텍스트에서 SVG 벡터 그래픽 코드를 자동으로 생성하는 기능을 구현하여 디자이너와 개발자에게 새로운 창의적 도구를 제공합니다.
Open-Weights
텍스트→이미지바이트댄스가 확산 트랜스포머를 기반으로 한 혁신적인 프레임워크 InfiniteYou(InfU)를 소개합니다. 이 기술은 정체성 유사성, 텍스트-이미지 정렬 및 생성 품질과 관련된 기존 방법의 한계를 해결하면서 사용자 정체성을 유지하는 유연한 사진 재창작을 가능하게 합니다
MIT
Stability AI가 새로운 AI 모델 Stable Virtual Camera를 출시, 일반 사진을 실제 깊이감과 원근감을 가진 3D 비디오로 변환하여 창작자에게 직관적인 카메라 제어 제공
Open-Weights
이미지→3D칭화대학교와 텐센트 AI 연구소가 공동으로 StdGEN을 발표, 단일 이미지에서 신체, 의복, 머리카락 등 구성 요소가 분리된 고품질 의미 분해 3D 캐릭터를 생성하는 혁신적인 파이프라인 제공
Open-Weights