이미지→3D텐센트는 텍스트와 이미지를 기반으로 고해상도 3D 자산을 생성하는 두 단계 프로세스를 갖춘 혼원3D 2.0 시스템을 출시했습니다.
Open-Weights
ComfyUI 생태계 소식 — 오픈소스 모델 릴리스, 커스텀 노드, 워크플로, 이미지·비디오·오디오 생성 도구 업데이트.
이미지→3D텐센트는 텍스트와 이미지를 기반으로 고해상도 3D 자산을 생성하는 두 단계 프로세스를 갖춘 혼원3D 2.0 시스템을 출시했습니다.
Open-Weights
카이쇼우 테크놀로지가 ReCamMaster를 발표했습니다. 이 기술은 사용자가 단일 비디오에서 새로운 카메라 시점과 움직임 경로를 생성할 수 있도록 합니다.
Open-Weights
텍스트→비디오hpcaitech가 Open-Sora 2.0 오픈 소스 비디오 생성 모델을 출시했습니다. 단 20만 달러의 훈련 비용으로 최상급 상업 모델에 가까운 성능을 달성했습니다.
Open-Weights
알리 통의 연구소가 다기능 비디오 생성 및 편집 모델 VACE를 출시하여 다양한 비디오 처리 작업을 단일 프레임워크로 통합하고 비디오 제작 장벽을 낮추었습니다.
Open-Weights
마이크로소프트 리서치가 전역 텍스트 프롬프트 기반의 지능형 레이어 생성 솔루션을 선보이며 50+ 독립 레이어를 포함한 투명 이미지 제작 지원
Open-Weights
이미지→비디오텐센트 후니위안 팀이 단일 이미지로 5초 비디오 생성이 가능한 오픈소스 모델 출시. 지능형 모션 생성과 맞춤형 효과 기능 제공
Open-Weights
텍스트→이미지지푸AI팀(THUDM)이 중영 이중언어 입력 및 한자 생성이 가능한 CogView4 오픈소스 이미지 생성 모델 공개, 다수 벤치마크에서 선두 성적
Open-Weights
멀티모달문서 내 텍스트와 이미지를 동시에 이해하는 AI 시스템, 복잡 문서 처리 효율 10% 이상 향상
Open-Weights
멀티모달Sesame 연구팀이 이중 Transformer 아키텍처 기반 대화형 음성 모델 CSM 공개, 실시간 음성 상호작용 구현 및 오픈소스 코어 제공
Open-Weights
알리바바가 최신 비디오 생성 모델 Wan2.1을 공식 오픈 소스화했습니다. 이 모델은 8GB의显存만으로도 실행할 수 있으며, 고화질 비디오 생성, 동적 자막 및 다국어 더빙을 지원합니다. VBench 순위표에서 86.22%의 총점으로 Sora 등 모델을 초월했습니다.
Open-Weights
알리바바 국제 디지털 상업 그룹(AIDC-AI)은 ComfyUI Copilot 플러그인을 발표했습니다. 이는 ComfyUI 프레임워크 기반으로 개발된 스마트 어시스트 도구로, 자연어 상호작용과 AI 기반 기능을 통해 ComfyUI 사용 경험을 단순화합니다. 중국어 상호작용 지원 및智能 노드 추천 등의 기능을 제공합니다.
Open-Weights
알리바바는 2025년 2분기에 최신 비디오 생성 모델인 WanX 2.1을 오픈 소스로 출시할 예정이라고 발표했습니다. 이 모델은 고해상도 비디오 생성, 동적 자막 및 다국어 더빙을 지원하며, VBench 순위에서 84.7%의 총점으로 1위를 차지했습니다.
Open-Weights
Skywork가 오픈소스 비디오 생성 모델 SkyReels-V1을 발표했습니다. 텍스트 생성 비디오와 이미지 생성 비디오를 지원하며, 영화 수준의 조명 효과와 자연스러운 동작 표현을 갖추고 있으며, 상용화되었습니다.
Open-Weights
멀티모달구글이 새로운 PaliGemma 2 mix 모델을 출시하여 이미지 설명, OCR, 목표 감지 등 다양한 시각 작업을 지원하고, 3B, 10B, 28B 세 가지 스케일 버전을 제공합니다.
Open-Weights
연구자들이 새로운 비디오 재조명 방법인 Light-A-Video를 제안하였으며, 일관된 조명 주의(CLA)와 점진적 조명 융합(PLF)을 통해 시간적으로 매끄러운 비디오 재조명 효과를 구현하였습니다.
Open-Weights
StepFun이 오픈소스 텍스트 기반 비디오 모델 Step-Video-T2V를 발표하였으며, 300억 파라미터를 보유하고 204프레임까지의 고품질 비디오 생성을 지원하며 온라인 체험 플랫폼을 제공합니다.
Open-Weights
이미지→3DKuaishouが3D認識技術による高品質な動画コンテンツ制作を実現するCineMasterテキスト→動画生成フレームワークを正式リリース
Open-Weights
알리바바의 최신 오픈소스 프로젝트 InspireMusic은 FunAudioLLM 기반의 통합 오디오 생성 프레임워크로, 음악 제작, 노래 생성 등 다양한 오디오 합성 작업을 지원합니다.
Open-Weights
텍스트→이미지알리바바 연구소가 이미지 생성 도구 ACE++를 오픈소스로 공개. 문맥 인식 콘텐츠 채우기 기술을 통해 단일 입력에서 캐릭터 일관성이 있는 새로운 이미지 생성을 지원하며, 온라인 체험과 3가지 전용 모델을 제공.
Open-Weights
ByteDance 연구팀이 OmniHuman-1 인체 애니메이션 생성 프레임워크를 발표하여, 단일 이미지와 모션 신호만으로 고품질 인체 비디오 애니메이션 생성이 가능해졌습니다.
Open-Weights