음성 합성Bilibili IndexTeam이 IndexTTS-2.5를 출시했습니다. 중국어, 영어, 일본어, 스페인어, 아랍어를 지원하는 제로샷 음성 복제와 감정 및 속도 제어 기능을 제공합니다.
Bilibili Model License
ComfyUI 생태계 소식 — 오픈소스 모델 릴리스, 커스텀 노드, 워크플로, 이미지·비디오·오디오 생성 도구 업데이트.
음성 합성Bilibili IndexTeam이 IndexTTS-2.5를 출시했습니다. 중국어, 영어, 일본어, 스페인어, 아랍어를 지원하는 제로샷 음성 복제와 감정 및 속도 제어 기능을 제공합니다.
Bilibili Model License
텍스트→비디오Unsloth가 FL2VA 및 Ref2VA용 MiniMax H3 GGUF 퀀트(Q2_K 6.3GB부터 Q8_0 20GB까지)와 ComfyUI 및 stablediffusion.cpp용 Qwen3-VL 텍스트 인코더 GGUF를 공개했습니다.
텍스트→이미지iljung1106의 새로운 ComfyUI 노드가 Krea 2에 정규화된 어텐션 가이던스를 도입하여, CFG 1.0이 필요한 Turbo 체크포인트에서 네거티브 프롬프트 제어를 복원합니다.
텍스트→비디오h3-realism-people-t2v-i2v-r2v.safetensors(125MB)를 ComfyUI/models/loras에 넣고 r34l1sm 트리거 워드로 T2V, I2V, R2V에서 실사 인물을 생성하세요.
GitHub에서 MiniMax H3 공식 스킬을 설치하세요: 5가지 생성 모드를 모두 다루는 h3-prompt-writing과 이중 언어 SKILL.md가 포함된 8가지 스타일별 비디오 생성 스킬.
Redis의 창시자 antirez가 Apple Silicon용 Metal 기반 네이티브 MiniMax-H3 추론 엔진 h3.c를 개발 중입니다. 프롬프트-투-비디오/오디오와 Ref2VA 참조가 종단 간(end-to-end) 작동합니다.
MIT
텍스트→비디오ComfyUI 커스텀 노드가 MiniMax H3의 15.7GB Qwen3-VL-32B 텍스트 인코더를 Qwen3-VL-4B와 학습된 투영으로 대체하여 조건화 VRAM을 4.5GB로 줄입니다.
MIT
인페인팅LanPaint 2.0.0에 MiniMax H3 지원이 추가되어 비디오 및 오디오 인페인팅 파이프라인을 제공합니다. 하나의 편집기에서 프레임별 마스크와 오디오 구간을 칠한 다음, 단일 패스로 두 스트림을 모두 인페인팅할 수 있습니다.
Lodestones가 Kroma v0.2를 LoRA 대신 전체 Krea 2 파인튜닝 checkpoint로 출시합니다. ComfyUI용 베이스 및 터보 파일과 커뮤니티 INT8 양자화 버전이 포함됩니다.
MIT
비디오 편집H3 Motion Context v0.2.0은 MiniMax H3 클립을 연결하여 컷을 넘어서도 모션과 오디오가 계속 이어지도록 하고, 레퍼런스 모드 지원을 추가하며, 연결 지점의 보이는 이음새를 제거합니다.
h3_clean_latent_upscaler_v1_mamad8.safetensors(56MB) 다운로드: Mamad8이 MiniMax H3용 2× 클린 잠재 업스케일러를 두 개의 ComfyUI 노드와 함께 공개했습니다. VAE 디코드 이전에 공간 해상도를 두 배로 늘립니다.
텍스트→비디오minimax_h3_turbo_v4_step600_ema.safetensors(MiniMax H3 Turbo LoRA v4)를 다운로드하세요. ComfyUI에서 2스텝 오디오-비디오 생성, pruned 체크포인트 지원.
minimax_h3_t1_image_vae_step1597.safetensors(5.2GB) 다운로드: Mamad8이 커스텀 노드 없이 단일 T=1 시간적 잠재 데이터를 이미지로 직접 디코딩하는 실험적 이미지 특화 MiniMax H3 VAE를 공개합니다.
텍스트→비디오Lightx2v의 MiniMax-H3-Prompt-Rewriter-LoRA는 짧은 프롬프트를 구조화된 H3 T2VA 설명으로 로컬에서 변환하며, Qwen3.6-27B 어댑터용 ComfyUI 노드 팩도 함께 사용할 수 있습니다.
캐릭터 애니메이션Wan-Animate-2와 Wan-Animate-2-Lite를 ComfyUI에서 사용하세요: 드라이빙 비디오를 직접 입력하는 엔드투엔드 캐릭터 애니메이션, 텍스트 기반 시점 제어, 네이티브 노드, 실시간 Lite 버전.
Apache-2.0
이미지→비디오Lightx2v와 ModelTC가 MiniMax H3를 4단계 FL2V Turbo LoRA로 증류해 샘플링 단계를 약 20단계에서 4단계로 줄였습니다. ComfyUI 변환 파일과 데모 Spaces도 함께 제공합니다.
텍스트→비디오MiniMax H3 Turbo LoRA(minimax_h3_turbo_4step_ckpt500.safetensors)를 다운로드하세요: ComfyUI에서 동기화된 스테레오 오디오와 함께 4단계로 비디오를 생성합니다. pruned 변환과 T2V/I2V 워크플로 포함.
Apache-2.0
텍스트→비디오tsuremen의 새로운 ComfyUI 노드는 MiniMax H3 스케줄의 첫 단계를 거쳐 여러 시드를 탐색하고, 노드에서 실시간 미리보기를 보여준 다음, 선택한 시드만 완료합니다.
텍스트→비디오ComfyUI용 Kijai의 실험적 w4a8 양자화 MiniMax H3 가중치를 다운로드하세요: minimax_h3_fl2va_pruned_w4a8_mixed.safetensors(12.5GB FL2VA), Ref2VA 변형 및 int8 convrot VAE.
minimax-h3-community-license-agreement
텍스트→비디오Sand.ai가 MAGI-2 미리보기를 오픈소스로 공개했습니다. 텍스트나 이미지를 동기화된 오디오가 포함된 10초 비디오로 변환하는 114B 파라미터 MoE 모델로, 토큰당 6B 파라미터만 활성화합니다.
Apache-2.0