Krea 2 Anygles: ComfyUI용 카메라 시점 제어 LoRA
Krea 2 Anygles는 사람 사진 한 장과 3D 인간 노멀 LoRA로 새로운 카메라 보기를 만들어 냅니다. 궤도, 고도, 거리 제어를 위한 ComfyUI 노드와 워크플로도 함께 제공됩니다.
사람에게 카메라를 향한 뒤 움직여 보세요. 수평 궤도, 고도, 거리 제어가 모두 하나의 어댑터에서 나옵니다. Anygles는 소스 이미지에서 3D 인간 메시와 정렬된 노멀 맵을 복원하고, 그 메시를 요청한 포즈로 회전시킨 뒤 렌더링된 노멀을 공간 제어로 Krea 2에 입력합니다. 원본 이미지는 정체성과 스타일 참조로 남으므로, 모델은 기존 이미지를 편집하는 대신 새로운 뷰를 생성합니다.
![]() | ![]() |
|---|---|
| 소스 이미지, 단일 인물 피사체 | 회전된 카메라 위치에서 본 동일한 피사체 |
수평 궤도. 모든 프레임은 원본 소스에서 독립적으로 생성되므로 뷰가 서로 이어지지 않습니다.
제어할 수 있는 항목
- 완전한 수평 궤도: 완전한 360도 회전에 걸친 연속 yaw.
- 고도: 신체 비율을 자연스럽게 유지하면서 시점을 피사체 위나 아래로 이동합니다.
- 거리: 더 가까운 프레이밍에서 더 넓은 뷰까지 조절합니다.
- 복합 모션: 하나의 부드러운 경로를 따라 yaw, 고도, 거리를 함께 변화시킵니다.
- 독립적 생성: 각 뷰는 원본 소스 이미지에서 시작하므로, 생성된 프레임을 모델에 다시 입력할 때 누적되는 드리프트를 피할 수 있습니다.
- 소스 인식 프레이밍: 출력은 16픽셀 정렬 크기로 소스 종횡비를 유지합니다.
공개된 제어 범위는 고도 -60도에서 +60도, 거리 0.6x에서 1.8x이며, 작성자는 이를 엄격한 한계가 아닌 인터페이스 가드레일이라고 설명합니다. 릴리스 스윕은 고도 -45도에서 +45도, 거리 1.35x에서 0.78x를 다룹니다.
하나의 닫힌 카메라 경로를 따라 함께 변하는 방위각, 고도, 거리.
현재 릴리스는 하나의 명확한 인물 피사체를 대상으로 합니다. 동물, 일반 사물, 군중, 또는 전체 3D 장면의 정확한 재구성을 위한 것은 아닙니다.
다중 각도 Qwen 베이스라인과의 비교
소스 저장소에는 4스텝 Lightning 스케줄로 실행되는 Qwen-Image-Edit 2511 다중 각도 LoRA와의 실용적인 직접 비교가 포함되어 있습니다. 양쪽 모두 생성되는 모든 프레임마다 원본 소스 이미지를 독립적으로 받으며, 모든 출력은 고정된 프롬프트와 시드에서 나온 첫 번째 결과입니다.
Qwen 다중 각도 베이스라인과 Anygles의 360도 수평 궤도 비교.
작성자는 Qwen 베이스라인이 Anygles가 사용하는 대상 노멀을 받지 않기 때문에, 이것이 동일 조건화 절제 실험이 아닌 기능 비교라고 언급합니다.
작동 방식
- SAM 3D Body로 소스 이미지에서 인간 메시를 한 번 복원합니다.
- 메시를 골반을 중심으로 회전시키고, 소스 종횡비와 일치하는 캔버스 안에 정렬된 대상 노멀로 렌더링합니다.
- 원본 이미지는 Krea 2의 의미 및 정체성 참조로 남습니다.
- 대상 노멀은 VAE로 인코딩되어 노이즈 이미지 입력에서 공간 Control-LoRA 프로젝션을 통해 주입됩니다.
- 짧은 상대 카메라 문장이 의도한 뷰 의미를 전달합니다. 내부 각도는 학습 규약에 맞게 정규화됩니다. 예를 들어 오른쪽으로 50도 요청은 왼쪽으로 310도로 전송되지만, UI는 부호 있는 제어를 유지합니다.
ComfyUI에서 실행하기
노드를 설치합니다:
cd ComfyUI/custom_nodes
git clone https://github.com/alexw5702-afk/krea2-anygles
cd krea2-anygles
pip install -r requirements.txtSAM 3D Body 라이선스에 동의하고 인간 메시 checkpoint를 다운로드한 뒤, LoRA를 일반적인 폴더에 넣습니다:
hf download facebook/sam-3d-body-dinov3 --local-dir ComfyUI/models/sam3d_body| 파일 | 저장 위치 |
|---|---|
krea2_anygles_rank32.safetensors | ComfyUI/models/loras |
krea2_turbo_int8_convrot.safetensors | ComfyUI/models/diffusion_models |
qwen3vl_4b_fp8_scaled.safetensors | ComfyUI/models/text_encoders |
qwen_image_vae.safetensors | ComfyUI/models/vae |
sam-3d-body-dinov3 | ComfyUI/models/sam3d_body |
노드 팩은 네 개의 노드를 추가합니다:
- Krea2 Anygles Camera는 소스를 정렬된 캔버스로 크기 조정하고, 인간 메시를 복원하며, yaw, 고도, 거리로 회전시키고, 대상 노멀을 렌더링한 뒤 카메라 프롬프트를 조립합니다.
- Krea2 Anygles Encode는 소스를 Qwen3-VL과 Krea 2 클린 참조 경로로 보내고, 전체 캔버스 대상 노멀을 인코딩합니다.
- Krea2 Anygles Load LoRA는 어댑터를 적용하고, 비표준 텐서를 버리는 대신 공간 프로젝션을 유지합니다.
- Krea2 Anygles Model Patch는 노이즈 이미지 입력에 정렬된 노멀 토큰을 주입하고 클린 시각 참조 K/V를 캐시합니다.
모델 카드의 권장 설정: 8스텝, Euler, simple scheduler, CFG 1.0, 어댑터 강도 1.0, VLM 참조 및 참조 K/V 캐시 활성화. SAM 3D Body와 Krea 2는 순차적으로 실행되므로, 두 전체 모델이 동시에 GPU에 올라가 있을 필요가 없습니다.
제공 현황
- LoRA 가중치: Hugging Face의 yijunwang2/krea2-anygles, 단일 rank 32 파일.
- ComfyUI 노드와 워크플로: GitHub의 alexw5702-afk/krea2-anygles.
- 데모 Space: 로컬 설치 없이 어댑터를 사용해 볼 수 있는 yijunwang2/krea2-anygles.
- 휴대용 Python 경로: 저장소에는 ComfyUI 외부에서 Diffusers pipeline으로 실행하기 위한
prepare_normal.py와example.py가 포함되어 있습니다.
이것은 비공식 커뮤니티 릴리스입니다. 숨겨진 면과 배경 콘텐츠는 측정된 형상에서 복원되는 것이 아니라 생성되므로, 액세서리, 텍스트, 손가락, 가려진 세부 정보가 달라질 수 있고, 큰 카메라 이동은 조명이나 신체 비율을 바꿀 수 있습니다. 신체 복원이 좋지 않거나, 심한 가림, 아주 작은 피사체 또는 여러 사람이 있는 경우 잘못된 노멀 제어가 나올 수 있습니다.


댓글
GitHub로 로그인하고 토론에 참여하세요.