Fizgig v7: Anima와 SDXL 추가, 모든 모델을 위한 파인튜닝
Fizgig v7은 Anima와 SDXL 학습, 지원하는 6개 모델 전체에 대한 완전한 파인튜닝(8GB 카드까지), 그리고 커뮤니티가 확장할 수 있는 완성된 드라이버 시스템을 추가합니다.
10월 5일 공개된 Fizgig v7.0.0은 Anima와 SDXL을 스튜디오에 추가하고, 완전한 파인튜닝을 지원하는 모든 모델의 기능으로 만들었습니다 (GitHub | 릴리스 노트 | 드라이버 가이드). 같은 날 v7.0.1 패치가 이어졌습니다.
Fizgig: Flux 2 Klein 9B, Krea 2, MiniMax H3, Qwen Image 2.1, SDXL, Anima를 위한 학습·파인튜닝·복구·탐색 작업대
이 스튜디오는 이미 Flux 2 Klein, Krea 2, MiniMax H3, Qwen Image 2.1용 LoRA, LoKR, 파인튜닝을 학습할 수 있었습니다. 버전 7은 두 가지 공백을 한 번에 메웁니다. 가장 많이 요청된 두 가지 구형 계열을 추가하고, 커뮤니티 드라이버가 설명하는 모델이라면 어떤 것이든 전체 작업대를 사용할 수 있게 합니다.
두 가지 새로운 베이스 모델
| 모델 | 비고 |
|---|---|
| Anima (실험적) | CircleStone Labs의 애니메이션·일러스트 모델로, 전체 작업대를 지원합니다. 비상업적 라이선스가 그대로 적용됩니다. |
| SDXL (실험적) | 단일 파일 SDXL checkpoint라면 무엇이든 됩니다. VAE와 텍스트 인코더를 checkpoint에서 바로 읽어옵니다. 기본 다운로드는 Juggernaut XL v9이며, Illustrious XL도 함께 제공됩니다. |
두 모델 모두 LoRA 및 LoKR 프리셋, 프롬프트 쌍이나 사진 쌍으로 만드는 슬라이더 LoRA, 파인튜닝을 제공합니다. Anima에는 Character 프리셋, Style 프리셋, 그리고 해당 모델 카드의 Official 레시피가 제공되며, SDXL에는 EMA를 켠 Strong, Standard, Slider 프리셋이 제공됩니다. kohya 파일, LoCon, 그리고 Lightning, LCM 같은 속도 LoRA를 포함한 커뮤니티 SDXL LoRA도 작업대에서 로드됩니다. CLIP의 77 토큰을 넘는 내용은 ComfyUI와 같은 방식으로 청크 단위로 인코딩되므로, 긴 캡션이 더 이상 잘리지 않습니다.
모든 모델 파인튜닝
파인튜닝은 이제 6개 모델 모두에서 Training 탭의 단일 Kind of training 선택 항목이 되었으며, Klein 9B, SDXL, Anima에서는 새로 추가된 기능입니다. 각 실행은 베이스 파일을 대체하는 완전한 checkpoint를 기록합니다.
가장 크게 달라진 점은 메모리 계획입니다. 파인튜닝은 항상 한 번에 한 부분만 학습하는 대신, 카드가 감당할 수 있는 만큼 모델을 각 패스에 담고, 학습하지 않는 블록은 필요할 때 시스템 메모리에서 스트리밍합니다. 충분히 큰 카드에서는 전체 모델이 한 번의 패스로 학습되고, 작은 카드에서는 작업이 분할됩니다.
| 모델 | 파인튜닝 최소 | 전체 모델 1회 패스 최소 |
|---|---|---|
| Anima | 8 GB | 10 GB |
| SDXL | 8 GB | 10 GB |
| Qwen Image 2.1 | 12 GB | 24 GB |
| Klein 9B | 16 GB | 32 GB |
| Krea 2 | 16 GB | 48 GB |
| MiniMax H3 | 16 GB | 48 GB |
32GB 카드에서 Krea 2는 4회 대신 2회, MiniMax H3는 3회 패스가 필요합니다. 작성자의 테스트에서 Anima를 기준으로 측정했을 때, 모든 것을 함께 학습하면 4개의 개별 패스보다 전체 모델을 약 2.6배 빠르게 처리했습니다. 새로운 Window size 설정은 한계에 가까운 카드를 위해 함께 학습되는 부분의 수를 제한하며, Training 탭은 실행이 시작되기 전에 현재 카드에 적용될 계획을 보여줍니다.
작업대 도구(여기서는 Gizmo 비디오 클립 준비 화면)는 모든 모델에서 실행되며, 이제 하나의 드라이버 인터페이스를 공유합니다.
드라이버 시스템 완성
Klein과 MiniMax H3는 이제 Krea 2, Qwen Image 2.1, SDXL, Anima가 사용하는 것과 동일한 드라이버 시스템에서 실행됩니다. 모델은 파일, LoRA 형식, 그리고 표준 인터페이스 뒤의 모델 코드로 한 번만 설명되며, 학습, 미리보기, 다운로드, 메모리 계획, 5가지 작업대 도구 모두가 그 설명을 바탕으로 동작합니다.
실질적인 효과는 한 모델을 위해 만든 기능이 다른 모델에서도 쓸 수 있게 되고, 커뮤니티가 모델을 추가할 수 있다는 것입니다. 드라이버 작성 가이드는 코드가 어디에서 호출되는지, 스틸 모델과 비디오 모델용 워크스루, 모든 선택적 기능, 그리고 완료된 모델이 갖춰야 할 체크리스트를 다룹니다. SDXL, Anima, Qwen Image 2.1이 이 가이드를 따라 만들어졌으며, 새로운 모델이나 구형 모델을 위한 pull request를 환영합니다.
작업대 업데이트
- Repair Studio는 이제 모든 모델에서 슬라이더를 변경한 뒤에 해당 블록만 다시 렌더링하며, 결과 그림은 전체 렌더링과 동일합니다. 기본적으로 켜져 있고 Setup 카드에서 끌 수 있습니다.
- Checkpoint to LoRA는 SDXL과 Anima를 포함한 모든 파인튜닝에서 동작합니다. 파인튜닝된 checkpoint를 선택한 rank의 LoRA로 변환합니다. 작성자에 따르면 파인튜닝에서 추출한 LoRA는 같은 rank에서 직접 학습한 LoRA보다 더 강하게 나온다고 합니다.
- LoHa LoRA는 Profiler와 Extract에서 로드됩니다. Extract는 LoHa를 표준 LoRA로 변환합니다.
- 네거티브 프롬프트에 제대로 된 여러 줄 입력 상자가 생겼고, 편집 내용을 기억하는 모델별 기본값이 제공됩니다. 충돌 없는 제외 항목은 이제 모델별로 유지되므로, Krea 2의 제외 항목이 같은 사진을 쓰는 SDXL에 더 이상 영향을 주지 않습니다.
- 더 많은 LoRA 형식 로드: diffusers 명명 규칙으로 저장된 SDXL LoRA도 이제 kohya, LyCORIS, PEFT, ComfyUI 방식 파일과 함께 어디서든 동작합니다.
저장된 LoRA, LoKR, Repair Studio 저장본, Extract 출력은 동일한 형식을 유지하며 ComfyUI의 표준 LoRA 로더를 통해 로드됩니다.
설치 방법
기존 설치본은 update_fizgig.bat, AMD에서는 update_fizgig_rocm.bat으로 업데이트합니다. Preferences 탭의 Anima 및 SDXL 섹션에서 해당 모델을 다운로드하며, 저장된 H3 설정도 그대로 유지됩니다.
ComfyUI/models/loras/에 바로 넣을 수 있는 kohya 형식 .safetensors LoRA를 저장합니다.
댓글
GitHub로 로그인하고 토론에 참여하세요.