Fizgig v7: Anima, SDXL и файнтюнинг для каждой модели
Fizgig v7 добавляет обучение Anima и SDXL, файнтюнинг всех шести моделей от карт на 8 ГБ и систему драйверов, расширяемую сообществом.
Fizgig v7.0.0, выпущенная 5 октября, добавляет Anima и SDXL в студию и превращает полный файнтюнинг в возможность каждой поддерживаемой модели (GitHub | заметки о выпуске | руководство по драйверам). Патч v7.0.1 вышел в тот же день.
Fizgig: рабочий стол для обучения, файнтюнинга, восстановления и исследования моделей Flux 2 Klein 9B, Krea 2, MiniMax H3, Qwen Image 2.1, SDXL и Anima
Студия уже умела обучать LoRA, LoKR и файнтюнинги для Flux 2 Klein, Krea 2, MiniMax H3 и Qwen Image 2.1. Версия 7 закрывает сразу два пробела: она добавляет два самых востребованных старых семейства и делает весь рабочий стол доступным для любой модели, которую описывает драйвер сообщества.
Две новые базовые модели
| Модель | Примечания |
|---|---|
| Anima (экспериментальное) | Аниме- и иллюстрационная модель от CircleStone Labs с полным рабочим столом. Её некоммерческая лицензия сохраняется. |
| SDXL (экспериментальное) | Любой однофайловый checkpoint SDXL. Его VAE и текстовые энкодеры читаются прямо из checkpoint. Juggernaut XL v9 это загрузка по умолчанию, рядом предлагается Illustrious XL. |
Обе поставляются с пресетами LoRA и LoKR, slider-LoRA из пар промптов или пар фото и файнтюнингом. Anima получает пресет Character, пресет Style и собственный рецепт Official из карточки модели; SDXL получает пресеты Strong, Standard и Slider с включённым EMA. LoRA для SDXL от сообщества тоже загружаются в рабочем столе, включая файлы kohya, LoCon и speed-LoRA, такие как Lightning и LCM. Всё, что выходит за 77 токенов CLIP, кодируется по частям так же, как это делает ComfyUI, поэтому длинные подписи больше не обрезаются.
Файнтюнинг каждой модели
Теперь файнтюнинг это один пункт Kind of training на вкладке Training для всех шести моделей, и он нов для Klein 9B, SDXL и Anima. Каждый запуск записывает полный checkpoint, который заменяет базовый файл.
Больше всего изменилось планирование памяти. Файнтюнинг упаковывает в каждый проход столько частей модели, сколько вмещает карта, вместо того чтобы всегда обучать по одной части, и при необходимости стримит из системной памяти блоки, которые не обучаются. На достаточно большой карте вся модель обучается за один проход, на маленькой карте работа разбивается.
| Модель | Файнтюнинг от | Вся модель за один проход от |
|---|---|---|
| Anima | 8 ГБ | 10 ГБ |
| SDXL | 8 ГБ | 10 ГБ |
| Qwen Image 2.1 | 12 ГБ | 24 ГБ |
| Klein 9B | 16 ГБ | 32 ГБ |
| Krea 2 | 16 ГБ | 48 ГБ |
| MiniMax H3 | 16 ГБ | 48 ГБ |
На карте с 32 ГБ Krea 2 требует два прохода вместо четырёх, а MiniMax H3 три. В тестах автора обучение всего вместе проходило по всей модели примерно в 2,6 раза быстрее, чем четыре отдельных прохода (измерения проводились на Anima). Новая настройка Window size ограничивает число частей, обучаемых вместе, для карт, близких к своему пределу, а вкладка Training показывает план для текущей карты ещё до начала запуска.
Инструменты рабочего стола (здесь показан вид подготовки видеоклипа Gizmo) работают на каждой модели и теперь используют один интерфейс драйвера.
Система драйверов завершена
Klein и MiniMax H3 теперь работают на той же системе драйверов, что и Krea 2, Qwen Image 2.1, SDXL и Anima. Модель описывается один раз: её файлы, формат LoRA и код модели за стандартным интерфейсом, и обучение, превью, загрузки, планирование памяти и все пять инструментов рабочего стола работают исходя из этого описания.
На практике это означает, что функция, созданная для одной модели, становится доступна остальным, а сообщество может добавлять модели. Руководство по написанию драйвера рассказывает, откуда вызывается код, содержит пошаговые разборы для модели изображений и видеомодели, все опциональные возможности и чек-лист того, что должна включать завершённая модель. SDXL, Anima и Qwen Image 2.1 были созданы по этому руководству, и pull request'ы для новых или старых моделей приветствуются.
Обновления рабочего стола
- Repair Studio теперь перерисовывает только блоки после изменения ползунка, на каждой модели, с тем же изображением, что и при полном рендере. Включён по умолчанию и может быть отключён в карточке Setup.
- Checkpoint to LoRA работает с любым файнтюнингом, включая SDXL и Anima. Он конвертирует файнтюнинг-checkpoint в LoRA с выбранными рангами; автор отмечает, что LoRA, извлечённая из файнтюнинга, получается сильнее, чем обученная напрямую с тем же рангом.
- LoHa LoRA загружаются в Profiler и Extract. Extract превращает LoHa в стандартную LoRA.
- Негативные промпты получили полноценное многострочное поле с модель-специфичным значением по умолчанию, которое запоминает правки. Бесконфликтные исключения теперь хранятся отдельно для каждой модели, так что исключение Krea 2 больше не влияет на SDXL на тех же фото.
- Загружается больше форматов LoRA: LoRA для SDXL, сохранённые с именованием diffusers, теперь работают везде, наряду с файлами kohya, LyCORIS, PEFT и в стиле ComfyUI.
Сохранённые LoRA, LoKR, результаты сохранения Repair Studio и выходы Extract сохраняют тот же формат и загружаются через стандартный загрузчик LoRA в ComfyUI.
Как получить
Существующие установки обновляются через update_fizgig.bat или update_fizgig_rocm.bat на AMD. Разделы Anima и SDXL на вкладке Preferences скачивают свои модели, а сохранённые настройки H3 переносятся.
.safetensors, которые сразу попадают в ComfyUI/models/loras/.
Комментарии
Войдите через GitHub, чтобы участвовать в обсуждении.