Fizgig v7: Anima, SDXL и файнтюнинг для каждой модели

ComfyUI Wikinews

Fizgig v7 добавляет обучение Anima и SDXL, файнтюнинг всех шести моделей от карт на 8 ГБ и систему драйверов, расширяемую сообществом.

Fizgig v7.0.0, выпущенная 5 октября, добавляет Anima и SDXL в студию и превращает полный файнтюнинг в возможность каждой поддерживаемой модели (GitHub | заметки о выпуске | руководство по драйверам). Патч v7.0.1 вышел в тот же день.

Студия LoRA и файнтюнинга Fizgig

Fizgig: рабочий стол для обучения, файнтюнинга, восстановления и исследования моделей Flux 2 Klein 9B, Krea 2, MiniMax H3, Qwen Image 2.1, SDXL и Anima

Студия уже умела обучать LoRA, LoKR и файнтюнинги для Flux 2 Klein, Krea 2, MiniMax H3 и Qwen Image 2.1. Версия 7 закрывает сразу два пробела: она добавляет два самых востребованных старых семейства и делает весь рабочий стол доступным для любой модели, которую описывает драйвер сообщества.

Две новые базовые модели

МодельПримечания
Anima (экспериментальное)Аниме- и иллюстрационная модель от CircleStone Labs с полным рабочим столом. Её некоммерческая лицензия сохраняется.
SDXL (экспериментальное)Любой однофайловый checkpoint SDXL. Его VAE и текстовые энкодеры читаются прямо из checkpoint. Juggernaut XL v9 это загрузка по умолчанию, рядом предлагается Illustrious XL.

Обе поставляются с пресетами LoRA и LoKR, slider-LoRA из пар промптов или пар фото и файнтюнингом. Anima получает пресет Character, пресет Style и собственный рецепт Official из карточки модели; SDXL получает пресеты Strong, Standard и Slider с включённым EMA. LoRA для SDXL от сообщества тоже загружаются в рабочем столе, включая файлы kohya, LoCon и speed-LoRA, такие как Lightning и LCM. Всё, что выходит за 77 токенов CLIP, кодируется по частям так же, как это делает ComfyUI, поэтому длинные подписи больше не обрезаются.

Файнтюнинг каждой модели

Теперь файнтюнинг это один пункт Kind of training на вкладке Training для всех шести моделей, и он нов для Klein 9B, SDXL и Anima. Каждый запуск записывает полный checkpoint, который заменяет базовый файл.

Больше всего изменилось планирование памяти. Файнтюнинг упаковывает в каждый проход столько частей модели, сколько вмещает карта, вместо того чтобы всегда обучать по одной части, и при необходимости стримит из системной памяти блоки, которые не обучаются. На достаточно большой карте вся модель обучается за один проход, на маленькой карте работа разбивается.

МодельФайнтюнинг отВся модель за один проход от
Anima8 ГБ10 ГБ
SDXL8 ГБ10 ГБ
Qwen Image 2.112 ГБ24 ГБ
Klein 9B16 ГБ32 ГБ
Krea 216 ГБ48 ГБ
MiniMax H316 ГБ48 ГБ

На карте с 32 ГБ Krea 2 требует два прохода вместо четырёх, а MiniMax H3 три. В тестах автора обучение всего вместе проходило по всей модели примерно в 2,6 раза быстрее, чем четыре отдельных прохода (измерения проводились на Anima). Новая настройка Window size ограничивает число частей, обучаемых вместе, для карт, близких к своему пределу, а вкладка Training показывает план для текущей карты ещё до начала запуска.

Рабочий стол Fizgig

Инструменты рабочего стола (здесь показан вид подготовки видеоклипа Gizmo) работают на каждой модели и теперь используют один интерфейс драйвера.

Система драйверов завершена

Klein и MiniMax H3 теперь работают на той же системе драйверов, что и Krea 2, Qwen Image 2.1, SDXL и Anima. Модель описывается один раз: её файлы, формат LoRA и код модели за стандартным интерфейсом, и обучение, превью, загрузки, планирование памяти и все пять инструментов рабочего стола работают исходя из этого описания.

На практике это означает, что функция, созданная для одной модели, становится доступна остальным, а сообщество может добавлять модели. Руководство по написанию драйвера рассказывает, откуда вызывается код, содержит пошаговые разборы для модели изображений и видеомодели, все опциональные возможности и чек-лист того, что должна включать завершённая модель. SDXL, Anima и Qwen Image 2.1 были созданы по этому руководству, и pull request'ы для новых или старых моделей приветствуются.

Обновления рабочего стола

  • Repair Studio теперь перерисовывает только блоки после изменения ползунка, на каждой модели, с тем же изображением, что и при полном рендере. Включён по умолчанию и может быть отключён в карточке Setup.
  • Checkpoint to LoRA работает с любым файнтюнингом, включая SDXL и Anima. Он конвертирует файнтюнинг-checkpoint в LoRA с выбранными рангами; автор отмечает, что LoRA, извлечённая из файнтюнинга, получается сильнее, чем обученная напрямую с тем же рангом.
  • LoHa LoRA загружаются в Profiler и Extract. Extract превращает LoHa в стандартную LoRA.
  • Негативные промпты получили полноценное многострочное поле с модель-специфичным значением по умолчанию, которое запоминает правки. Бесконфликтные исключения теперь хранятся отдельно для каждой модели, так что исключение Krea 2 больше не влияет на SDXL на тех же фото.
  • Загружается больше форматов LoRA: LoRA для SDXL, сохранённые с именованием diffusers, теперь работают везде, наряду с файлами kohya, LyCORIS, PEFT и в стиле ComfyUI.

Сохранённые LoRA, LoKR, результаты сохранения Repair Studio и выходы Extract сохраняют тот же формат и загружаются через стандартный загрузчик LoRA в ComfyUI.

Как получить

Существующие установки обновляются через update_fizgig.bat или update_fizgig_rocm.bat на AMD. Разделы Anima и SDXL на вкладке Preferences скачивают свои модели, а сохранённые настройки H3 переносятся.

Fizgig это самостоятельный тренер, а не нода ComfyUI: он сохраняет LoRA в формате kohya .safetensors, которые сразу попадают в ComfyUI/models/loras/.

Комментарии

Войдите через GitHub, чтобы участвовать в обсуждении.

Загрузка комментариев…
Fizgig v7: Anima, SDXL и файнтюнинг для каждой модели | ComfyUI Wiki