Ming-Image 0.1 Design: модель 6B для UI, инфографики и постеров

ComfyUI Wiki

Ming-Image 0.1 Design: это 6B text-to-image модель для UI, инфографики и постеров с выводом RGBA с прозрачностью и поддержкой ComfyUI в процессе разработки.

M

Ming-Image 0.1 Design

Text-to-ImageДизайн UIПрозрачность RGBAРендеринг текста

Открытая 6B text-to-image модель от inclusionAI, созданная для визуального дизайна, а не для фотографии. Она компонует UI-экраны, дашборды, инфографику, постеры и другие макеты с большим количеством текста, а также умеет создавать RGBA-изображение с настоящим альфа-каналом для вывода, готового к композитингу.

РазработчикinclusionAI
Дата выпуска2026-09-17
Архитектура6B diffusion transformer (на базе Z-Image) с текстовым энкодером vision-language
Параметры6B
ЛицензияMIT
Разрешение1024 x 1024 или 2048 x 2048
Выборка12 шагов, CFG 1.0

Возможности

  • Генерация дизайна: UI-экраны, дашборды, адаптивные макеты карточек, инфографика, постеры и наборы логотипов
  • Рендеринг текста: макеты строятся вокруг разборчиво отрисованного текста, а не случайных подписей
  • Прозрачность RGBA: опциональный вывод с прозрачным фоном для ассетов, которые потом композитятся в другом месте
  • Улучшение промпта: официальный pipeline переписывает промпты с помощью Ling-3.0-flash-VL или qwen3.8-27B ДО выборки
  • Два варианта вывода: 1024 для быстрой итерации, 2048 для полноценных макетов

Связанное

Guides and workflows related to this model series.

No articles found.

Комментарии

Войдите через GitHub, чтобы участвовать в обсуждении.

Загрузка комментариев…