~9 мин

Qwen-Image: наконец-то читаемый текст на картинке

Постеры, обложки, вывески и макеты с настоящими буквами - и редактирование готового изображения

Что такое Qwen-Image и Qwen-Image-Edit, почему открытые модели годами не умели рисовать текст и как Qwen это исправила. Когда брать Qwen вместо FLUX, чем она отличается от закрытого Ideogram, как редактировать готовую картинку и менять текст на ней прямо в ComfyUI.

Боль, которую все терпели

Сделай в старой модели постер с надписью «Кофейня на углу» - и получишь картинку с буквами-инопланетянами: «Коффейня нв угле», «Koffeynaa». Текст на картинке был ахиллесовой пятой генерации. Поэтому дизайнеры рисовали фон в нейросети, а буквы потом дописывали руками в редакторе.

В 2026-м эту боль закрыла Qwen-Image . Это первая открытая модель, которая рисует настоящие читаемые буквы - и по-русски, и по-английски, и на иероглифах.

Sodi показывает чистый постер с читаемым текстом рядом со смятым постером с каракулями
Слева - каракули старых моделей. Справа - читаемый текст от Qwen-Image.

Где Qwen-Image незаменима

  • Постеры и афиши - заголовок, дата, место прямо в картинке, без дорисовки.
  • Обложки для канала, подкаста, видео - с названием, которое реально читается.
  • Вывески и упаковка - текст на коробке, витрине, этикетке выглядит как настоящий.
  • Макеты интерфейса - кнопки, меню, подписи в дизайне приложения за один прогон.
  • Мемы и карточки с подписью - текст не разваливается.

Простое правило: есть на картинке буквы, которые должны читаться, - первым делом пробуй Qwen-Image. Нет букв, нужна просто красивая сцена - часто удобнее FLUX.2.

Qwen-Image-Edit: переписать, а не перерисовать

У Qwen есть младшая сестра под редактирование - Qwen-Image-Edit . Она работает не с нуля, а с уже готовой картинкой:

  • поменять надпись на вывеске, не трогая саму вывеску;
  • убрать или подставить объект;
  • собрать новую сцену из одной-трёх входных картинок;
  • править аккуратно, не разрушая остальное изображение.

Это закрывает кучу рутины. Сгенерировал постер, а в дате опечатка? Не перегенеришь всё заново и не молишься, чтобы вышло так же удачно, - просто переписываешь дату через Edit.

Qwen против Ideogram - открытое против закрытого

Тебе наверняка попадётся Ideogram - сервис, который тоже славится текстом на картинке. Разница принципиальная.

Qwen-Image (открытая)
  • Качаешь и крутишь локально - бесплатно, без интернета, без чужих серверов.
  • Работает в ComfyUI - встраивается в любой твой workflow.
  • Лицензия Apache 2.0 - можно использовать коммерчески.
  • Есть редактирование готовых картинок (Edit) и квантованные версии под слабое железо.
Ideogram (закрытый API)
  • Только через платный сервер - локально не запустить, веса закрыты.
  • Платишь за каждую картинку и зависишь от чужого аптайма и правил.
  • Не встроить в ComfyUI как обычную модель.
  • Данные уходят на сторону - не всегда приемлемо для работы.

Ideogram бывает удобен как быстрый онлайн-инструмент. Но если хочешь держать всё у себя, без оплаты за кадр и с полным контролем - открытый ответ зовут Qwen-Image.

Как подключить в ComfyUI

Qwen-Image встроена в ComfyUI нативно - её поддержали ещё в 2025-м, и в свежей версии есть готовые шаблоны (templates). Общая логика та же, что с любым чекпоинтом из прошлой главы.

Запуск Qwen-Image - по шагам
  1. Обнови ComfyUI до свежей версии - старая может не знать про Qwen.
  2. Скачай модель Qwen-Image с проверенной площадки. Слабое железо - бери версию с пометкой GGUF (квантованную).
  3. Положи файл в models (как обычный чекпоинт; шаблон подскажет точную папку).
  4. Открой готовый шаблон Qwen-Image из меню примеров ComfyUI.
  5. В промпте опиши сцену и явно укажи текст в кавычках. Запусти.

Частые ошибки с Qwen-Image

  • Брать Qwen для картинок без текста. Если букв нет, часто красивее и быстрее сработает FLUX.2. Qwen - именно под текст.
  • Не указывать текст явно. Напишешь «постер кофейни» - модель сама придумает надпись, и не всегда ту. Задавай слова в кавычках.
  • Перегенерировать всё ради одной опечатки. Для правок есть Qwen-Image-Edit - меняй точечно.
  • Ставить полную модель на слабую карту. Не помещается - бери GGUF-версию, она для этого и сделана.
  • Искать Ideogram в ComfyUI. Его там нет. Открытый аналог - это Qwen.

TL;DR - если коротко

  • Qwen-Image (Alibaba, 20 млрд параметров, лицензия Apache 2.0) - открытая модель, которая первой стала рисовать читаемый текст на картинке: русский, английский, китайский.
  • Это про постеры, обложки, вывески, мемы и макеты интерфейса - всё, где на картинке должны быть настоящие буквы, а не каракули.
  • Qwen-Image-Edit редактирует готовое изображение: меняет объекты и даже переписывает текст на нём, не перерисовывая всё заново.
  • Ideogram делает похоже, но это закрытый платный API. Qwen - открытый ответ: качаешь и крутишь локально в ComfyUI бесплатно.
  • Железо слабовато? Бери квантованную (GGUF) версию Qwen-Image - влезет в скромную видеокарту.

Поиск по вики

Нажмите Esc для закрытия

Введите запрос для мгновенного поиска по всем страницам курсов и уроков.