Qwen-Image: наконец-то читаемый текст на картинке
Постеры, обложки, вывески и макеты с настоящими буквами - и редактирование готового изображения
Что такое Qwen-Image и Qwen-Image-Edit, почему открытые модели годами не умели рисовать текст и как Qwen это исправила. Когда брать Qwen вместо FLUX, чем она отличается от закрытого Ideogram, как редактировать готовую картинку и менять текст на ней прямо в ComfyUI.
Боль, которую все терпели
Сделай в старой модели постер с надписью «Кофейня на углу» - и получишь картинку с буквами-инопланетянами: «Коффейня нв угле», «Koffeynaa». Текст на картинке был ахиллесовой пятой генерации. Поэтому дизайнеры рисовали фон в нейросети, а буквы потом дописывали руками в редакторе.
В 2026-м эту боль закрыла Qwen-Image Qwen-Image - модель генерации картинок от Alibaba (команда Qwen) на 20 млрд параметров, архитектура MMDiT. Лицензия Apache 2.0 - можно использовать свободно, включая коммерцию. Главная фишка - аккуратный, читаемый текст прямо на изображении. . Это первая открытая модель, которая рисует настоящие читаемые буквы - и по-русски, и по-английски, и на иероглифах.
Где Qwen-Image незаменима
- Постеры и афиши - заголовок, дата, место прямо в картинке, без дорисовки.
- Обложки для канала, подкаста, видео - с названием, которое реально читается.
- Вывески и упаковка - текст на коробке, витрине, этикетке выглядит как настоящий.
- Макеты интерфейса - кнопки, меню, подписи в дизайне приложения за один прогон.
- Мемы и карточки с подписью - текст не разваливается.
Простое правило: есть на картинке буквы, которые должны читаться, - первым делом пробуй Qwen-Image. Нет букв, нужна просто красивая сцена - часто удобнее FLUX.2.
Qwen-Image-Edit: переписать, а не перерисовать
У Qwen есть младшая сестра под редактирование - Qwen-Image-Edit Qwen-Image-Edit - версия Qwen-Image для редактирования готовых изображений (база 20 млрд параметров). Умеет менять объекты, собирать картинку из нескольких входных, работать со слоями и - главное - аккуратно переписывать текст на уже существующей картинке. . Она работает не с нуля, а с уже готовой картинкой:
- поменять надпись на вывеске, не трогая саму вывеску;
- убрать или подставить объект;
- собрать новую сцену из одной-трёх входных картинок;
- править аккуратно, не разрушая остальное изображение.
Это закрывает кучу рутины. Сгенерировал постер, а в дате опечатка? Не перегенеришь всё заново и не молишься, чтобы вышло так же удачно, - просто переписываешь дату через Edit.
Qwen против Ideogram - открытое против закрытого
Тебе наверняка попадётся Ideogram - сервис, который тоже славится текстом на картинке. Разница принципиальная.
- Качаешь и крутишь локально - бесплатно, без интернета, без чужих серверов.
- Работает в ComfyUI - встраивается в любой твой workflow.
- Лицензия Apache 2.0 - можно использовать коммерчески.
- Есть редактирование готовых картинок (Edit) и квантованные версии под слабое железо.
- Только через платный сервер - локально не запустить, веса закрыты.
- Платишь за каждую картинку и зависишь от чужого аптайма и правил.
- Не встроить в ComfyUI как обычную модель.
- Данные уходят на сторону - не всегда приемлемо для работы.
Ideogram бывает удобен как быстрый онлайн-инструмент. Но если хочешь держать всё у себя, без оплаты за кадр и с полным контролем - открытый ответ зовут Qwen-Image.
Как подключить в ComfyUI
Qwen-Image встроена в ComfyUI нативно - её поддержали ещё в 2025-м, и в свежей версии есть готовые шаблоны (templates). Общая логика та же, что с любым чекпоинтом из прошлой главы.
- Обнови ComfyUI до свежей версии - старая может не знать про Qwen.
- Скачай модель Qwen-Image с проверенной площадки. Слабое железо - бери версию с пометкой GGUF (квантованную).
- Положи файл в models (как обычный чекпоинт; шаблон подскажет точную папку).
- Открой готовый шаблон Qwen-Image из меню примеров ComfyUI.
- В промпте опиши сцену и явно укажи текст в кавычках. Запусти.
Частые ошибки с Qwen-Image
- Брать Qwen для картинок без текста. Если букв нет, часто красивее и быстрее сработает FLUX.2. Qwen - именно под текст.
- Не указывать текст явно. Напишешь «постер кофейни» - модель сама придумает надпись, и не всегда ту. Задавай слова в кавычках.
- Перегенерировать всё ради одной опечатки. Для правок есть Qwen-Image-Edit - меняй точечно.
- Ставить полную модель на слабую карту. Не помещается - бери GGUF-версию, она для этого и сделана.
- Искать Ideogram в ComfyUI. Его там нет. Открытый аналог - это Qwen.
TL;DR - если коротко
- Qwen-Image (Alibaba, 20 млрд параметров, лицензия Apache 2.0) - открытая модель, которая первой стала рисовать читаемый текст на картинке: русский, английский, китайский.
- Это про постеры, обложки, вывески, мемы и макеты интерфейса - всё, где на картинке должны быть настоящие буквы, а не каракули.
- Qwen-Image-Edit редактирует готовое изображение: меняет объекты и даже переписывает текст на нём, не перерисовывая всё заново.
- Ideogram делает похоже, но это закрытый платный API. Qwen - открытый ответ: качаешь и крутишь локально в ComfyUI бесплатно.
- Железо слабовато? Бери квантованную (GGUF) версию Qwen-Image - влезет в скромную видеокарту.