Все говорили, что нейросети не умеют текст в картинках. Я сама повторяла это как мантру — и вот надо пересматривать.
Qwen 3 Image вышел с заявкой, которую сложно игнорировать: разборчивый текст размером до 10 пикселей, 12 языков, 20+ шрифтов и инструкции длиной до 4500 токенов. То есть вы буквально можете описать макет целой газетной полосы — и модель попытается его собрать.
Я взяла это и проверила на практике. Вот что реально работает и как это повторить.
Где это даёт результат
Забудьте про «сгенерировать красивую картинку». Qwen 3 Image — это инструмент для верстальных задач: инфографики, схемы с подписями, интерфейсные макеты, страницы с формулами. Всё то, где раньше надо было либо лезть в Figma, либо просить дизайнера.
Сценарии, где я вижу реальный смысл:
— быстрый черновик инфографики для поста или презентации — схема процесса с подписанными блоками — макет экрана с текстом для согласования (не для продакшена, но для идеи — отлично) — визуализация научной структуры или формульного блока
Как писать промт, чтобы получить что-то путное
Главная ошибка — писать как для Midjourney: «красивая инфографика про X». Здесь работает другой принцип. Модель понимает верстальные инструкции, поэтому промт должен выглядеть как техзадание, а не как описание настроения.
Вот шаблон, который я использую:
Создай инфографику на тему [тема]. Структура: [перечисли блоки — заголовок, 3-4 пункта с иконками, вывод внизу]. Шрифт: чёткий sans-serif, текст читаемый, минимальный размер — не мельче 12px. Язык: русский. Стиль: [минималистичный / деловой / научный]. Цветовая схема: [опиши или назови 2-3 цвета].
Нюанс: чем подробнее вы описываете структуру — тем меньше модель фантазирует и тем ближе результат к тому, что вам нужно. 4500 токенов — это не ограничение, это приглашение быть конкретными.
Типичные ошибки
Первое — ждать полиграфного качества. Это черновик и прототип, не финальный макет. Используйте как отправную точку.
Второе — короткий промт. Чем меньше деталей, тем больше модель додумывает сама — и не всегда удачно.
Третье — не указывать язык. По умолчанию может поехать в английский или смешать оба.
Воркфлоу, который я теперь применяю
1. Формулирую структуру инфографики текстом (буквально: «блок 1 — заголовок, блок 2 — три факта с иконками, блок 3 — вывод») 2. Вставляю в промт-шаблон выше, уточняю стиль и цвета 3. Генерирую 2-3 варианта, выбираю ближайший 4. Дорабатываю в Canva или Figma — меняю шрифты, подгоняю цвета под бренд
Итого: вместо «нарисуй с нуля в Figma за час» — «получи черновик за 2 минуты, доведи за 15».
Генераторы изображений наконец перестали соревноваться только с художниками — и начали конкурировать с дизайнерами. Это другая история.
📻 Подписывайся на В эфире радио Свеклана
В этом посте были ссылки, но мы их удалили по правилам Сетки