Все говорили, что нейросети не умеют текст в картинках. Я сама повторяла это как мантру — и вот надо пересматривать.

Qwen 3 Image вышел с заявкой, которую сложно игнорировать: разборчивый текст размером до 10 пикселей, 12 языков, 20+ шрифтов и инструкции длиной до 4500 токенов. То есть вы буквально можете описать макет целой газетной полосы — и модель попытается его собрать.

Я взяла это и проверила на практике. Вот что реально работает и как это повторить.

Где это даёт результат

Забудьте про «сгенерировать красивую картинку». Qwen 3 Image — это инструмент для верстальных задач: инфографики, схемы с подписями, интерфейсные макеты, страницы с формулами. Всё то, где раньше надо было либо лезть в Figma, либо просить дизайнера.

Сценарии, где я вижу реальный смысл:

— быстрый черновик инфографики для поста или презентации — схема процесса с подписанными блоками — макет экрана с текстом для согласования (не для продакшена, но для идеи — отлично) — визуализация научной структуры или формульного блока

Как писать промт, чтобы получить что-то путное

Главная ошибка — писать как для Midjourney: «красивая инфографика про X». Здесь работает другой принцип. Модель понимает верстальные инструкции, поэтому промт должен выглядеть как техзадание, а не как описание настроения.

Вот шаблон, который я использую:

Создай инфографику на тему [тема]. Структура: [перечисли блоки — заголовок, 3-4 пункта с иконками, вывод внизу]. Шрифт: чёткий sans-serif, текст читаемый, минимальный размер — не мельче 12px. Язык: русский. Стиль: [минималистичный / деловой / научный]. Цветовая схема: [опиши или назови 2-3 цвета].

Нюанс: чем подробнее вы описываете структуру — тем меньше модель фантазирует и тем ближе результат к тому, что вам нужно. 4500 токенов — это не ограничение, это приглашение быть конкретными.

Типичные ошибки

Первое — ждать полиграфного качества. Это черновик и прототип, не финальный макет. Используйте как отправную точку.

Второе — короткий промт. Чем меньше деталей, тем больше модель додумывает сама — и не всегда удачно.

Третье — не указывать язык. По умолчанию может поехать в английский или смешать оба.

Воркфлоу, который я теперь применяю

1. Формулирую структуру инфографики текстом (буквально: «блок 1 — заголовок, блок 2 — три факта с иконками, блок 3 — вывод») 2. Вставляю в промт-шаблон выше, уточняю стиль и цвета 3. Генерирую 2-3 варианта, выбираю ближайший 4. Дорабатываю в Canva или Figma — меняю шрифты, подгоняю цвета под бренд

Итого: вместо «нарисуй с нуля в Figma за час» — «получи черновик за 2 минуты, доведи за 15».

Генераторы изображений наконец перестали соревноваться только с художниками — и начали конкурировать с дизайнерами. Это другая история.

📻 Подписывайся на В эфире радио Свеклана


В этом посте были ссылки, но мы их удалили по правилам Сетки