Токены в нейросетях

Иногда кажется, что генерировать изображения в нейросетях очень легко: написал запрос и тебе выпала картинка

Но, когда мы пишем запрос без определенной структуры, шанс, что получится нужная картинка с первого раза, невелик

Что же надо знать, чтобы получить с первого раза тот самый вариант?

Надо уметь использовать токены Токены — слова в промте, например «единорог» это токен, «зеленый» тоже токен

Есть некая система, как их использовать так, чтобы получить нужный результат:

1. Формат + Объект Формат — фото, иллюстрация, 3D рендер Объект — жираф, стул, единорог 2. Описание Цвет, материал, эмоции, поза, внешность 3. Фон 4. Дополнение Освещение, тип камеры, настройки камеры, стили известных художников, качество изображения