Нейросеть картинки по описанию: как создать
Нейросеть картинки по описанию делает так: вы пишете фразу — она рисует кадр. Звучит просто, но между «получилось что-то похожее» и «получилось именно то, что нужно» лежит навык формулировки. В этом уроке разберём его на модели Grok Imagine Image 2.0: она стоит 3 рубля за кадр, поэтому тренироваться на ней не страшно, а результат при этом уровня платных стоков.

Что такое нейросеть картинки по описанию и когда она нужна
Генерация по описанию заменяет три привычных пути: поиск на фотостоке, съёмку и работу дизайнера над простым макетом. Вы формулируете сцену словами — модель собирает её с нуля. Ни лицензий, ни поиска «то же самое, но с другого ракурса», ни ожидания подрядчика.
Grok Imagine Image 2.0 — модель компании xAI, вторая версия их генератора изображений. В кабинете она открывает список моделей раздела «Картинка». Три вещи, ради которых её стоит взять в работу:
- Цена. 3 рубля за кадр — можно делать серии, а не беречь каждую попытку.
- Кириллица. Надписи на русском выходят ровными: заголовок баннера, подпись, адрес сайта.
- Доработка. Готовый кадр можно поправить фразой, не пересоздавая его целиком.
Для кого этот урок
Владельцу небольшого бизнеса. Нужны картинки для соцсетей, сайта и рекламы, а бюджета на фотосессию нет. После урока вы сможете собрать месячный запас визуала за пару часов и сотню рублей.
Маркетологу и таргетологу. Креативы нужны десятками, гипотезы проверяются перебором. Дешёвая модель снимает вопрос «а не жалко ли попробовать ещё вариант».
Автору и SMM-специалисту. Иллюстрация к посту нужна каждый день, а стоки дают одинаковые лица. Здесь у вас будет своя картинка под конкретный текст.
Новичку в нейросетях. Это самый мягкий вход: ошибка стоит три рубля, а интерфейс не требует настроек.
Как создать картинку нейросетью: пошагово
- Откройте раздел «Картинка». В кабинете это вкладка в верхнем меню, прямая ссылка — lk.vibemarketolog.ru/image. Если вы ещё не заходили, сначала будет короткая регистрация: новым пользователям начисляется 100 рублей на счёт.
- Выберите модель. Grok Imagine Image 2.0 стоит первой в списке, под её названием указана цена — 3 ₽. Карточка подсвечивается рамкой, когда выбрана.
- Выберите формат кадра. Ряд кнопок под полем описания: 1:1 — квадрат для поста, 9:16 — сторис и Reels, 16:9 — баннер и обложка, 3:2 и 2:3 — классические фото-пропорции.
- Опишите сцену. Пишите по-русски, обычными словами. Что в кадре, где происходит, какой свет, какое настроение. Про то, как формулировать, — следующий раздел урока.
- Проверьте цену на кнопке. Кнопка внизу показывает точную сумму: «Создать за 3 ₽». Она всегда честная — списывается ровно столько.
- Нажмите и подождите. Обычно кадр готов примерно за минуту. Можно свернуть генерацию в фон и заняться другим — результат появится в галерее.
- Оцените результат. Под картинкой есть кнопки: «Создать ещё», «Доработать», «Скачать». Готовый файл сразу сохраняется в вашей галерее.
Три правила описания, которые экономят попытки

Правило первое: опишите свет
Свет — то, что отличает «картинку из нейросети» от кадра, похожего на настоящую съёмку. У этой модели освещение проработано особенно хорошо, и она отзывается на такие формулировки:
- «тёплый закатный свет из окна» — уютная домашняя сцена;
- «мягкий рассеянный студийный свет» — предметная съёмка, каталог;
- «контровой свет по краю предмета» — премиальная подача, тёмный фон;
- «пасмурный день, ровное освещение» — спокойный документальный кадр.
Сравните: «чашка кофе на столе» и «керамическая чашка кофе на деревянном столе, тёплый утренний свет из окна сбоку, мягкие тени, размытый фон кухни». Второе описание даёт кадр, который не стыдно поставить на сайт.
Правило второе: надпись — в кавычках и коротко
Если на изображении нужен текст, задайте его дословно и скажите, где он стоит: надпись «Свежая выпечка» крупно в верхней трети, тёмным по светлому. Так модель понимает, что это не описание сцены, а буквы, которые надо нарисовать.
Одна-две короткие надписи выходят чисто. Если требовать пять-шесть подписей мелким шрифтом, начнутся ошибки — это общая слабость генеративных моделей, а не только этой. Когда нужен плотный текстовый макет, разумнее сгенерировать фон здесь, а подписи добавить в любом редакторе.
Правило третье: назовите формат до генерации
Формат кадра выбирается кнопкой, но полезно продублировать его смысл словами: «вертикальный кадр для сторис», «широкий баннер». Модель принимает пять пропорций: 1:1, 2:3, 3:2, 16:9 и 9:16. Если выбрать формат, которого у неё нет, сервис подберёт ближайший — генерация не сорвётся.
Доработка: как поправить кадр, не потеряв его
Это главная особенность модели, ради которой стоит разобраться отдельно. Обычно недовольство деталью означает новую генерацию: вы меняете описание, нажимаете «Создать» — и получаете другую картинку целиком. Другой ракурс, другая посуда, другое лицо.

Здесь иначе. Под готовым результатом нажмите «Доработать» — откроется поле «Что изменить в этой картинке?». Напишите одну фразу о правке:
- «замени фон на тёмный графитовый»;
- «добавь пар над чашкой»;
- «сделай свет теплее, как на закате»;
- «убери лишние предметы справа».
Модель вернёт тот же кадр с внесённой правкой: композиция, герой и надписи останутся на месте. Стоит это те же 3 рубля.
Важное ограничение: доработать можно только своё изображение, созданное этой же моделью. Загрузить постороннее фото сюда нельзя — для работы с вашими снимками в кабинете есть другие инструменты, о них рассказывает урок про генерацию изображений.
Попробуйте прямо сейчас: приветственного бонуса хватит примерно на 33 картинки.
Создать картинкуПополнить балансРазбор режимов и соседних инструментов
Создание с нуля и работа по фото
В разделе есть переключатель «Создать с нуля» и «Редактировать фото». Grok Imagine 2.0 работает в первом режиме: она рисует кадр по тексту. Если нужно изменить вашу собственную фотографию — платформа подскажет и предложит переключиться на Nano Banana 2, которая умеет работать с загруженными изображениями.
Стиль бренда
Если в профиле заполнен Brand Voice, платформа подмешивает фирменный стиль в генерации — палитру, тон, характер визуала. У этой модели стиль-референс при создании с нуля не поддерживается, о чём кабинет честно пишет прямо под полем описания.
Где ещё доступна эта модель
Кроме раздела «Картинка», модель работает в трёх местах: в Вайб-Контекстологе — при генерации креативов для Яндекс Директа и каруселей РСЯ; в нодовом конструкторе Вайб Студии; и у Вайб-Агента, который может сгенерировать картинку сам в рамках задачи.
Чем описание для нейросети отличается от обычного текста
Главная ошибка новичка — писать модели так, как пишут человеку. Дизайнеру достаточно сказать «сделай красиво и по-осеннему», он додумает остальное из опыта и знания вашего бизнеса. Нейросеть картинки по описанию не додумывает — она буквально собирает то, что вы перечислили, а недосказанное заполняет средним по всему интернету. Отсюда и ощущение «получилось что-то безликое»: безликим был запрос.
Полезно держать в голове четыре слоя, из которых складывается любое хорошее описание.
Объект. Что именно в кадре: не «еда», а «круассан с шоколадом на керамической тарелке». Чем конкретнее существительное, тем меньше свободы у модели ошибиться.
Обстановка. Где это происходит: столешница, витрина, улица, студийный фон. Обстановка задаёт настроение сильнее, чем любые прилагательные вроде «уютный».
Свет. Самый недооценённый слой. Одна и та же сцена при «мягком утреннем свете из окна» и при «жёстком контровом свете» выглядит как работы двух разных фотографов.
Подача. Ракурс и характер картинки: вид сверху, крупный план, фотореализм или иллюстрация. Этот слой решает, впишется ли кадр в ваш визуальный стиль.
Когда все четыре слоя названы, описание получается длиной в одно-два предложения — и этого достаточно. Растекаться на абзац не нужно: лишние подробности начинают конкурировать друг с другом, и модель теряет главное.
Сколько попыток обычно уходит
Честный ориентир по нашему опыту: при описании из четырёх слоёв удачный кадр получается с первой или второй попытки, ещё одна-две уходят на доработку деталей. То есть готовая картинка обходится примерно в девять-двенадцать рублей вместе с правками — дешевле одной лицензии на стоковое фото.
Если попыток уходит пять и больше, дело почти всегда не в модели, а в запросе: он либо слишком общий, либо противоречивый. Классический пример противоречия — «минималистичная сцена с множеством деталей». Модель попробует угодить обеим частям и выдаст кашу.
Готовые описания под частые задачи
Чтобы не начинать с чистого листа, вот четыре рабочих заготовки. Подставьте свой предмет — остальное уже настроено так, чтобы кадр получился с первого раза.
Карточка товара для маркетплейса
«Керамическая кружка ручной работы на светлом бетонном столе, мягкий рассеянный студийный свет сверху, лёгкая тень, однотонный светло-серый фон, фотореализм, кадр сверху под небольшим углом»
Что здесь работает: названы материал и поверхность, задан тип света, фон описан отдельно, указан ракурс. Меняйте только первое существительное — и получите серию карточек в едином стиле.
Баннер для рекламы с надписью
«Рекламный баннер пекарни: свежие круассаны на деревянной доске справа, тёплый утренний свет, слева свободное место под текст, надпись „Свежая выпечка каждый день“ крупно слева вверху, тёмным по светлому»
Здесь важны три вещи: предмет отправлен в одну половину кадра, вторая явно объявлена свободной под текст, а сама надпись задана дословно в кавычках и с указанием места.
Иллюстрация к посту в соцсети
«Рабочий стол вида сверху: открытый блокнот, чашка кофе, очки и веточка эвкалипта на светлом дереве, естественный дневной свет из окна, спокойная атмосфера, квадратный кадр»
Приём «вид сверху» и перечисление трёх-четырёх предметов даёт узнаваемую стоковую композицию, которая одинаково хорошо смотрится и в ленте, и в статье.
Портрет для страницы «О нас»
«Портрет улыбающегося бариста в фартуке за стойкой кофейни, тёплый вечерний свет из окна сбоку, размытый фон с полками и кофемашиной, естественная мимика, фотореализм»
Для людей особенно важно описать свет и фон: без этого модель выдаёт нейтральный студийный кадр, который выглядит безлико.
Как проверить, что кадр готов к публикации
Быстрый чек-лист перед тем, как ставить картинку на сайт или в рекламу.
- Прочитайте надписи вслух. Если на кадре есть текст, проверьте каждую букву: генеративные модели иногда путают похожие символы, и заметить это проще проговаривая.
- Посчитайте предметы. Кружек должно быть столько, сколько вы просили, у людей — привычное количество пальцев. Это классическая слабость всех моделей.
- Посмотрите на края кадра. Там чаще всего остаются обрезанные объекты и странные детали, которые не видно в центре.
- Оцените свет. Тени должны падать в одну сторону: разнонаправленные тени сразу выдают искусственность.
- Если что-то не так — не пересоздавайте. Опишите правку в поле доработки: это дешевле и сохранит удачную часть кадра.
Сколько стоит
Оплата поштучная: списывается ровно за созданный кадр, подписки нет. Для сравнения — как модель встала в общий ряд.
| Модель | Цена | Когда выбирать |
|---|---|---|
| Z-Image | 1,2 ₽ | Черновики и фоны без текста |
| Grok Imagine Image 2.0 | 3 ₽ | Серии кадров, русский текст, правки словами |
| Qwen Image 3.0 | от 7 ₽ | Плотная вёрстка и надписи, работа по 10 фото |
| Nano Banana 2 Lite | 9 ₽ | Когда нужно очень быстро, около 4 секунд |
| Nano Banana 2 | от 15 ₽ | Поиск фактов в интернете внутри генерации |
| GPT-Image-2 | 19 ₽ | Разрешение до 4K и сложные сцены |
Доработка кадра стоит столько же, сколько генерация. Если генерация не удалась, деньги возвращаются на баланс автоматически.
Частые ошибки и как их избежать
- Слишком общее описание. «Красивая картинка про кофе» даёт случайный результат. Добавьте предмет, место, свет и настроение — четырёх деталей обычно достаточно.
- Текст без кавычек. Если написать «сделай надпись про доставку», модель придумает формулировку сама. Задавайте точные слова.
- Много надписей сразу. Пять-шесть подписей мелким шрифтом — риск ошибок в буквах. Оставьте одну-две главные.
- Попытка получить всё за один заход. Дешевле сделать базовый кадр и добрать детали доработкой, чем переписывать описание по кругу.
- Ожидание правок по чужому фото. Доработка работает только с картинками, созданными этой моделью. Для ваших снимков — другие инструменты кабинета.
- Перевод описания на английский. Не нужно: модель понимает русский, а на родном языке формулировки обычно точнее.
Частые вопросы
Сколько стоит одна картинка?
Три рубля. Доработка готового кадра — тоже три рубля. Подписки нет, деньги списываются с баланса личного кабинета за каждую генерацию.
Как создать картинку нейросетью бесплатно?
Полностью бесплатной генерации на платформе нет, но новым пользователям начисляется приветственный бонус 100 рублей — это примерно 33 изображения. Их хватает, чтобы разобраться и понять, подходит ли вам инструмент.
Нужен ли VPN или зарубежная карта?
Нет. Всё работает из России напрямую: оплата рублями, никаких аккаунтов на иностранных сервисах и обходных путей.
Модель точно пишет русский текст без ошибок?
Короткие надписи — заголовок, подпись, цена, адрес — выходят ровными. Для длинных текстовых блоков мелким шрифтом лучше подойдут GPT-Image-2 или Qwen Image 3.0, они специально сильны в типографике.
Почему не получается загрузить своё фото для правки?
Так устроена эта модель: она правит собственные генерации по их внутреннему идентификатору, а не по загруженному файлу. Чтобы отредактировать ваш снимок, переключитесь на Nano Banana 2, Qwen Image 3.0 или SeeDream 5 Pro — они принимают фото на вход.
Какие форматы кадра доступны?
Пять: 1:1, 2:3, 3:2, 16:9 и 9:16. Форматы 4:3 и 3:4 модель не знает — при их выборе сервис подставит ближайший подходящий, чтобы генерация не сорвалась после списания.
Сколько ждать результат?
Обычно около минуты. Это медленнее, чем у Nano Banana 2 Lite (там примерно четыре секунды), но втрое дешевле. Генерацию можно свернуть в фон и продолжить работать — картинка появится в галерее.
Где потом искать созданные картинки?
В галерее раздела и в общей истории генераций. Оттуда можно скачать файл, повторить удачный запрос или поделиться ссылкой. Как пользоваться историей, подробно разобрано в уроке про поиск старых генераций.
Советы напоследок
- Держите под рукой два-три своих удачных описания — их удобно переиспользовать, меняя только предмет.
- Для рекламных серий фиксируйте формулировку света и стиля, а меняйте только сюжет: так кадры будут выглядеть как один комплект.
- Начинайте с квадрата 1:1 — он прощает неточности композиции, а обрезать под другой формат всегда успеете.
- Если результат почти хорош, не переписывайте описание: одна фраза в поле доработки дешевле и точнее.
- Сравните модели на одном и том же описании — три рубля за пробу того стоят. Разбор соседней модели есть в уроке про Qwen Image 3.0, а быстрая Lite-модель — в этом разборе.
Что нового появилось вместе с этой моделью и почему она встала первой в списке — читайте в анонсе обновления.