Z-Image — фотореалистичное фото за 1,2 ₽ Veo 3.1 и Seedance — видео со звуком, от 120 ₽ Gemini Omni — говорящий персонаж с русской озвучкой GPT-5 и Claude 4.8 Opus — ответы от 3 ₽ Suno 5.5 — песня целиком за 99 ₽ Sora 2 и Kling 3 — уже внутри, за рубли Grok Video — рекламный ролик за 36 ₽ +20% бонусами к первому пополнению — до 6000 ₽
Изображения

Нейросеть картинки по описанию: как создать

Нейросеть картинки по описанию делает так: вы пишете фразу — она рисует кадр. Звучит просто, но между «получилось что-то похожее» и «получилось именно то, что нужно» лежит навык формулировки. В этом уроке разберём его на модели Grok Imagine Image 2.0: она стоит 3 рубля за кадр, поэтому тренироваться на ней не страшно, а результат при этом уровня платных стоков.

lk.vibemarketolog.ru/image
Как создать картинку нейросетью по описанию: раздел Картинка в личном кабинете
Раздел «Картинка»: модель выбрана, описание введено, кнопка показывает точную цену до нажатия.

Что такое нейросеть картинки по описанию и когда она нужна

Генерация по описанию заменяет три привычных пути: поиск на фотостоке, съёмку и работу дизайнера над простым макетом. Вы формулируете сцену словами — модель собирает её с нуля. Ни лицензий, ни поиска «то же самое, но с другого ракурса», ни ожидания подрядчика.

Grok Imagine Image 2.0 — модель компании xAI, вторая версия их генератора изображений. В кабинете она открывает список моделей раздела «Картинка». Три вещи, ради которых её стоит взять в работу:

  • Цена. 3 рубля за кадр — можно делать серии, а не беречь каждую попытку.
  • Кириллица. Надписи на русском выходят ровными: заголовок баннера, подпись, адрес сайта.
  • Доработка. Готовый кадр можно поправить фразой, не пересоздавая его целиком.

Для кого этот урок

Владельцу небольшого бизнеса. Нужны картинки для соцсетей, сайта и рекламы, а бюджета на фотосессию нет. После урока вы сможете собрать месячный запас визуала за пару часов и сотню рублей.

Маркетологу и таргетологу. Креативы нужны десятками, гипотезы проверяются перебором. Дешёвая модель снимает вопрос «а не жалко ли попробовать ещё вариант».

Автору и SMM-специалисту. Иллюстрация к посту нужна каждый день, а стоки дают одинаковые лица. Здесь у вас будет своя картинка под конкретный текст.

Новичку в нейросетях. Это самый мягкий вход: ошибка стоит три рубля, а интерфейс не требует настроек.

Как создать картинку нейросетью: пошагово

  1. Откройте раздел «Картинка». В кабинете это вкладка в верхнем меню, прямая ссылка — lk.vibemarketolog.ru/image. Если вы ещё не заходили, сначала будет короткая регистрация: новым пользователям начисляется 100 рублей на счёт.
  2. Выберите модель. Grok Imagine Image 2.0 стоит первой в списке, под её названием указана цена — 3 ₽. Карточка подсвечивается рамкой, когда выбрана.
  3. Выберите формат кадра. Ряд кнопок под полем описания: 1:1 — квадрат для поста, 9:16 — сторис и Reels, 16:9 — баннер и обложка, 3:2 и 2:3 — классические фото-пропорции.
  4. Опишите сцену. Пишите по-русски, обычными словами. Что в кадре, где происходит, какой свет, какое настроение. Про то, как формулировать, — следующий раздел урока.
  5. Проверьте цену на кнопке. Кнопка внизу показывает точную сумму: «Создать за 3 ₽». Она всегда честная — списывается ровно столько.
  6. Нажмите и подождите. Обычно кадр готов примерно за минуту. Можно свернуть генерацию в фон и заняться другим — результат появится в галерее.
  7. Оцените результат. Под картинкой есть кнопки: «Создать ещё», «Доработать», «Скачать». Готовый файл сразу сохраняется в вашей галерее.

Три правила описания, которые экономят попытки

Три правила промпта для нейросети: свет, текст в кавычках, формат кадра
Свет, точная надпись и формат кадра — три вещи, которые сильнее всего влияют на результат.

Правило первое: опишите свет

Свет — то, что отличает «картинку из нейросети» от кадра, похожего на настоящую съёмку. У этой модели освещение проработано особенно хорошо, и она отзывается на такие формулировки:

  • «тёплый закатный свет из окна» — уютная домашняя сцена;
  • «мягкий рассеянный студийный свет» — предметная съёмка, каталог;
  • «контровой свет по краю предмета» — премиальная подача, тёмный фон;
  • «пасмурный день, ровное освещение» — спокойный документальный кадр.

Сравните: «чашка кофе на столе» и «керамическая чашка кофе на деревянном столе, тёплый утренний свет из окна сбоку, мягкие тени, размытый фон кухни». Второе описание даёт кадр, который не стыдно поставить на сайт.

Правило второе: надпись — в кавычках и коротко

Если на изображении нужен текст, задайте его дословно и скажите, где он стоит: надпись «Свежая выпечка» крупно в верхней трети, тёмным по светлому. Так модель понимает, что это не описание сцены, а буквы, которые надо нарисовать.

Одна-две короткие надписи выходят чисто. Если требовать пять-шесть подписей мелким шрифтом, начнутся ошибки — это общая слабость генеративных моделей, а не только этой. Когда нужен плотный текстовый макет, разумнее сгенерировать фон здесь, а подписи добавить в любом редакторе.

Правило третье: назовите формат до генерации

Формат кадра выбирается кнопкой, но полезно продублировать его смысл словами: «вертикальный кадр для сторис», «широкий баннер». Модель принимает пять пропорций: 1:1, 2:3, 3:2, 16:9 и 9:16. Если выбрать формат, которого у неё нет, сервис подберёт ближайший — генерация не сорвётся.

Доработка: как поправить кадр, не потеряв его

Это главная особенность модели, ради которой стоит разобраться отдельно. Обычно недовольство деталью означает новую генерацию: вы меняете описание, нажимаете «Создать» — и получаете другую картинку целиком. Другой ракурс, другая посуда, другое лицо.

lk.vibemarketolog.ru/image
Доработка готовой картинки нейросетью: поле Что изменить в этой картинке
Под результатом появляется поле правки. Сцену заново описывать не нужно — только то, что меняем.

Здесь иначе. Под готовым результатом нажмите «Доработать» — откроется поле «Что изменить в этой картинке?». Напишите одну фразу о правке:

  • «замени фон на тёмный графитовый»;
  • «добавь пар над чашкой»;
  • «сделай свет теплее, как на закате»;
  • «убери лишние предметы справа».

Модель вернёт тот же кадр с внесённой правкой: композиция, герой и надписи останутся на месте. Стоит это те же 3 рубля.

Важное ограничение: доработать можно только своё изображение, созданное этой же моделью. Загрузить постороннее фото сюда нельзя — для работы с вашими снимками в кабинете есть другие инструменты, о них рассказывает урок про генерацию изображений.

Двадцать секунд о том, как это выглядит на практике.

Попробуйте прямо сейчас: приветственного бонуса хватит примерно на 33 картинки.

Создать картинкуПополнить баланс

Разбор режимов и соседних инструментов

Создание с нуля и работа по фото

В разделе есть переключатель «Создать с нуля» и «Редактировать фото». Grok Imagine 2.0 работает в первом режиме: она рисует кадр по тексту. Если нужно изменить вашу собственную фотографию — платформа подскажет и предложит переключиться на Nano Banana 2, которая умеет работать с загруженными изображениями.

Стиль бренда

Если в профиле заполнен Brand Voice, платформа подмешивает фирменный стиль в генерации — палитру, тон, характер визуала. У этой модели стиль-референс при создании с нуля не поддерживается, о чём кабинет честно пишет прямо под полем описания.

Где ещё доступна эта модель

Кроме раздела «Картинка», модель работает в трёх местах: в Вайб-Контекстологе — при генерации креативов для Яндекс Директа и каруселей РСЯ; в нодовом конструкторе Вайб Студии; и у Вайб-Агента, который может сгенерировать картинку сам в рамках задачи.

Чем описание для нейросети отличается от обычного текста

Главная ошибка новичка — писать модели так, как пишут человеку. Дизайнеру достаточно сказать «сделай красиво и по-осеннему», он додумает остальное из опыта и знания вашего бизнеса. Нейросеть картинки по описанию не додумывает — она буквально собирает то, что вы перечислили, а недосказанное заполняет средним по всему интернету. Отсюда и ощущение «получилось что-то безликое»: безликим был запрос.

Полезно держать в голове четыре слоя, из которых складывается любое хорошее описание.

Объект. Что именно в кадре: не «еда», а «круассан с шоколадом на керамической тарелке». Чем конкретнее существительное, тем меньше свободы у модели ошибиться.

Обстановка. Где это происходит: столешница, витрина, улица, студийный фон. Обстановка задаёт настроение сильнее, чем любые прилагательные вроде «уютный».

Свет. Самый недооценённый слой. Одна и та же сцена при «мягком утреннем свете из окна» и при «жёстком контровом свете» выглядит как работы двух разных фотографов.

Подача. Ракурс и характер картинки: вид сверху, крупный план, фотореализм или иллюстрация. Этот слой решает, впишется ли кадр в ваш визуальный стиль.

Когда все четыре слоя названы, описание получается длиной в одно-два предложения — и этого достаточно. Растекаться на абзац не нужно: лишние подробности начинают конкурировать друг с другом, и модель теряет главное.

Сколько попыток обычно уходит

Честный ориентир по нашему опыту: при описании из четырёх слоёв удачный кадр получается с первой или второй попытки, ещё одна-две уходят на доработку деталей. То есть готовая картинка обходится примерно в девять-двенадцать рублей вместе с правками — дешевле одной лицензии на стоковое фото.

Если попыток уходит пять и больше, дело почти всегда не в модели, а в запросе: он либо слишком общий, либо противоречивый. Классический пример противоречия — «минималистичная сцена с множеством деталей». Модель попробует угодить обеим частям и выдаст кашу.

Готовые описания под частые задачи

Чтобы не начинать с чистого листа, вот четыре рабочих заготовки. Подставьте свой предмет — остальное уже настроено так, чтобы кадр получился с первого раза.

Карточка товара для маркетплейса

«Керамическая кружка ручной работы на светлом бетонном столе, мягкий рассеянный студийный свет сверху, лёгкая тень, однотонный светло-серый фон, фотореализм, кадр сверху под небольшим углом»

Что здесь работает: названы материал и поверхность, задан тип света, фон описан отдельно, указан ракурс. Меняйте только первое существительное — и получите серию карточек в едином стиле.

Баннер для рекламы с надписью

«Рекламный баннер пекарни: свежие круассаны на деревянной доске справа, тёплый утренний свет, слева свободное место под текст, надпись „Свежая выпечка каждый день“ крупно слева вверху, тёмным по светлому»

Здесь важны три вещи: предмет отправлен в одну половину кадра, вторая явно объявлена свободной под текст, а сама надпись задана дословно в кавычках и с указанием места.

Иллюстрация к посту в соцсети

«Рабочий стол вида сверху: открытый блокнот, чашка кофе, очки и веточка эвкалипта на светлом дереве, естественный дневной свет из окна, спокойная атмосфера, квадратный кадр»

Приём «вид сверху» и перечисление трёх-четырёх предметов даёт узнаваемую стоковую композицию, которая одинаково хорошо смотрится и в ленте, и в статье.

Портрет для страницы «О нас»

«Портрет улыбающегося бариста в фартуке за стойкой кофейни, тёплый вечерний свет из окна сбоку, размытый фон с полками и кофемашиной, естественная мимика, фотореализм»

Для людей особенно важно описать свет и фон: без этого модель выдаёт нейтральный студийный кадр, который выглядит безлико.

Как проверить, что кадр готов к публикации

Быстрый чек-лист перед тем, как ставить картинку на сайт или в рекламу.

  • Прочитайте надписи вслух. Если на кадре есть текст, проверьте каждую букву: генеративные модели иногда путают похожие символы, и заметить это проще проговаривая.
  • Посчитайте предметы. Кружек должно быть столько, сколько вы просили, у людей — привычное количество пальцев. Это классическая слабость всех моделей.
  • Посмотрите на края кадра. Там чаще всего остаются обрезанные объекты и странные детали, которые не видно в центре.
  • Оцените свет. Тени должны падать в одну сторону: разнонаправленные тени сразу выдают искусственность.
  • Если что-то не так — не пересоздавайте. Опишите правку в поле доработки: это дешевле и сохранит удачную часть кадра.

Сколько стоит

Оплата поштучная: списывается ровно за созданный кадр, подписки нет. Для сравнения — как модель встала в общий ряд.

МодельЦенаКогда выбирать
Z-Image1,2 ₽Черновики и фоны без текста
Grok Imagine Image 2.03 ₽Серии кадров, русский текст, правки словами
Qwen Image 3.0от 7 ₽Плотная вёрстка и надписи, работа по 10 фото
Nano Banana 2 Lite9 ₽Когда нужно очень быстро, около 4 секунд
Nano Banana 2от 15 ₽Поиск фактов в интернете внутри генерации
GPT-Image-219 ₽Разрешение до 4K и сложные сцены

Доработка кадра стоит столько же, сколько генерация. Если генерация не удалась, деньги возвращаются на баланс автоматически.

Частые ошибки и как их избежать

  • Слишком общее описание. «Красивая картинка про кофе» даёт случайный результат. Добавьте предмет, место, свет и настроение — четырёх деталей обычно достаточно.
  • Текст без кавычек. Если написать «сделай надпись про доставку», модель придумает формулировку сама. Задавайте точные слова.
  • Много надписей сразу. Пять-шесть подписей мелким шрифтом — риск ошибок в буквах. Оставьте одну-две главные.
  • Попытка получить всё за один заход. Дешевле сделать базовый кадр и добрать детали доработкой, чем переписывать описание по кругу.
  • Ожидание правок по чужому фото. Доработка работает только с картинками, созданными этой моделью. Для ваших снимков — другие инструменты кабинета.
  • Перевод описания на английский. Не нужно: модель понимает русский, а на родном языке формулировки обычно точнее.

Частые вопросы

Сколько стоит одна картинка?

Три рубля. Доработка готового кадра — тоже три рубля. Подписки нет, деньги списываются с баланса личного кабинета за каждую генерацию.

Как создать картинку нейросетью бесплатно?

Полностью бесплатной генерации на платформе нет, но новым пользователям начисляется приветственный бонус 100 рублей — это примерно 33 изображения. Их хватает, чтобы разобраться и понять, подходит ли вам инструмент.

Нужен ли VPN или зарубежная карта?

Нет. Всё работает из России напрямую: оплата рублями, никаких аккаунтов на иностранных сервисах и обходных путей.

Модель точно пишет русский текст без ошибок?

Короткие надписи — заголовок, подпись, цена, адрес — выходят ровными. Для длинных текстовых блоков мелким шрифтом лучше подойдут GPT-Image-2 или Qwen Image 3.0, они специально сильны в типографике.

Почему не получается загрузить своё фото для правки?

Так устроена эта модель: она правит собственные генерации по их внутреннему идентификатору, а не по загруженному файлу. Чтобы отредактировать ваш снимок, переключитесь на Nano Banana 2, Qwen Image 3.0 или SeeDream 5 Pro — они принимают фото на вход.

Какие форматы кадра доступны?

Пять: 1:1, 2:3, 3:2, 16:9 и 9:16. Форматы 4:3 и 3:4 модель не знает — при их выборе сервис подставит ближайший подходящий, чтобы генерация не сорвалась после списания.

Сколько ждать результат?

Обычно около минуты. Это медленнее, чем у Nano Banana 2 Lite (там примерно четыре секунды), но втрое дешевле. Генерацию можно свернуть в фон и продолжить работать — картинка появится в галерее.

Где потом искать созданные картинки?

В галерее раздела и в общей истории генераций. Оттуда можно скачать файл, повторить удачный запрос или поделиться ссылкой. Как пользоваться историей, подробно разобрано в уроке про поиск старых генераций.

Советы напоследок

  • Держите под рукой два-три своих удачных описания — их удобно переиспользовать, меняя только предмет.
  • Для рекламных серий фиксируйте формулировку света и стиля, а меняйте только сюжет: так кадры будут выглядеть как один комплект.
  • Начинайте с квадрата 1:1 — он прощает неточности композиции, а обрезать под другой формат всегда успеете.
  • Если результат почти хорош, не переписывайте описание: одна фраза в поле доработки дешевле и точнее.
  • Сравните модели на одном и том же описании — три рубля за пробу того стоят. Разбор соседней модели есть в уроке про Qwen Image 3.0, а быстрая Lite-модель — в этом разборе.

Что нового появилось вместе с этой моделью и почему она встала первой в списке — читайте в анонсе обновления.

Поделиться уроком
Telegram ВКонтакте
Обновление Что нового: Grok Imagine 2.0 — нейросеть для картинок за 3 ₽
Попробовать +100 ₽ в подарок Пополнить баланс