Пополните на 30 000 ₽ — ИИ-агент на месяц в подарок, до 31 июля Z-Image — фотореалистичное фото за 1,2 ₽ Veo 3.1 и Seedance — видео со звуком, от 120 ₽ Gemini Omni — говорящий персонаж с русской озвучкой GPT-5 и Claude 4.8 Opus — ответы от 3 ₽ Suno 5.5 — песня целиком за 99 ₽ Sora 2 и Kling 3 — уже внутри, за рубли Grok Video — рекламный ролик за 36 ₽ +20% бонусами к первому пополнению — до 6000 ₽

Claude Opus 5 в чате: думает вслух и считает по токенам

Claude Opus 5 в чате: думает вслух и считает по токенам

Claude Opus 5 — старшая модель Anthropic — заработала в чате Вайб-Маркетолога. Это самая сильная нейросеть для текста из тех, что у нас есть: она думает перед ответом, показывает ход рассуждений прямо в ленте и умеет искать в интернете. Платить нужно только за фактически потраченные токены, без подписки и без пакетов — списывается ровно столько, сколько модель израсходовала на ваш вопрос и свой ответ.

Нейросеть Claude Opus 5 в чате Вайб-Маркетолога показывает ход рассуждений
Claude Opus 5 в чате: видно, о чём модель думает, пока пишет ответ.

Что нового: нейросеть Claude Opus 5 в чате

Раньше в чате были доступны модели попроще: они хорошо справляются с короткими задачами — переписать абзац, придумать заголовки, вычитать текст. Но там, где нужно долго держать в голове условия задачи и не терять нить — стратегия продвижения, разбор большого брифа, аудит рекламной кампании, сложный технический текст — качество проседало. Opus 5 закрывает именно эту нишу.

Модель, которая думает перед тем, как отвечать

У Opus 5 включён режим размышлений. Прежде чем начать печатать ответ, модель строит внутренний план: разбирает вопрос на части, проверяет, что именно от неё требуется, прикидывает варианты и отбрасывает неподходящие. Это заметно на сложных задачах — там, где обычная модель хватается за первую пришедшую идею, Opus 5 сначала перебирает несколько и выбирает лучшую.

Особенно хорошо это видно на задачах с условиями: «напиши структуру лендинга для стоматологии в городе-миллионнике, средний чек 40 тысяч, основной трафик из Директа, но конверсия падает». Модель не выдаёт универсальный шаблон, а последовательно учитывает каждое ограничение и объясняет, почему предлагает именно такой порядок блоков.

Ход рассуждений видно прямо в ленте

Мы не стали прятать эту работу. Пока модель думает, в чате появляется отдельный блок «Размышления»: в него построчно приходит то, о чём модель рассуждает. Когда ответ готов, блок автоматически сворачивается, чтобы не мешать читать, — но его всегда можно раскрыть обратно.

Зачем это нужно на практике. Во-первых, видно, что система работает, а не зависла: на трудных вопросах пауза до первого слова ответа бывает заметной, и полоска рассуждений снимает ощущение «всё сломалось». Во-вторых, по ходу мыслей сразу понятно, правильно ли модель поняла задачу. Если она рассуждает не о том — не нужно ждать полного ответа, проще сразу переформулировать вопрос и не тратить деньги впустую.

Поиск в интернете, когда данных не хватает

Если вопрос требует свежих сведений, модель сама сходит в интернет — до трёх поисковых запросов на один ответ. Она сообщает об этом в ответе и опирается на найденное. Это работает для запросов вида «какие сейчас требования площадки к формату креативов» или «что изменилось в правилах модерации».

Оплата за фактические токены

Самое важное изменение — не в самой модели, а в том, как она считается. Обычные модели в чате тарифицируются по символам. Для Opus 5 мы сделали честный токенный расчёт: сколько токенов модель реально прочитала и написала — столько и стоит сообщение.

Механика простая. В момент отправки система резервирует на балансе сумму под максимально возможный ответ. Когда ответ готов, она пересчитывает стоимость по фактическому расходу и возвращает разницу на баланс. Резерв — это не списание: он почти всегда больше факта, и лишнее приходит обратно в ту же секунду, когда модель закончила отвечать. Под каждым ответом показывается плашка с реальной стоимостью: сколько токенов ушло на запрос, сколько на ответ и сколько рублей списалось.

Для кого и зачем

Opus 5 дороже остальных текстовых моделей, и брать его на каждую мелочь смысла нет. Вот задачи, где разница в качестве окупает разницу в цене:

  • Маркетинговая стратегия и позиционирование. Длинный бриф с ограничениями по бюджету, гео, конкурентам. Модель удерживает весь контекст и не забывает условия к середине ответа.
  • Разбор рекламных кампаний. Вставили выгрузку статистики — получили не общие слова, а разбор по срезам с гипотезами, что именно тянет вниз.
  • Длинные тексты с фактурой. Экспертные статьи, обзоры рынка, сценарии вебинаров — там, где текст должен быть связным на десять тысяч знаков, а не рассыпаться на абзацы-клише.
  • Сложные технические задачи. Разобрать чужой код, объяснить логику интеграции, составить техническое задание разработчику.
  • Работа с документами. Вычитка договора на предмет неудобных формулировок, сведение нескольких версий текста в одну, перевод с сохранением терминологии.

Для простых задач — заголовки, короткие посты, рерайт — оставайтесь на моделях подешевле: они справятся не хуже, а сообщение обойдётся в разы дешевле.

Как это работает

Оплата Claude Opus 5 по фактическим токенам с возвратом разницы
Резерв больше факта — разница возвращается на баланс сразу после ответа.

Токен — это кусочек текста, примерно один слог или короткое слово. Модель читает ваш вопрос вместе со всей предыдущей перепиской (это входящие токены) и пишет ответ (исходящие). Входящие дешевле, исходящие дороже — так устроено у всех больших языковых моделей.

Три вещи, которые стоит знать, чтобы платить меньше:

  1. Длинная переписка дорожает. Каждое новое сообщение тянет за собой всю историю чата. Если тема сменилась — начните новый чат, и входящая часть снова станет короткой.
  2. Повторный контекст стоит в десять раз дешевле. Мы включили кеширование: та часть переписки, которую модель уже видела в предыдущем сообщении, считается по льготной ставке. Продолжать диалог по одной теме выгоднее, чем каждый раз заново вываливать в новый чат один и тот же бриф.
  3. Короткий ответ стоит дешевле длинного. Если нужен список из пяти пунктов — так и напишите. Модель не станет разворачивать его в эссе, и исходящих токенов будет меньше.

Если ответ не получился по технической причине — оборвалось соединение, отказал провайдер — деньги возвращаются на баланс полностью. Платите только за то, что дошло до вас.

Сколько стоит

Без подписки и без обязательных пакетов: деньги списываются с рублёвого баланса по факту. Ставки для Claude Opus 5:

Что считаетсяЦенаПояснение
Входящие токены (ваш вопрос и история чата)1,5 ₽ за 1000Основной объём в длинной переписке
Исходящие токены (ответ модели)7,5 ₽ за 1000Сюда же входят размышления
Повторный контекст (кеш)0,15 ₽ за 1000В 10 раз дешевле обычного входа
Поиск в интернете3 ₽ за запросНе более 3 запросов на ответ
Минимум за сообщение2 ₽Даже если ответ совсем короткий

На практике: обычный содержательный ответ на 1500–2500 токенов при небольшой истории чата обходится в 12–25 ₽. Короткая уточняющая реплика — 2–5 ₽. Разбор большого документа с длинным ответом — 60–90 ₽. Бесконечно дорогой одна реплика быть не может: длина ответа ограничена, и резерв считается именно от этого предела.

Opus 5 уже в списке моделей чата — переключитесь и попробуйте на своей задаче.

Открыть чатПополнить баланс

Как попробовать

  1. Войдите в кабинет и откройте вкладку «Текст».
  2. Нажмите на название текущей модели над полем ввода — откроется список.
  3. Выберите Claude Opus 5. Модель стоит в быстром выборе, отдельно искать не нужно.
  4. Задайте вопрос. Чем подробнее условия — тем заметнее разница с обычными моделями.
  5. Пока идёт ответ, раскройте блок «Размышления» и посмотрите, правильно ли модель поняла задачу.
  6. Под готовым ответом проверьте плашку стоимости: там видно, сколько токенов и рублей ушло.

Баланс пополняется на той же странице, в разделе пополнения. Минимальная сумма небольшая — на пробу Opus 5 хватит и сотни рублей.

Как формулировать запрос, чтобы получить максимум

Opus 5 сильнее обычных моделей ровно там, где ему дают, с чем работать. На запрос из трёх слов он ответит примерно так же, как модель втрое дешевле, — и вы просто переплатите. Несколько приёмов, которые реально меняют результат:

Давайте вводные, а не только задание

Сравните: «напиши текст для рассылки» и «напиши текст рассылки для базы из 4000 клиентов автосервиса, которые не приезжали больше года; цель — вернуть на плановое ТО; средний чек 8 тысяч; тон дружелюбный, без давления; ограничение — не обещать скидок». Второй запрос стоит на несколько рублей дороже (входящие токены), а результат отличается принципиально: модель учтёт каждое условие, включая запрет на скидки.

Задавайте формат ответа

Модель по умолчанию склонна разворачивать мысль подробно — а исходящие токены самые дорогие. Если нужен список из семи пунктов по одному предложению, так и напишите. Это и дешевле, и удобнее читать. Работает и обратное: «разбери подробно, с примерами» даст развёрнутый материал.

Просите проверить себя

Фраза «перед ответом проверь, все ли условия учтены, и перечисли их» включает модель в режим самопроверки — она пробегает по вводным и ловит собственные пропуски. На сложных брифах с пятью-шестью ограничениями это заметно повышает точность.

Работайте в одном чате по одной теме

Продолжение диалога дешевле нового старта: повторный контекст считается по льготной ставке, а модель уже знает вводные — не нужно пересказывать бриф заново. Но когда тема сменилась полностью, начинайте новый чат: тащить за собой чужую историю значит платить за неё в каждом сообщении.

Прикладывайте картинки, когда это уместно

Модель умеет смотреть изображения. Скриншот интерфейса, фотография товара, макет баннера, график из отчёта — всё это можно приложить к сообщению и спросить, что на нём не так. Для разбора креативов и аудита посадочных страниц это экономит абзацы описаний.

Чего Opus 5 в чате делать не будет

Честные границы, чтобы не было завышенных ожиданий. Чат — это собеседник, а не исполнитель:

  • Не создаёт файлы. Он напишет текст коммерческого предложения, но не соберёт PDF. Не нарисует картинку и не смонтирует ролик.
  • Не нажимает кнопки в кабинете. Модель не запустит за вас генерацию во вкладке «Картинки» и не зайдёт в ваши рекламные кампании.
  • Не помнит вас между чатами. Каждый чат начинается с чистого листа; всё, что важно, нужно принести в переписку.

Всё перечисленное умеет Вайб-Агент — отдельный инструмент на том же движке, который как раз запускает генерации и отдаёт готовые файлы.

Частые вопросы

Сколько стоит Claude Opus 5 в рублях?

1,5 ₽ за 1000 входящих токенов и 7,5 ₽ за 1000 исходящих. Обычное сообщение с содержательным ответом — 12–25 ₽. Подписка не нужна, платите только за отправленные сообщения.

Чем Opus 5 отличается от других моделей в чате?

Режимом размышлений и способностью держать сложный контекст. На простых задачах разницы почти нет, и переплачивать смысла не имеет. На длинных задачах с множеством условий Opus 5 заметно точнее: он не теряет ограничения из брифа и не сваливается в общие фразы.

Почему с баланса сначала списалась большая сумма?

Это резерв под максимально возможный ответ, а не списание. Как только модель закончила отвечать, система пересчитывает стоимость по фактическому расходу и возвращает разницу. Итоговая сумма всегда указана в плашке под ответом.

Что будет, если ответ оборвётся на середине?

Если сбой технический — деньги возвращаются полностью. Если модель дописала ответ до конца, но он оказался длинным, вы платите за фактически написанное, не больше.

Модель отвечает по-русски?

Да, и отвечает, и размышляет по-русски. Ход мыслей в блоке «Размышления» специально приведён к языку переписки — читать перевод не придётся.

Модель умеет искать в интернете?

Да, до трёх поисковых запросов на один ответ, по 3 ₽ за запрос. Модель обращается к поиску сама, когда своих знаний не хватает, и указывает это в ответе.

Что дальше

Claude Opus 5 в чате — это собеседник: он рассуждает, пишет и объясняет, но не создаёт файлы. Для задач, где нужен готовый результат на диске — картинки, видео, озвучка, презентация, коммерческое предложение в PDF — мы собрали на этом же движке отдельный инструмент: Вайб-Агент. Он сам подбирает инструменты платформы, выполняет задачу шагами и отдаёт готовые файлы. Сейчас идёт набор в бесплатное тестирование.

Другие свежие обновления кабинета: озвучка и диалоги на нейросети Gemini и гайд по SEO и AEO — как попадать в ответы нейросетей, а не только в поисковую выдачу.

Открыть чат