ИИ-агенты и автоматизация

Вайб-кодинг: что это и сколько реально стоит

Вайб-кодинг: что это и сколько реально стоит

Вайб-кодинг — это работа, где человек описывает задачу словами, а реализацию пишет модель. Приём даёт скорость на прототипах и внутренних инструментах и плохо переносится на код, за который отвечают деньгами. Экономика считается просто: сессия из тридцати шагов с историей около 20 000 токенов стоит примерно 2,5 ₽ на позиции за 8 ₽ за миллион и около 9,5 ₽ на позиции за 30 ₽. Дорого делает не ставка, а длина сессии.

Разберём, где приём действительно экономит время, где он подводит, и как считать его стоимость на своей работе.

Что это на самом деле

Термин описывает не технологию, а способ работы. Вместо того чтобы набирать реализацию, человек формулирует, что должно получиться, смотрит на предложенный код, говорит, что не так, и повторяет.

Важное уточнение, которое теряется в спорах: это не «код без понимания». Работающий вариант приёма выглядит как парное программирование, где один участник печатает быстро и знает много API, а второй держит в голове задачу целиком и отвечает за результат. Если второго участника нет, получается не вайб-кодинг, а генерация текста, похожего на код.

Где приём работает

Прототипы и черновики. Когда задача — быстро проверить идею, а не сдать её в эксплуатацию.

Незнакомый стек. Модель знает синтаксис и типовые конструкции библиотеки, которую вы видите первый раз, и экономит часы чтения документации.

Рутина с понятным результатом. Разбор формата, миграция, обвязка, тесты по уже написанному коду.

Разовые скрипты. Код, который отработает один раз и будет удалён, не требует того качества, которое требуется от продукта.

Подробный разбор того, как формулировать задачу для кода, — в статье промпт для генерации кода.

Где приём ломается

Код, за который отвечают деньгами. Платежи, права доступа, персональные данные. Здесь нужен обычный процесс с ревью и тестами.

Большая чужая кодовая база. Модель видит то, что вы показали. Не показали — она додумает, и додуманное будет выглядеть убедительно.

Задачи без критерия готовности. Если непонятно, как проверить результат, цикл превращается в бесконечную правку формулировок.

Работа в одиночку без проверки. Самый дорогой сценарий: код принимается, потому что запускается, а не потому, что верен. Почему уверенный тон модели не связан с правильностью, разобрано в статье галлюцинации нейросети.

Сколько это стоит

Считаем честно. Расход идёт за токены, и главная особенность агентской сессии в том, что история переотправляется на каждом шаге.

Возьмём сессию в тридцать шагов, где история к концу выросла примерно до 20 000 токенов, а средний ответ занимает 600. Суммарно за сессию проходит около 300 000 входных токенов и 18 000 выходных.

Модель₽ за миллион₽ за сессию
deepseek-v4-flash10,32
qwen-3-6-flash30,95
grok-build-0-151,59
haiku-4-582,54
sonnet-4-6123,82
opus-5309,54

Даже на флагмане это меньше десяти рублей за сессию. Сумма перестаёт быть незаметной на объёме: сорок сессий в день на команду из пяти человек — это уже тысячи рублей в месяц, и разница между первой и последней строкой таблицы становится тридцатикратной.

Почему длинная сессия дорожает быстрее, чем кажется

Механика простая и она же главный источник неожиданных счетов. На первом шаге в модель уходит ваш вопрос и немного контекста. На десятом — всё то же плюс девять предыдущих обменов. На тридцатом — плюс двадцать девять.

Отсюда два практических правила. Первое: одна задача — одна сессия. Новая задача начинается с чистого листа, а не дописывается в конец предыдущей. Второе: не показывайте лишние файлы. Каждый приложенный файл остаётся в истории до конца сессии и оплачивается на каждом шаге. Механика подсчёта разобрана в статье как считать токены.

Какую модель брать

Расклад по классам задач на ставках 12 сентября 2026 года.

ЗадачаМодель₽ за миллион
Рутинные правки, тесты, обвязкаqwen-3-6-flash3
Быстрая разработка и инженерные задачиgrok-build-0-15
Массовые операции и типовой кодhaiku-4-58
Точные правки в существующем кодеsonnet-4-612
Архитектура и разбор сложных ошибокopus-530

Разумная схема — дешёвая модель по умолчанию и переключение на сильную там, где дешёвая буксует. Флагман на всём подряд увеличивает счёт в разы и почти не меняет результат на простых правках.

Четыре ошибки, которые дороже всего

Не задают критерий готовности. Без ответа на вопрос «как мы поймём, что готово» цикл не заканчивается.

Показывают весь проект вместо нужных файлов. Это одновременно дороже и хуже по качеству: модель тонет в лишнем.

Принимают код, который не читали. Приём экономит набор текста, а не понимание.

Ведут одну бесконечную сессию. К сотому шагу вы платите за историю, а не за задачу.

Как проверять то, что написала модель

Приём стоит ровно столько, сколько стоит ваша проверка. Порядок, который экономит больше всего времени, выглядит так.

Сначала прочитайте, потом запускайте. Запуск подтверждает, что код не падает, и ничего не говорит о том, верен ли он. Самые дорогие ошибки проходят проверку запуском.

Спросите, что код делает с граничными случаями. Пустой вход, отрицательное число, отсутствующий файл, обрыв сети. Модель обычно пишет счастливый путь, если не попросить об остальном.

Проверьте зависимости. Модель охотно подключает библиотеку, которая решает задачу, и не обязана знать, что в вашем проекте её быть не должно.

Не давайте ей писать тесты к собственному коду без надзора. Тест, написанный по той же неверной логике, подтвердит неверное поведение. Разбор приёма — в статье нейросеть для тестирования.

Что меняется в команде

Отдельный эффект, который замечают не сразу: меняется не скорость набора, а распределение времени.

Времени на реализацию уходит меньше, времени на ревью — больше. Если процесс ревью был слабым, приём его не усилит, а нагрузит: объём кода растёт быстрее, чем способность команды его читать.

Отсюда практическое следствие. Внедрять приём имеет смысл там, где уже есть тесты и ревью. В проекте без них ускорение производства кода означает ускорение производства проблем, и первым это почувствует тот, кто будет разбираться в чужом сгенерированном коде через полгода.

Чем это отличается от работы с агентом

Граница тонкая, но она есть. В вайб-кодинге человек остаётся в цикле на каждом шаге: смотрит, правит формулировку, решает. Агент действует сам, вызывая инструменты и запуская команды без подтверждения на каждом шаге.

Второе быстрее и требует другой дисциплины — прав, песочницы и наблюдаемости. Что именно стоит разрешать такому исполнителю, разобрано в статье права агента: что разрешать, а устройство самого цикла — в статье как сделать ИИ-агента.

Чего мы не утверждаем

Мы не утверждаем, что приём заменяет знание языка и архитектуры. Он ускоряет того, кто понимает результат, и разгоняет ошибки того, кто не понимает.

Мы не публикуем чужие оценки прироста продуктивности. Цифры вроде «в три раза быстрее» зависят от задачи и меряются на своём проекте, а не по чужой статье.

Расчёт в таблице — модель поведения, а не ваш счёт. Длина истории и размер файлов у всех разные, и умножать нужно на свои числа.

Что нужно, чтобы попробовать

Ключ заводится за минуту на keydealer.ru/login — почта и пароль, без документов и без зарубежной карты. Оплата российской картой в рублях, один ключ на весь каталог.

Платные текстовые модели доступны сразу на приветственном бонусе: провести одну сессию и посмотреть, во что она обошлась, можно без пополнения.

Что держать в голове

Приём работает там, где есть проверяемый критерий готовности, и подводит там, где его нет.

Стоимость определяется длиной сессии, а не ставкой модели: история переотправляется на каждом шаге.

Одна задача — одна сессия, лишние файлы не показывают, а код читают перед тем, как принять. Как мы проверяем факты и почему у каждой цифры стоит дата — на странице о проекте. Завести ключ: keydealer.ru/login.

Частые вопросы

Что такое вайб-кодинг?

Способ работы, при котором человек описывает задачу словами, а код пишет модель. Человек задаёт направление и проверяет результат, вместо того чтобы набирать реализацию самому.

Сколько стоит час вайб-кодинга?

Зависит от модели и длины сессии. Сессия из тридцати шагов с историей, доросшей до 20 000 токенов, обходится примерно в 2,5 ₽ на позиции за 8 ₽ за миллион и в 9,5 ₽ на позиции за 30 ₽.

Подходит ли это для продакшена?

Для прототипов и внутренних инструментов да. Для кода, который обслуживает клиентов и деньги, нужен обычный процесс: ревью, тесты, понимание каждой строки.

Какая модель нужна для вайб-кодинга?

Для рутинных правок достаточно недорогой позиции, для архитектуры и разбора сложных ошибок берут модель классом выше. Держать флагман на всём подряд невыгодно.

Почему длинная сессия дорожает нелинейно?

Вся накопленная история переотправляется в модель на каждом шаге. Двадцатый шаг стоит дороже первого, потому что тащит с собой все предыдущие.

Что главное в промпте для кода?

Контекст и ограничения: какие файлы трогать, какой стек, что нельзя менять, как проверяется результат. Общая просьба «напиши функцию» даёт общий ответ.

Источники