Нейросеть для вайб-кодинга: выбор модели под задачу
Почему модель влияет на результат сильнее инструмента, чем отличаются дешёвые и дорогие модели на практике, как устроен роутинг задач и на чём реально экономят.
Все статьи гида Вайб-кодинг · 11
Инструмент определяет способ работы, а модель - качество рассуждения. Путаница между этими двумя вещами - причина большинства неудачных выборов.
Почему модель важнее, чем кажется
Три свойства, которые различаются между уровнями моделей и напрямую влияют на работу:
Глубина рассуждения. Способность удержать много связей одновременно. Здесь разрыв самый заметный: неочевидный баг сильная модель находит, слабая ходит кругами.
Поведение на длинной цепочке. Агентная задача - это десятки шагов. Модель, теряющая цель на середине, бесполезна независимо от качества отдельных ответов.
Честность при незнании. Модель, которая признаёт неуверенность, дешевле в отладке, чем модель, которая уверенно выдумывает.
При этом честная оговорка: разница между моделями меньше, чем разница между хорошей и плохой постановкой задачи. Точный адрес и проверяемый критерий дают больше, чем переход на уровень выше.
Дешёвые против дорогих на практике
Дешёвая и быстрая модель выигрывает там, где решение известно и нужно его аккуратно применить: механические правки, разведка по репозиторию, генерация обвязки, однотипные изменения по списку. Разница в результате на таких задачах близка к нулю, а разница в скорости заметна сразу.
Дорогая модель окупается там, где надо думать: причина проблемы неизвестна, нужно удержать много условий, цена ошибки высока, автоматически проверить нельзя.
Практический признак: если вы можете описать, что именно надо сделать, берите дешёвую. Если вам надо, чтобы кто-то разобрался, - дорогую.
Роутинг
Схема, дающая основную экономию без потери качества:
- Разбор и план - на сильной модели. Один раз, дорого, коротко.
- Исполнение по плану - на быстрой. Много шагов, дёшево.
- Проверка результата - отдельным прогоном, желательно другой моделью: та же модель повторит то же неверное предположение.
Это работает, потому что план - это короткий текст, который дорого придумать и дёшево применить. Механика такого распределения на реальном проекте разобрана в блоге: роутер моделей, который сократил расходы.
На чём реально экономят
Порядок по величине эффекта, и он не тот, который ожидают:
- Контекст. Каждый шаг отправляет всю накопленную историю заново. Длинный грязный диалог на дешёвой модели легко дороже короткой сессии на дорогой. Одна сессия - одна задача.
- Точный адрес задачи. «Посмотри эту функцию» вместо «разберись, почему не работает»: во втором случае агент прочитает пол-репозитория, и вы заплатите за всё прочитанное.
- Ограничение шагов. Агент, который двадцать раз перезапускает падающие тесты, тратит больше, чем разница между уровнями моделей.
- Делегирование разведки. Поиск по большому репозиторию возвращает три страницы вывода; субагент прочитает их у себя и вернёт абзац.
- И только потом смена модели.
Вывод, который стоит запомнить: смена модели меняет цену за токен, а раздутый контекст умножает число токенов на каждом шаге. Второе сильнее.
Подробно про расход контекста - лимиты Claude Code и память агента. Как выбирать модель по критериям - лучшая нейросеть для кода. Общая картина - гид по вайб-кодингу.
Вопросы и ответы
Что влияет на результат сильнее - инструмент или модель?
На качество кода - модель, на способ работы - инструмент. Одна и та же модель в чате и в агенте даёт разный результат, потому что агент видит вывод тестов. Поэтому правильнее сказать так: инструмент определяет, может ли модель проверить себя, а модель - насколько хорошо она рассуждает.
Как сократить расход при работе с агентом?
Сокращать контекст, а не переходить на модель дешевле. Каждый шаг отправляет всю накопленную историю заново, поэтому длинный грязный диалог на дешёвой модели легко обходится дороже короткой сессии на дорогой.
Что такое роутинг задач по моделям?
Схема, где простые шаги идут на быструю дешёвую модель, а сложные - на сильную. Разбор задачи и план делаются один раз на дорогой модели, а механическое исполнение по готовому плану - на дешёвой. Это даёт основную экономию без потери качества.
Ещё по теме
- Вайб-кодинг: что это такое простыми словамиГид
- Нейросеть для написания кода: сравнение инструментовКакие категории инструментов для написания кода существуют, чем терминальные агенты отличаются от IDE и от чата, и по каким критериям выбирать вместо чтения рейтингов.
- Лучшая нейросеть для кода: как выбрать под задачуПочему универсального ответа на этот вопрос нет, какие критерии работают вместо рейтингов, что брать под рутину, что под сложные задачи и что под ревью.
- Курсы по вайб-кодингу: чему учиться и в каком порядкеЧто нужно знать до того, как начинать, в каком порядке осваивать навыки, что учить бесполезно и почему практика на своём проекте заменяет большую часть курсов.
Сделаю под ключ
Доведу вайб-кодинг-прототип до рабочего продукта
Разберу, что нагенерировал ИИ, закрою дыры в безопасности и данных и выложу в прод.
от 1 500 $ · 1-2 недели