Перейти к содержимому
PD
Claude Code

Модели в Claude Code: какую выбрать под задачу

Чем отличаются модели разных уровней в работе агента, что брать на рутину, что на сложные задачи, как выбор влияет на расход и почему самая мощная модель не всегда лучший ответ.

Все статьи гида Claude Code · 13

Выбор модели - самый прямой рычаг влияния на скорость, качество и счёт. При этом «взять самую мощную» - плохая стратегия по умолчанию: она выигрывает не везде, а платить приходится всегда.

Чем отличаются модели

Практически значимых отличий три.

Глубина рассуждения. Насколько модель справляется с задачей, где нужно удержать много связей сразу. Здесь разрыв между уровнями самый заметный: сложный баг с неочевидной причиной старшая модель находит, младшая ходит кругами.

Скорость. Быстрая модель меняет характер работы. Когда ответ приходит за секунды, вы работаете в диалоге; когда за полминуты - вы ждёте и переключаетесь на другое.

Цена за токен. Разница между уровнями кратная. На одной задаче незаметно, на сотне задач в месяц - заметно вполне.

Отдельно стоит сказать: разница между моделями меньше, чем разница между хорошей и плохой постановкой задачи. Точный адрес файла и внятный критерий готовности дают больше, чем переход на модель выше.

Что брать на рутину

Быструю и дешёвую модель. Признаки такой задачи:

  • Решение известно, нужно его аккуратно применить.
  • Правка механическая: переименование, форматирование, однотипные изменения по списку.
  • Есть однозначный автоматический критерий: тест либо проходит, либо нет.
  • Задача короткая и локальная.

Сюда же попадает вся разведка: найти файл, посмотреть, где что вызывается, собрать список. Это работа на объём чтения, а не на глубину мысли, и делегировать её лучше субагенту на быстрой модели.

Что брать на сложное

Старшую модель. Признаки:

  • Причина проблемы неизвестна, и её надо найти рассуждением, а не поиском.
  • Нужно удержать одновременно много условий: архитектура, миграция, рефакторинг с зависимостями.
  • Цена ошибки высока, а проверить автоматически не получится.
  • Задача требует выбора между вариантами, а не выполнения известного.

Рабочая связка: разбор и план - на старшей модели, исполнение по плану - на быстрой. План короткий, его дорого думать и дёшево применять.

Влияние на расход

Три вещи стоит знать до того, как удивляться счёту.

Контекст важнее модели. Каждый следующий запрос отправляет всю накопленную историю заново. Длинный грязный диалог на дешёвой модели легко обходится дороже короткой сессии на дорогой - см. лимиты и контекст.

Неудачный цикл дороже неудачной модели. Агент, который двадцать раз перезапускает падающие тесты, тратит больше, чем разница между уровнями моделей. Ограничение числа шагов в неинтерактивном режиме - страховка именно от этого.

Расход растёт нелинейно. Это не «в два раза больше задач - в два раза больше денег»: в длинной сессии каждый шаг дороже предыдущего.

Если задача экономии стоит системно, а не разово, - подход с маршрутизацией задач по моделям разобран в блоге: роутер моделей, который сократил расходы.

Как выбирать на практике

ЗадачаМодель
Найти файл, собрать списокБыстрая
Однотипные правки по спискуБыстрая
Написать тесты на готовый кодБыстрая или средняя
Найти причину неочевидного багаСтаршая
Спроектировать изменение схемыСтаршая
Рефакторинг с зависимостямиСтаршая
Применить готовый планБыстрая

Что дальше

Про то, как модель задаётся при запуске и меняется на ходу, - в статье про команды CLI. Общая картина - гид по Claude Code.

Вопросы и ответы

Всегда ли лучше брать самую мощную модель?

Нет. На однозначных задачах разница в результате близка к нулю, а разница в цене и скорости заметна. Самая мощная модель окупается там, где нужно удержать много условий одновременно: архитектура, неочевидный баг, рефакторинг с зависимостями. На рутине она просто дороже.

Можно ли менять модель посреди работы?

Да, модель переключается внутри сессии, и контекст при этом сохраняется. Рабочий приём: разобрать сложную задачу на дорогой модели, а механические правки по готовому плану доделать на быстрой.

Что влияет на расход сильнее - модель или размер контекста?

Контекст. Смена модели меняет цену за токен в разы, а раздутый контекст умножает количество токенов на каждом шаге разговора. Дешёвая модель с грязным контекстом легко обходится дороже дорогой модели с чистым.

Ещё по теме