Выбор модели и глубины рассуждения - это баланс качества, скорости и стоимости, и начинается он с алиасов, а не со случайных полных ID. Claude Code понимает aliases вроде default, sonnet, opus, haiku и fable, которые Anthropic переназначает на актуальные версии; есть opusplan для смены модели между планом и исполнением и варианты с расширенным контекстом. Смысл алиасов в том, что они переживают выход новых версий, тогда как захардкоженный полный ID устаревает.
Отсюда важное предупреждение: не фиксируйте конкретную модель в общей книге или шаблоне только потому, что она была default в момент написания. Набор доступных моделей зависит от аккаунта, провайдера и managed-allowlist, и то, что работало у вас, может быть недоступно у коллеги или в CI. Выбор и проверку делают вживую - командой /model, флагом --model при запуске, - а не переносят из чужого конфига как данность.
Effort управляет глубиной рассуждения, и его уровни стоит понимать по назначению, а не по ощущению. low - для коротких локальных задач, чувствительных к задержке; medium - для рутины с ограничением расхода; high - базовый баланс качества и цены для большинства инженерных задач; xhigh - для сложного рассуждения, архитектуры и трудного debugging; max - для самых тяжёлых случаев, где уже возможны diminishing returns и overthinking. Есть и session-only режим workflow-поведения.
Полезно один раз свести уровни effort в таблицу, чтобы выбирать осознанно. Ниже - карта от low до max. Ключевое правило рядом с ней: доступные уровни зависят от модели, и сравнивать их по одному ответу нельзя. Честная оценка - это повторяемый набор задач, на котором меряют корректность, число turns, расход токенов и время; ощущение от одного удачного или неудачного ответа обманчиво.
| Effort | Практическое применение |
|---|---|
| low | Короткие локальные задачи, чувствительные к задержке |
| medium | Рутинные изменения с ограничением расхода |
| high | Баланс качества и цены для большинства задач |
| xhigh | Сложное рассуждение, архитектура, трудный debugging |
| max | Самые сложные случаи; возможны diminishing returns |
Extended thinking и fast mode - два переключателя с неочевидными последствиями. Thinking переключается Alt+T или настройкой, но некоторые модели используют adaptive reasoning или не дают его полностью отключить, а MAX_THINKING_TOKENS=0 действует не одинаково на разных моделях и провайдерах - поэтому проверяют /status и метаданные вывода. Fast mode ускоряет поддерживаемые Opus-модели и может иметь другую цену; включение fast с другой модели способно переключить модель и вызвать cache miss.
Advisor добавляет вторую модель как совещательный голос, но не как гарантию. /advisor подключает модель, которую основной агент может вызвать в ключевой момент; это не независимое одобрение и не обещание лучшего результата. Практическая польза - в сложном выборе, где второй анализ дешевле, чем большой неверный diff. В настройках это выражается связкой model, effortLevel, advisorModel и fallbackModel - осознанным профилем, а не случайным набором.
Полезно один раз увидеть такой профиль в settings, чтобы задать поведение модели явно. Ниже - фрагмент с основной моделью, уровнем effort, советником и запасной моделью. К этой форме возвращаются, настраивая рабочий профиль под задачу: она делает выбор модели воспроизводимым и объяснимым, а не зависящим от того, что было выбрано в прошлой сессии.
У провайдеров своя специфика, и её нельзя игнорировать. Bedrock, Agent Platform, Foundry и gateways часто требуют сопоставить алиасы с deployment-ID через переменные ANTHROPIC_DEFAULT_*_MODEL или managed modelOverrides, а заодно описать capabilities - иначе UI предложит неподдерживаемый effort или thinking. Типичный провал - захардкодить модель по вчерашнему default и сравнивать уровни по одному ответу; правильный ход - алиасы, живая проверка и оценка на повторяемом наборе.
// Осознанный профиль модели в settings
{
"model": "sonnet",
"effortLevel": "high",
"advisorModel": "opus",
"fallbackModel": ["sonnet", "haiku"]
}