Перейти к содержимому

Выбор модели

Агент не привязан к одной модели: список берётся из каталога Waibee Router и зависит от твоего доступа. Модель меняется в любой момент, история разговора при этом сохраняется.

/model открыть выбор моделей
/model sonnet переключиться псевдонимом
/effort high уровень рассуждений

Псевдонимы sonnet, opus и haiku указывают на последнюю модель своего семейства, поэтому их не нужно править после выхода новых версий. Свои псевдонимы задаются в settings.json:

.waibee/settings.json
{ "aliases": { "fast": "anthropic/claude-haiku-4.5" }, "model": "sonnet" }

Внутри почти каждого семейства есть три уровня, и выбирать практичнее уровень, а не конкретную версию: версии сменяются часто, а уровни нет.

  • флагман: максимальное качество, самый дорогой и медленный;
  • средний: рабочая лошадка, лучший компромисс;
  • быстрый: для механических операций и большого объёма однотипных вызовов.

Что доступно именно тебе, показывает /model: там же видно окно контекста и цены. Полный каталог отдаёт роутер, см. Модели.

Задача Что брать
Планирование, разбор незнакомой кодовой базы, сложный баг Флагман, при необходимости с высоким /effort
Повседневная разработка: правки, тесты, рефакторинг по описанию Средний уровень. Это разумное значение по умолчанию
Массовые механические изменения, переименования, разбор вывода линтера Быстрая и дешёвая модель
Работа с картинками, скриншотами, PDF Модель с поддержкой нужной модальности
Долгий автономный прогон с целью Средний уровень: цена растёт пропорционально числу ходов

Рабочая схема: сложное обдумать флагманом, реализацию отдать средней модели, проверку результата снова поручить сильной. Переключение через /model не сбрасывает контекст, так что менять модель по ходу задачи нормально.

Отдельный вариант это waibee/auto: модель под запрос подбирает роутер (Autorouting). Удобно, когда конкретная модель не важна.

Для субагентов модель задаётся в их описании, поэтому фоновая рутина может идти на дешёвой модели, пока основной разговор работает на сильной.

Reasoning-модели перед ответом обдумывают задачу. /effort управляет тем, сколько сил на это уходит.

Уровень Когда
none Рассуждения не нужны: простые правки, механическая работа
minimal, low Немного подумать без заметной задержки
medium Разумный компромисс
high, xhigh Сложная логика, запутанный баг, проектирование

В списке показываются только уровни, которые поддерживает выбранная модель: у части моделей селектора нет вовсе. У моделей OpenAI серий o и GPT-5 рассуждения включены по умолчанию на среднем уровне, потому что без них они отвечают хуже. У остальных семейств по умолчанию выключены, пока уровень не выбран.

Высокий уровень стоит дороже и отвечает дольше: токены рассуждений тарифицируются как вывод. Поднимай его на конкретной сложной задаче, а не на всю сессию.

  • Токены за сессию показывает /status: ввод, вывод, доля попаданий в кэш и среднее на ход. Фактические списания смотри в личном кабинете.
  • Кэш промптов сильно снижает стоимость длинных сессий: у моделей Claude агент переиспользует стабильный префикс автоматически.
  • Контекст дорожает по мере разговора. Каждый ход отправляет накопленную историю, поэтому в длинных сессиях помогает /compact, см. Окно контекста.
  • Большое окно контекста не заменяет точный запрос. Мегабайт файлов в контексте это и стоимость, и потеря внимания модели к главному.