Выбор модели
Агент не привязан к одной модели: список берётся из каталога Waibee Router и зависит от твоего доступа. Модель меняется в любой момент, история разговора при этом сохраняется.
/model открыть выбор моделей/model sonnet переключиться псевдонимом/effort high уровень рассужденийПсевдонимы sonnet, opus и haiku указывают на последнюю модель своего семейства, поэтому их не нужно править после выхода новых версий. Свои псевдонимы задаются в settings.json:
{ "aliases": { "fast": "anthropic/claude-haiku-4.5" }, "model": "sonnet" }Уровни внутри семейства
Заголовок раздела «Уровни внутри семейства»Внутри почти каждого семейства есть три уровня, и выбирать практичнее уровень, а не конкретную версию: версии сменяются часто, а уровни нет.
- флагман: максимальное качество, самый дорогой и медленный;
- средний: рабочая лошадка, лучший компромисс;
- быстрый: для механических операций и большого объёма однотипных вызовов.
Что доступно именно тебе, показывает /model: там же видно окно контекста и цены. Полный каталог отдаёт роутер, см. Модели.
Как выбирать под задачу
Заголовок раздела «Как выбирать под задачу»| Задача | Что брать |
|---|---|
| Планирование, разбор незнакомой кодовой базы, сложный баг | Флагман, при необходимости с высоким /effort |
| Повседневная разработка: правки, тесты, рефакторинг по описанию | Средний уровень. Это разумное значение по умолчанию |
| Массовые механические изменения, переименования, разбор вывода линтера | Быстрая и дешёвая модель |
| Работа с картинками, скриншотами, PDF | Модель с поддержкой нужной модальности |
| Долгий автономный прогон с целью | Средний уровень: цена растёт пропорционально числу ходов |
Рабочая схема: сложное обдумать флагманом, реализацию отдать средней модели, проверку результата снова поручить сильной. Переключение через /model не сбрасывает контекст, так что менять модель по ходу задачи нормально.
Отдельный вариант это waibee/auto: модель под запрос подбирает роутер (Autorouting). Удобно, когда конкретная модель не важна.
Для субагентов модель задаётся в их описании, поэтому фоновая рутина может идти на дешёвой модели, пока основной разговор работает на сильной.
Уровень рассуждений (/effort)
Заголовок раздела «Уровень рассуждений (/effort)»Reasoning-модели перед ответом обдумывают задачу. /effort управляет тем, сколько сил на это уходит.
| Уровень | Когда |
|---|---|
none |
Рассуждения не нужны: простые правки, механическая работа |
minimal, low |
Немного подумать без заметной задержки |
medium |
Разумный компромисс |
high, xhigh |
Сложная логика, запутанный баг, проектирование |
В списке показываются только уровни, которые поддерживает выбранная модель: у части моделей селектора нет вовсе. У моделей OpenAI серий o и GPT-5 рассуждения включены по умолчанию на среднем уровне, потому что без них они отвечают хуже. У остальных семейств по умолчанию выключены, пока уровень не выбран.
Высокий уровень стоит дороже и отвечает дольше: токены рассуждений тарифицируются как вывод. Поднимай его на конкретной сложной задаче, а не на всю сессию.
Цена и расход
Заголовок раздела «Цена и расход»- Токены за сессию показывает
/status: ввод, вывод, доля попаданий в кэш и среднее на ход. Фактические списания смотри в личном кабинете. - Кэш промптов сильно снижает стоимость длинных сессий: у моделей Claude агент переиспользует стабильный префикс автоматически.
- Контекст дорожает по мере разговора. Каждый ход отправляет накопленную историю, поэтому в длинных сессиях помогает
/compact, см. Окно контекста. - Большое окно контекста не заменяет точный запрос. Мегабайт файлов в контексте это и стоимость, и потеря внимания модели к главному.
- Быстрый старт: первые команды в TUI.
- Окно контекста: почему разговор дорожает и как этим управлять.
- Лучшие практики: как формулировать задачи, чтобы средней модели хватало.