FAQ
В каком формате указывать модель?
Заголовок раздела «В каком формате указывать модель?»<провайдер>/<модель>, только из каталога /v1/models (например anthropic/claude-sonnet-4.6). На /v1/chat/completions имя без провайдера отклоняется с 422; на /v1/messages короткие имена моделей Claude принимаются. waibee/auto отдаёт выбор модели роутеру и возвращает в ответе ту модель, которая отработала.
Какие форматы API поддерживаются?
Заголовок раздела «Какие форматы API поддерживаются?»Два: OpenAI Chat Completions (POST /v1/chat/completions) и Anthropic Messages (POST /v1/messages). Клиент под любой из них работает сменой base URL и ключа.
Как аутентифицироваться?
Заголовок раздела «Как аутентифицироваться?»Ключ sk_live_.... На /v1/chat/completions и /v1/models используется заголовок Authorization: Bearer. На /v1/messages подходит x-api-key или Authorization: Bearer.
Как включить стриминг?
Заголовок раздела «Как включить стриминг?»"stream": true. Chat Completions отдаёт SSE с завершающим data: [DONE], Messages отдаёт события Anthropic до message_stop (без [DONE]).
Поддерживается ли reasoning effort max?
Заголовок раздела «Поддерживается ли reasoning effort max?»Только на /v1/messages через output_config.effort. На /v1/chat/completions reasoning_effort доходит до xhigh; значение max возвращает feature_not_supported.
Поддерживается ли вызов инструментов?
Заголовок раздела «Поддерживается ли вызов инструментов?»Да, на всех трёх эндпоинтах: tools в формате OpenAI на /v1/chat/completions и на /v1/responses, в формате Anthropic на /v1/messages. До 256 инструментов в запросе. Веб-поиск доступен на всех трёх эндпоинтах и выполняется роутером, а web_fetch_* и code_execution_* не поддерживаются. Подробнее: Вызов инструментов.
Можно ли получить ответ строго по JSON-схеме?
Заголовок раздела «Можно ли получить ответ строго по JSON-схеме?»Да: response_format с типом json_schema на /v1/chat/completions, output_config.format на /v1/messages. См. Structured outputs.
Есть ли ограничение запросов в секунду?
Заголовок раздела «Есть ли ограничение запросов в секунду?»Фиксированного лимита RPS на ключ нет. 429 приходит либо от модели (provider_rate_limited), либо при исчерпании лимита расходов ключа (api_key_limit_exceeded, время сброса в extra.reset_at). См. Лимиты.
Есть ли кэширование промптов?
Заголовок раздела «Есть ли кэширование промптов?»Да. Блоки cache_control ({"type": "ephemeral"}, опционально "ttl": "1h") проходят к провайдеру и снижают стоимость повторных запросов с общим префиксом.
Какие лимиты на запрос?
Заголовок раздела «Какие лимиты на запрос?»Тело до 100 МБ, inline-файл до 50 МБ, текст до 15 МБ, до 1000 сообщений и до 256 инструментов. Подробнее в разделе Лимиты.
Где посмотреть коды ошибок?
Заголовок раздела «Где посмотреть коды ошибок?»Форматы и коды ошибок для обоих эндпоинтов собраны в API Reference. Chat Completions отдаёт ошибки в формате OpenAI, Messages в формате Anthropic.