Перейти к содержимому

Модели

Модель в запросе указывается идентификатором вида <провайдер>/<модель>, например anthropic/claude-sonnet-4.6. Точные идентификаторы берутся из каталога GET /v1/models, а не задаются по памяти: список моделей меняется.

Особый идентификатор waibee/auto передаёт выбор модели роутеру: он подбирает её под запрос и возвращает в ответе ту, которая отработала. Подробнее в Autorouting.

GET /v1/models возвращает доступные модели. У каждой записи:

Поле Что описывает
id Идентификатор для поля model в запросе
name Человекочитаемое имя
context_length Размер окна контекста
max_completion_tokens Максимум токенов в ответе
pricing Цены в долларах за один токен, отдельно за ввод, вывод, чтение и запись кэша
model_class Класс модели, сейчас у всех chat
capabilities.modality_input Что модель принимает на вход (text, image, audio, video)
capabilities.modality_output Что выдаёт на выходе
capabilities.features Поддерживаемые возможности. Сейчас в каталоге встречаются tools, pdf_input, reasoning, response_format, structured_outputs, parallel_tool_calls; список пополняется, поэтому проверяйте наличие нужного значения, а не сравнивайте набор целиком
Окно терминала
curl https://api.waibee.com/v1/models \
-H "Authorization: Bearer $WAIBEE_API_KEY"
{
"object": "list",
"data": [
{
"id": "anthropic/claude-sonnet-4.6",
"object": "model",
"name": "Anthropic: Claude Sonnet 4.6",
"context_length": 1000000,
"max_completion_tokens": 128000,
"pricing": {
"prompt": "0.000003",
"completion": "0.000015",
"input_cache_read": "0.0000003",
"input_cache_write": "0.00000375",
"input_cache_write_1h": "0.000006"
},
"model_class": "chat",
"capabilities": {
"modality_input": ["image", "text"],
"modality_output": ["text"],
"features": ["pdf_input", "reasoning", "response_format", "structured_outputs", "tools"]
}
}
]
}
  1. Запросите GET /v1/models и найдите нужный id.
  2. Сверьте capabilities с задачей: картинки на входе видно в modality_input, а вызов инструментов, structured outputs, reasoning и PDF в features.
  3. Если нужно кэширование промптов, проверьте pricing: у поддерживающих моделей есть отдельные цены input_cache_read и input_cache_write.
  4. Подставьте id в поле model запроса к /v1/chat/completions или /v1/messages.

Цены в pricing указаны за один токен и соответствуют вашему тарифу, см. Токены и usage.

Идентификатор нужен точно такой, как в каталоге, включая всё после двоеточия: имя, собранное по памяти или по догадке, отклоняется с model_not_found.

Каталог отдаётся и в OpenAI-совместимом формате, поэтому клиенты, которые умеют читать GET /v1/models, подхватывают список сами.