Модели и провайдеры
Доступные модели, slug'и вида провайдер/модель и каталог GET /v1/models
Модели и провайдеры
Адресация моделей
Модель указывается slug'ом вида провайдер/модель:
{
"model": "deepseek/deepseek-v4-pro",
"messages": [{ "role": "user", "content": "Привет!" }]
}Алиас auto выбирает самую дешёвую подходящую модель автоматически.
Провайдеры
| Провайдер | Префикс slug | Формат API | Тарификация |
|---|---|---|---|
| OpenAI | openai/ | OpenAI Chat Completions | токены (input/output, кэш) |
| Anthropic | anthropic/ | Messages API (конвертируется шлюзом) | токены (input/output, cache read/write) |
| Kimi (Moonshot) | kimi/ | OpenAI-совместимый | токены |
| DeepSeek | deepseek/ | OpenAI-совместимый | токены (cache hit/miss) |
| Xiaomi MiMo | mimo/ | OpenAI-совместимый | токены |
| GLM (Zhipu) | glm/ | OpenAI-совместимый | токены (cache hit/miss) |
| Deepgram | deepgram/ | REST (prerecorded) | секунды аудио |
| fal.ai (в разработке) | fal/ | REST + очередь + webhooks | мегапиксели / изображения / секунды видео |
Примеры slug'ов: openai/gpt-5, anthropic/claude-sonnet-4.5,
deepseek/deepseek-v4-pro, kimi/kimi-k2.6, glm/glm-5.2,
mimo/mimo-v2.5-pro, deepgram/nova-3.
Каталог моделей
Актуальный список моделей с контекстными окнами и ценами всегда доступен через API:
curl https://api.nikagateway.ru/v1/models \
-H "Authorization: Bearer sk-tunnel-..."Ответ совместим с форматом OpenAI GET /v1/models и дополнительно содержит
тип модели, размер контекста и цены.
Эндпоинты
POST /v1/chat/completions— единый OpenAI-совместимый endpoint для всех chat-моделей;POST /v1/messages— нативный Anthropic Messages API (для клиентов вроде Claude Code), см. Claude (Anthropic);POST /v1/audio/transcriptions— распознавание речи (Deepgram, multipart), см. Распознавание речи;POST /v1/listen— нативный прокси Deepgram prerecorded;- прокси fal.ai:
fal.run/{model},queue.fal.run/{model}— в разработке.
Кэш-токены
Провайдеры тарифицируют повторное использование контекста дешевле. Шлюз учитывает это транзитом:
- OpenAI: чтение из кэша — 0.25–0.5× от цены входных токенов;
- Anthropic: запись в кэш — 1.25×, чтение — 0.1×;
- DeepSeek / GLM: свои ставки cache hit/miss.
Скидка по кэшу отражается в usage ответа, а фактическая стоимость — в
usage.cost_rub.
PII-маскирование
Для всех chat-моделей (включая /v1/messages) доступно автоматическое
вырезание персональных данных из запросов с восстановлением в ответах —
настраивается на API-ключ или пер-запросно полем pii.mode. Подробнее —
PII-маскирование.
Надёжность
При ошибках апстрима (5xx, 429 от провайдера) шлюз выполняет повторные попытки и следит за health-check провайдеров. Ошибка провайдера не стоит вам денег: резерв возвращается полностью — см. Биллинг.