# Царь Роутер (TsarRouter) - полная выгрузка
> Агрегатор российских и open-source нейросетей: единый OpenAI-совместимый API к моделям, развёрнутым в России (провайдеры: Яндекс, Сбер, MTS, Cloud.ru, VK и другие). Оплата российской банковской картой или через СБП, цены в рублях.
Base URL API: `https://api.tsarrouter.ru/v1` - совместим с OpenAI SDK, ключи формата `sk-tsar-...`.
Моделей в каталоге: 87. Этот файл генерируется автоматически из живого реестра моделей - состав и цены всегда актуальны.
Бесплатные модели: если провайдер даёт модель бесплатно, ниже она помечена «бесплатно» и работает даже с нулевым балансом - пользоваться можно без пополнения. Состав меняется. Модели с пометкой «превью-доступ» бесплатны временно и без гарантий доступности.
Цены «за запрос»: у синтеза речи (TTS) и классификаторов текста вызов тарифицируется блоками (по умолчанию 250 символов или токенов, у отдельных моделей размер блока другой), поэтому длинный запрос стоит кратно указанной ставке - считайте её нижней границей. У OCR, обработки и генерации изображений «за запрос» означает ровно один вызов.
Персональные данные: оператор ПДн, рег. № 77-26-557111 в реестре Роскомнадзора. Все модели развёрнуты в ЦОД России - запросы не уходят за рубеж (152-ФЗ).
Это llms-full.txt: весь публичный текст сайта и документации одним файлом. Короткая версия с оглавлением и ссылками - https://tsarrouter.ru/llms.txt.
## Оглавление
- ## О сервисе
- ## Быстрый старт
- ## Документация
- ### Старт
- ### Быстрый старт
- ### История изменений
- ### Лимиты
- ### Потоковое распознавание речи
- ### Рассуждение моделей
- ### Сколько стоит запрос
- ### Список ошибок
- ### Выбор провайдера и надёжность
- ## Модели: Текст (31)
- ## Модели: Эмбеддинг (12)
- ## Модели: Реранкер (4)
- ## Модели: Vision OCR (21)
- ## Модели: Расшифровка речи (STT) (9)
- ## Модели: Синтез речи (TTS) (1)
- ## Модели: Изображения (2)
- ## Модели: Другие (7)
- ## Бенчмарки
- ## Статус сервиса
- ## Правовые документы
## О сервисе
Единый OpenAI-совместимый API к моделям, развёрнутым в России. Меняете base_url - и всё работает: один ключ, оплата только за использование.
- Подключение за 2 минуты: используете OpenAI SDK - просто поменяйте base_url. LangChain, curl, любой HTTP-клиент работают без нового SDK.
- Автоподбор провайдера: вы указываете модель - если она доступна у нескольких провайдеров, система сама направит запрос на самый быстрый и дешёвый.
- Запасные модели: укажите список моделей на замену - если основная не отвечает ни у одного провайдера, запрос автоматически уйдёт на следующую из списка.
- 0% наценки на токены: цены провайдеров без наценки, комиссия 15% при пополнении - и всё. Платите только за то, что используете.
- Оплата российской картой и СБП: пополнение от 100 ₽ картой любого российского банка (МИР, Visa, Mastercard) или по QR-коду через СБП. Неиспользованный остаток можно вернуть - условия в оферте https://tsarrouter.ru/offer.
- Бесплатные модели: если провайдер даёт модель бесплатно, она доступна за 0 ₽ и работает даже с нулевым балансом. Состав меняется, актуальный список - https://tsarrouter.ru/models?caps=free.
- Прозрачные тир-лимиты: лимиты запросов опубликованы целиком и растут с пополнением, без «обратитесь в отдел продаж». Сетка лимитов - https://docs.tsarrouter.ru/guide/limity.
- Собственные бенчмарки: скорость и качество моделей тестируем сами и публикуем как есть, это не копия чужих таблиц - https://tsarrouter.ru/benchmarks.
- Открытая документация: быстрый старт, примеры кода, справочник ошибок и лимитов - https://docs.tsarrouter.ru. Исходники в открытом репозитории https://gitverse.ru/tsartech/tsarrouter-docs, предложить правку может каждый.
- Данные в России - 152-ФЗ: оператор персональных данных, рег. № 77-26-557111 в реестре Роскомнадзора. Все модели развёрнуты в ЦОД России, запросы не уходят за рубеж.
Ссылки:
- [Каталог моделей](https://tsarrouter.ru/models): все модели с ценами, статусом и контекстом
- [models.csv](https://tsarrouter.ru/models.csv): каталог с ценами по провайдерам, машиночитаемо (CSV)
- [models.json](https://tsarrouter.ru/models.json): то же в JSON
- [Бенчмарки](https://tsarrouter.ru/benchmarks): Царь Индекс и собственные замеры качества, сводка ниже
- [Изменения каталога](https://tsarrouter.ru/changelog): добавления и снятия моделей
- [Статус сервиса](https://status.tsarrouter.ru): аптайм по каждой модели
## Быстрый старт
Совместимо с OpenAI SDK: меняется только base_url и ключ.
```python
from openai import OpenAI
client = OpenAI(
base_url="https://api.tsarrouter.ru/v1",
api_key="sk-tsar-...",
)
response = client.chat.completions.create(
model="yandex/yandexgpt-pro-5.1",
messages=[{"role": "user", "content": "Привет, ЦАРЬ!"}],
)
print(response.choices[0].message.content)
```
Полное руководство - https://docs.tsarrouter.ru/guide.
## Документация
Ниже - полный текст страниц https://docs.tsarrouter.ru, как он лежит в исходниках (markdown с элементами MDX). Таблицы лимитов подставлены живые.
### Старт
Источник: https://docs.tsarrouter.ru/api
Страница в работе.
### Быстрый старт
Источник: https://docs.tsarrouter.ru/guide
Сервис ЦАРЬ РОУТЕР находится на стадии **бета-тестирования**.
1. Если вы сталкиваетесь с ошибками в том числе 429 (превышение лимитов), то сообщите нам по почте [support@tsarrouter.ru](mailto:support@tsarrouter.ru)
2. Действуют лимиты запросов по уровням - подробнее на странице [Лимиты](https://docs.tsarrouter.ru/guide/limity).
3. Что еще находится в работе:
1. Добавление новых моделей и отладка текущих моделей.
2. Добавление эндпоинтов
3. И т.д.
4. На странице [Истории изменений](https://docs.tsarrouter.ru/guide/istoriya-izmenenij) можно узнать какие модели добавились/изменились/удалились и другие изменения сервиса.
Спасибо, желаем удачного использования!
#### 1. Базовый URL
```
https://api.tsarrouter.ru/v1
```
Это адрес, который вы подставляете вместо `base_url` OpenAI. Все эндпоинты совместимы с форматом OpenAI.
#### 2. Ключ
Зарегистрируйтесь в [личном кабинете](https://tsarrouter.ru/dashboard) и создайте API-ключ.
Формат: `sk-tsar-` + 40 hex-символов. Один ключ открывает доступ ко всем моделям всех провайдеров.
Передавайте ключ в заголовке `Authorization`:
```
Authorization: Bearer sk-tsar-ваш-ключ
```
#### 3. Первый запрос
```python
from openai import OpenAI
client = OpenAI(
base_url="https://api.tsarrouter.ru/v1",
api_key="sk-tsar-ваш-ключ",
)
response = client.chat.completions.create(
model="yandex/yandexgpt-pro-5.1",
messages=[{"role": "user", "content": "Привет!"}],
)
print(response.choices[0].message.content)
```
```javascript
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.tsarrouter.ru/v1",
apiKey: "sk-tsar-ваш-ключ",
});
const response = await client.chat.completions.create({
model: "sber/gigachat-2-max",
messages: [{ role: "user", content: "Привет!" }],
});
console.log(response.choices[0].message.content);
```
```bash
curl https://api.tsarrouter.ru/v1/chat/completions \
-H "Authorization: Bearer sk-tsar-ваш-ключ" \
-H "Content-Type: application/json" \
-d '{
"model": "yandex/yandexgpt-pro-5.1",
"messages": [{"role": "user", "content": "Привет!"}]
}'
```
#### 4. Названия моделей
Все модели используют формат `provider/model`:
`yandex/yandexgpt-pro-5.1`, `sber/gigachat-2-max`, `BAAI/bge-m3`.
> **Регистр имеет значение.** `sber/gigachat-2-max` ≠ `Sber/gigachat-2-max`.
Актуальный каталог моделей с ценами - на странице "[Модели](https://tsarrouter.ru/models)". Список идентификаторов можно получить и запросом (цен этот листинг не отдаёт):
```python
from openai import OpenAI
client = OpenAI(
base_url="https://api.tsarrouter.ru/v1",
api_key="sk-tsar-ваш-ключ",
)
models = client.models.list()
for model in models.data:
print(model.id)
```
```javascript
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.tsarrouter.ru/v1",
apiKey: "sk-tsar-ваш-ключ",
});
const models = await client.models.list();
for (const model of models.data) {
console.log(model.id);
}
```
```bash
curl https://api.tsarrouter.ru/v1/models \
-H "Authorization: Bearer sk-tsar-ваш-ключ"
```
### История изменений
Источник: https://docs.tsarrouter.ru/guide/istoriya-izmenenij
##### 03.09.2026
* **Анонсировано:**
* 30 сентября провайдер **Yandex Cloud** отключает модель `Qwen/Qwen3-235B-A22B-Instruct-2507`. Вместе с уходом этой модели у **MWS** 9 сентября она станет недоступна полностью
* 30 октября провайдер **Yandex Cloud** отключает модели `openai/gpt-oss-20b` и `openai/gpt-oss-120b` - обе остаются у других провайдеров
* 31 октября провайдер **Sber GigaChat** прекращает работу GigaChat API. Часть моделей линейки останется доступна через провайдера **Cloud.ru**; какие именно - уточняем и сообщим отдельно
##### 02.09.2026
* **Анонсировано:**
* 9 сентября провайдер **MWS** отключает модель `Qwen/Qwen3-235B-A22B-Instruct-2507` - модель остаётся у провайдера **Yandex Cloud**
##### 31.08.2026
* **Добавлено:**
* `ai-sage/GigaAM-v3` - модель распознавания речи.
##### 30.08.2026
* **Изменено:**
* Суточный лимит бесплатных моделей теперь растёт с уровнем аккаунта:
| Уровень лимита | Было | Стало |
| --- | --- | --- |
| 0 | 250 | 250 |
| 1 | 1000 | 500 |
| 2 | 1000 | 1000 |
| 3 | 1000 | 2000 |
##### 27.08.2026
* **Добавлено:**
* Бесплатные текстовые модели: `deepseek/deepseek-v4-flash-0731`, `Qwen/Qwen3.5-35B-A3B`, `Qwen/Qwen3.6-27B`, `Qwen/Qwen3.8-27B`
* **Изменено:**
* У моделей `nvidia/Nemotron-3-Nano-30B-A3B` и `Qwen/Qwen3.5-35B-A3B` на канале immers.cloud проставлен бейдж квантования **INT4**
* Обновлены цены канала **Timeweb Cloud**. Ставки за 1 млн токенов, вход / выход:
| Модель | Предыдущая цена | Новая цена |
| --- | --- | --- |
| `zai-org/GLM-5.2` | 2318,00 / 2318,00 ₽ | 267,00 / 1120,00 ₽ |
| `openai/gpt-oss-120b` | 68,00 / 67,50 ₽ | 20,00 / 82,00 ₽ |
##### 26.08.2026
* **Удалено:**
* Бесплатные текстовые модели: `deepseek/deepseek-v4-flash-0731` и `Qwen/Qwen3.5-35B-A3B` - канал immers.cloud снял их публичные эндпоинты
##### 24.08.2026
* **Удалено:**
* Бесплатные текстовые модели: `Qwen/Qwen3.6-27B` и `Qwen/Qwen3.8-27B`
* Бесплатный канал **immers.cloud** у модели `openai/gpt-oss-20b` - модель остаётся на канале **Yandex Cloud**
##### 21.08.2026
* **Изменено:**
* Обновлены цены канала **MWS**. Ставки за 1 млн токенов, вход / выход:
| Модель | Предыдущая цена | Новая цена |
| --- | --- | --- |
| `openai/gpt-oss-120b` | 3,40 / 13,50 ₽ | 13,42 / 54,90 ₽ |
| `zai-org/GLM-5.2` | 115,00 / 463,00 ₽ | 178,12 / 746,64 ₽ |
| `Qwen/Qwen3-235B-A22B-Instruct-2507` | 61,00 / 244,00 ₽ | 79,30 / 320,86 ₽ |
| `Qwen/Qwen3.6-35B-A3B` | 54,00 / 219,00 ₽ | 70,76 / 283,04 ₽ |
| `google/gemma-4-31b-it` | 54,00 / 219,00 ₽ | 56,12 / 224,48 ₽ |
| `moonshotai/Kimi-K2.6` | 183,00 / 732,00 ₽ | 157,38 / 652,70 ₽ |
У моделей с несколькими каналами цены остальных каналов не изменились - актуальные ставки каждого канала видны в [каталоге](https://tsarrouter.ru/models).
##### 19.08.2026
* **Изменено:**
* Бесплатные модели на уровне 0 (аккаунт без пополнений) - суточный лимит поднят с 50 до 250 запросов. Минутный лимит (20 запросов/мин) и лимиты остальных уровней не изменились.
##### 18.08.2026
* **Добавлено:**
* Бесплатная модель `Qwen/Qwen3.8-27B` - контекст 262K, распознавание изображений, вызов функций и структурированный ответ.
* **Изменено:**
* У моделей `Qwen/Qwen3.8-27B`, `Qwen/Qwen3.6-27B` и `Qwen/Qwen3.6-35B-A3B` на канале immers.cloud заработало размышление. Раньше оно было отключено, теперь включено по умолчанию: ход рассуждений приходит в `reasoning_content`, уровень задаётся `reasoning_effort` (low, medium, high), выключить можно через `reasoning_options` (mode: DISABLED) - подробности в разделе [«Рассуждение моделей»](https://docs.tsarrouter.ru/guide/razmyshlenie).
##### 17.08.2026
* **Добавлено:**
* Три бесплатные модели: `deepseek/deepseek-v4-flash-0731`, `Qwen/Qwen3.6-35B-A3B` и `Qwen/Qwen3.6-27B`. У DeepSeek рассуждение по умолчанию выключено. Для сложных задач оно включается параметром `reasoning_effort` (low/medium/high), ход рассуждений приходит в `reasoning_content`;
* Значки квантования (NVFP4, INT4) у каналов в [каталоге](https://tsarrouter.ru/models): сжатая версия модели быстрее и дешевле в размещении, но может отвечать чуть слабее полной;
* Обновлена смена пароля на странице [«Аккаунт»](https://tsarrouter.ru/dashboard/account);
* Переключатель **Стоимость / Объём** на графике [«Использование»](https://tsarrouter.ru/dashboard/usage): если вы пользуетесь бесплатными моделями, график стоимости пуст - теперь расход виден в токенах, а у нетокенных моделей в минутах, символах или штуках.
* **Исправлено:**
* Фильтр «Кэш» в [каталоге](https://tsarrouter.ru/models)
* **Удалено:**
* `yandex/yandex-art` (YandexART 2.0) - Яндекс выводит модель 18.08.2026, запросы к ней перестанут работать. Перейдите на `yandex/aliceai-image-art` (Alice AI ART 3.0) - она уже в каталоге, достаточно поменять имя модели в запросе.
##### 11.08.2026
* **Добавлено:**
* Разделы руководства [«Сколько стоит запрос»](https://docs.tsarrouter.ru/guide/skolko-stoit-zapros) и [«Выбор канала и надёжность»](https://docs.tsarrouter.ru/guide/vybor-kanala-i-nadezhnost).
* **Изменено:**
* `GET /v1/key` и `GET /v1/limits` больше не отдают служебные поля `is_service` и `enforcement`;
* Заголовки `X-TsarRouter-*` теперь читаются браузерными клиентами (добавлены в CORS).
##### 10.08.2026
* **Изменено:**
* Страница [«Использование» в личном кабинете](https://tsarrouter.ru/dashboard/usage) переработана: разрезы по моделям / ключам / провайдерам, фильтры одним рядом чипов, серии в журнале, сортировка по всей выборке, выгрузка CSV, разбивка кэша на графике.
* **Исправлено:**
* Графики расходов режут сутки по местному времени пользователя - раньше столбики могли сдвигаться относительно журнала.
##### 30.07.2026
* **Добавлено:**
* Раздел руководства [«Рассуждение моделей»](https://docs.tsarrouter.ru/guide/razmyshlenie);
* `reasoning_effort` у моделей GigaChat и счётчик токенов рассуждения в `usage` - подробности в новом разделе.
* **Изменено:**
* Ход рассуждений в обычном запросе теперь приходит в `choices[0].message.reasoning_content` (как в потоковом); прежнее имя `reasoning` не отдаётся.
##### 28.07.2026
* **Добавлено:**
* `usage.prompt_tokens_details.cached_tokens` - сколько входных токенов пришло из кэша повторяющегося начала промпта;
* Значок **«Кэш»** у моделей и каналов в [каталоге](https://tsarrouter.ru/models), в подсказке - ставка за кэшированный вход;
* Разбивка расхода «новый вход / из кэша / выход» на странице [«Использование» в личном кабинете](https://tsarrouter.ru/dashboard/usage).
* **Изменено:**
* Там, где у канала есть отдельная ставка за кэшированный вход, он считается по ней - дешевле обычного входа. Где такой ставки нет, вход считается как раньше, по полной цене.
##### 18.07.2026
* **Добавлено:**
* Платные дополнения к распознаванию речи Nexara на `/v1/audio/transcriptions` - включаются параметрами запроса, тарифицируются надбавкой к минуте:
* диаризация (разделение по дикторам) - `diarize=true` (плюс `num_speakers`, `diarization_setting`);
* определение ролей говорящих - `roles` (`auto` или список названий; только вместе с диаризацией);
* фильтрация нецензурной лексики - `profanity_filter=true`.
* `nexara/speech-to-text-ru` - модель распознавания Nexara, заточенная под русскую речь.
* **Изменено:**
* Распознавание Nexara теперь основной канал общей модели `openai/whisper-large-v3` (резерв - Cloud.ru и MTS). Прежнее имя `nexara/speech-to-text` продолжает работать.
##### 15.07.2026
* **Добавлена:**
* GLM-5.2 (MWS) - рассуждающая модель Z.ai, контекст 200K токенов.
##### 04.07.2026
* **Изменено:**
* Сетка лимитов по уровням теперь **действует** - запросы сверх лимита получают `429`. Ваши актуальные лимиты - на странице [«Лимиты» в личном кабинете](https://tsarrouter.ru/dashboard/limits) и через [`GET /v1/key`](https://docs.tsarrouter.ru/guide/limity#get-v1key).
##### 03.07.2026
* **Добавлено:**
* Заголовки `x-ratelimit-limit-requests` / `x-ratelimit-remaining-requests` / `x-ratelimit-reset-requests` на авторизованных ответах `/v1` и честный `Retry-After` в каждом `429` (см. [Лимиты](https://docs.tsarrouter.ru/guide/limity));
* `GET /v1/key` - уровень аккаунта, действующая сетка лимитов и бюджет ключа;
* Страница [«Лимиты» в личном кабинете](https://tsarrouter.ru/dashboard/limits);
* Опубликована сетка лимитов по уровням.
* **Изменено:**
* Все отказы по лимитам теперь возвращают единый код `429` (раньше часть отвечала `503`);
* Оферта: новый п. 2.8 о технических лимитах (редакция от 03.07.2026).
##### 02.07.2026
* **Добавлены:**
* Распознавание речи Yandex SpeechKit - синхронное (`yandex/speech-to-text`, записи до 30 с) и асинхронное (`yandex/speech-to-text-async`, до 40 мин, диаризация до 2 дикторов, пословные таймкоды, авто-определение языка).
* **Изменено:**
* Лимит загрузки аудио на `/v1/audio/transcriptions` поднят до 60 МБ; размер и длительность файла теперь проверяются по лимитам выбранной модели с понятной ошибкой 400 (см. [список ошибок](https://docs.tsarrouter.ru/guide/spisok-oshibok)).
##### 27.06.2026
* **Добавлены:**
* MiniMax M3 (Cloud.ru);
* Анализ тональности речи (Palatine).
* Gemma 3 27B (MWS)
##### 26.06.2026
* **Удалена:**
* DeepSeek V3.2 (Yandex) - запросы автоматически перенаправляются на DeepSeek V4 Flash.
##### 23.06.2026
* **Обновление линейки MWS.** Добавлены:
* Gemma 4 31B,
* Kimi K2.6,
* Qwen3.6 35B.
* Удалены:
* Qwen3 Coder 480B,
* Qwen3 ASR,
* Qwen3 TTS.
##### 21.06.2026
* **Добавлены:**
* Улучшение и повышение разрешения фото (VK Cloud).
##### 16.06.2026
* **Добавлена:**
* Синтез речи Qwen3 TTS (MWS, превью).
* **Удалена:**
* GLM-4.6
##### 15.06.2026
* **Добавлены:**
* Генерация изображений Kandinsky (Sber);
* Распознавание и синтез речи (VK Cloud).
##### 14.06.2026
* **Добавлены типы моделей:**
* Синтез речи (Yandex SpeechKit v3);
* Генерация изображений (YandexART, Alice);
* Классификация текста (Yandex);
* Детекторы ИИ-контента (GigaCheck, Sber).
##### 13.06.2026
* **Добавлены провайдеры распознавания речи (STT) с вариантами диаризации:**
* Nexara,
* Palatine,
* T-Bank,
* VK Cloud.
##### 12.06.2026
* **Добавлены:**
* Qwen3.5 35B;
* Gemma 4 26B;
* Nemotron 3 Nano (Immers Cloud).
##### 05.06.2026
* **Добавлена:**
* Qwen3 ASR (распознавание речи, MTS).
##### 29.05.2026
* **Добавлены:**
* DeepSeek V4 Pro (Cloud.ru);
* Kimi K2.6 (Cloud.ru);
* GLM-5.1.
##### 28.05.2026
* **Добавлены:**
* DeepSeek V4 Flash (Yandex);
* Alice Flash;
* Эмбеддинги Yandex v2;
* Распознавание речи Whisper (Cloud.ru).
##### 27.05.2026
* **Добавлены:**
* компьютерное зрение VK Cloud - 8 детекторов и OCR-моделей.
##### 24.05.2026
* **Добавлены:**
* OCR Yandex (13 моделей: документы, таблицы, рукописный текст, паспорта и др.);
* DeepSeek OCR.
##### 17.05.2026
* **Добавлены:**
* YandexGPT Pro 5 и 5.1,
* YandexGPT Lite 5.
* Подключён новый провайдер Timeweb Cloud с моделями Yandex.
##### 12.05.2026
* **Добавлены (Cloud.ru):**
* MiniMax M2.5,
* Qwen3.5 397B,
* Qwen3.6 35B,
* VL-эмбеддеры,
* Реранкеры Qwen3.
##### 11.05.2026
* **Обновление моделей Cloud.ru.** Удалены:
* MiniMax M2,
* Qwen3 Next 80B,
* GLM-4.7 Flash,
* вся линейка T-pro и T-lite.
##### 27.04.2026
* **Добавлены:**
* Kimi K2 (MTS);
* Gemma 3 27B (Cloud.ru).
##### 11.04.2026
* **Добавлено распознавание речи:**
* Whisper (Cloud.ru),
* SpeechKit (Yandex).
##### 10.04.2026
* **Добавлены:** GigaChat 2 Lite, Pro, Max (Sber).
##### 06.04.2026
* **Добавлены:**
* DeepSeek V3.2,
* Qwen3.5 35B (Yandex).
##### 10.02.2026
* **Добавлены:**
* Модели Yandex (YandexGPT, Alice, Gemma 3),
* Эмбеддинги Sber и Yandex.
##### 08.02.2026
* **Запуск Царь Роутера.** Стартовый каталог Cloud.ru: GigaChat, линейка GLM, Qwen3 (Coder/Next/Instruct), T-pro и T-lite, gpt-oss, а также эмбеддеры и реранкеры.
### Лимиты
Источник: https://docs.tsarrouter.ru/guide/limity
Лимиты считаются на аккаунт целиком (по всем вашим ключам) и зависят от уровня. Запросы сверх лимита получают ответ `429`.
Актуальные значения именно для вашего аккаунта всегда доступны без документации:
на странице [«Лимиты» в личном кабинете](https://tsarrouter.ru/dashboard/limits)
и через [`GET /v1/key`](#get-v1key).
#### Уровни
Лимиты зависят от уровня аккаунта. Уровень определяется суммой пополнений за всё
время (пополнения минус возвраты; промокоды не учитываются) и повышается
автоматически - обычно в течение минуты после оплаты.
| Уровень | Условие | Общий лимит, запросов/мин |
| --- | --- | --- |
| Уровень 0 | Без пополнений | 120 |
| Уровень 1 | Пополнения от 1 000 ₽ | 600 |
| Уровень 2 | Пополнения от 10 000 ₽ | 1 200 |
| Уровень 3 | Пополнения от 50 000 ₽ | 2 400 |
Нужны индивидуальные лимиты - напишите на [support@tsarrouter.ru](mailto:support@tsarrouter.ru).
#### Сетка по типам моделей
Лимиты действуют **на аккаунт целиком** (по всем вашим ключам сразу), окно - 60 секунд. Одновременно действуют общий лимит уровня и лимит каждого типа моделей - срабатывает более строгий из них:
| Тип моделей | Уровень 0 | Уровень 1 | Уровень 2 | Уровень 3 |
| --- | --- | --- | --- | --- |
| Текст | 20 | 60 | 120 | 240 |
| Эмбеддинг | 60 | 300 | 600 | 1 200 |
| Реранкер | 60 | 300 | 600 | 1 200 |
| Vision OCR | 12 | 30 | 60 | 120 |
| Расшифровка речи (STT) | 60 | 300 | 600 | 1 200 |
| Синтез речи (TTS) | 120 | 600 | 1 200 | 2 400 |
| Изображения | 30 | 60 | 120 | 240 |
| Детектор ИИ-текста | 30 | 60 | 120 | 240 |
| Классификатор | 12 | 30 | 60 | 120 |
| Обработка изображений | 30 | 60 | 120 | 240 |
| Анализ тональности речи | 30 | 60 | 120 | 240 |
| Потоковая расшифровка речи | 5 | 10 | 20 | 40 |
Дополнительно:
| Лимит | Уровень 0 | Уровень 1 | Уровень 2 | Уровень 3 |
| --- | --- | --- | --- | --- |
| Бесплатные модели, запросов/мин | 20 | 20 | 20 | 20 |
| Бесплатные модели, запросов/сутки (МСК) | 250 | 500 | 1 000 | 2 000 |
| Одновременные потоковые ответы | 5 | 20 | 50 | 100 |
| `GET /v1/models`, запросов/мин | 600 | 1 200 | 1 200 | 1 200 |
| `GET /v1/stats`, запросов/мин | 30 | 60 | 60 | 60 |
#### Ответ 429 и заголовки
При превышении лимита API возвращает `429` в OpenAI-совместимом формате
(`rate_limit_error`, см. [список ошибок](https://docs.tsarrouter.ru/guide/spisok-oshibok)). Отклонённый
запрос **не тратит квоту** (единственное исключение: отказ по лимиту типа успевает
занять слот общего лимита). В `429` есть `Retry-After` - секунды до освобождения
окна; у лимита одновременных потоков значение фиксированное - 5 секунд.
Успешные и ошибочные ответы авторизованных эндпоинтов `/v1/*` несут заголовки
самого ограничивающего действующего лимита:
```
x-ratelimit-limit-requests: 120
x-ratelimit-remaining-requests: 119
x-ratelimit-reset-requests: 60
```
* `limit` - размер лимита, `remaining` - осталось в текущем окне, `reset` - секунды до сброса окна.
* Заголовки приходят на авторизованные `/v1`-ответы - как успешные, так и `429`. Исключение - ранние отказы, когда запрос не дошёл до проверки лимитов: `401` (неверный или просроченный ключ), `403` (ключ отключён), `400` валидации тела приходят без них.
* У потоковых ответов значения фиксируются в момент старта потока.
Рекомендуемая обработка: при `429` подождите `Retry-After` секунд и повторите
запрос с экспоненциальной задержкой на случай повторного отказа.
#### GET /v1/key
Статус своего ключа: уровень, действующая сетка лимитов и бюджет ключа. Авторизация - тем же Bearer-ключом, чей статус запрашивается.
```bash
curl https://tsarrouter.ru/v1/key \
-H "Authorization: Bearer $TSAR_API_KEY"
```
```json
{
"data": {
"label": "my-key",
"tier": 2,
"expires_at": "2026-12-31T23:59:59Z",
"available_rub": 376.55,
"limits": {
"total_rpm": 1200,
"per_type_rpm": {"text": 120, "embedding": 600, "...": 0},
"free_rpm": 20,
"free_requests_per_day": 1000,
"concurrent_streams": 50,
"get_models_rpm": 1200,
"get_stats_rpm": 60
},
"budget": {
"type": "monthly",
"amount_rub": 500.0,
"spent_rub": 123.45,
"remaining_rub": 376.55,
"resets_at": "2026-08-01T00:00:00Z"
}
}
}
```
* Если поддержка выдала ключу [индивидуальный лимит](#уровни), он приходит в
`limits.individual_rpm` и отражается в самой сетке (`total_rpm`).
* `expires_at` - когда ключ перестанет действовать; `null` - бессрочный.
Отключённый или просроченный ключ статус не читает (`403`/`401`).
* `available_rub` - сколько рублей доступно этому ключу. Ключ без бюджета
видит баланс аккаунта; ключ с бюджетом - остаток своего бюджета, но не
больше доступных средств аккаунта (бюджетный ключ может быть выдан
подрядчику, поэтому сам баланс аккаунта ему не сообщается). Если баланс
аккаунта меньше 1 ₽, поле отдаёт `0` - столько платных запросов и пройдёт.
* У некоторых старых ключей `available_rub` может отдавать `null`.
* Блокировки по деньгам (`402`): платные запросы - когда баланс аккаунта
меньше 1 ₽ (бесплатные модели продолжают работать); любые запросы ключа,
включая бесплатные, - когда израсходован весь его бюджет (`spent_rub`
достиг `amount_rub`).
* `budget` - денежный лимит самого ключа из личного кабинета (не баланс
аккаунта). `remaining_rub` - остаток бюджета; `resets_at` - момент сброса
счётчика для периодических бюджетов (`daily` - полночь UTC, `weekly` -
понедельник, `monthly` - первое число месяца), `null` - без автосброса.
У ключа без бюджета поля `budget` равны `null`, кроме `spent_rub` -
накопленного расхода ключа (информационно).
* Все метки времени - ISO 8601, UTC (`Z`).
* Машиночитаемые русские названия типов из `per_type_rpm` отдаёт публичный
`GET /v1/model-types`.
* Полная сетка лимитов по всем уровням машиночитаемо - публичный
`GET /v1/limits` (без авторизации); таблицы этой страницы рендерятся из него.
### Потоковое распознавание речи
Источник: https://docs.tsarrouter.ru/guide/potokovoe-raspoznavanie
Потоковое распознавание превращает речь в текст **по мере произнесения**: вы шлёте
аудио-чанки в WebSocket, сервер отвечает промежуточными результатами (`delta`)
и финальной транскрипцией. Подходит для живых субтитров, диктовки и транскрипции
звонков. Модели с этим режимом отмечены в [каталоге](https://tsarrouter.ru/models)
бейджем «Потоковая».
Формат событий совместим с OpenAI Realtime API (transcription-режим) — при
переносе клиентского кода достаточно сменить URL.
#### Подключение
```
wss://api.tsarrouter.ru/v1/realtime/transcriptions?model=
```
Два способа авторизации:
| Способ | Как | Для кого |
| --- | --- | --- |
| Заголовок | `Authorization: Bearer <ключ>` | серверные клиенты |
| Subprotocol | `["realtime", "openai-insecure-api-key.<ключ>"]` | браузер (заголовки в WebSocket недоступны) |
Оба держат ключ вне URL. Передавать ключ query-параметром нельзя — секрет попал бы
в журналы сервера.
Модель задаётся query-параметром `?model=` или событием `session.update`
(поле `session.audio.input.transcription.model`).
#### События
Клиент → сервер:
| Событие | Назначение |
| --- | --- |
| `session.update` | Настроить формат аудио и/или модель (до первого аудио) |
| `input_audio_buffer.append` | Чанк аудио: `{"audio": ""}`, рекомендуем ~200 мс |
| `input_audio_buffer.commit` | Конец фразы — запросить финальную транскрипцию |
Сервер → клиент:
| Событие | Назначение |
| --- | --- |
| `session.created` / `session.updated` | Подтверждение сессии и настроек |
| `conversation.item.input_audio_transcription.delta` | Прирост текста по мере речи |
| `input_audio_buffer.committed` | Фраза принята в финализацию |
| `conversation.item.input_audio_transcription.completed` | Финальный текст + `usage.seconds` |
| `error` | Ошибка; фатальные дополнительно закрывают соединение ([коды](https://docs.tsarrouter.ru/guide/spisok-oshibok#потоковое-распознавание-речи-websocket)) |
Серверного VAD нет: конец фразы задаёт клиент событием `commit`
(`turn_detection: null`).
#### Формат аудио
Сырой **PCM16LE mono** (`audio/pcm`). Частота дискретизации - строго одна из:
8000, 16000, 22050, 32000, 44100, 48000 Гц (по умолчанию 16000). Промежуточные
значения не принимаются: например, 24000 Гц - частота по умолчанию в примерах
OpenAI Realtime - закроет сессию кодом 4004. Частота задаётся в `session.update`:
```json
{"type": "session.update", "session": {"audio": {"input": {"format": {"type": "audio/pcm", "rate": 16000}}}}}
```
#### Биллинг и лимиты
Тарификация посекундная — по длительности **принятого аудио** (не времени
соединения: паузы между чанками бесплатны). Списанные секунды каждой фразы
приходят в `usage.seconds` события `completed`. На старте сессии на балансе
резервируется стоимость аудио-бюджета сессии, по завершении списывается только
фактическое — остаток возвращается сразу.
Лимиты сессий (аудио-бюджет, одновременные сессии, таймаут бездействия) зависят
от уровня аккаунта — см. [Лимиты](https://docs.tsarrouter.ru/guide/limity).
#### Пример (Python)
```python
# pip install websockets
import asyncio, base64, json, websockets
URL = "wss://api.tsarrouter.ru/v1/realtime/transcriptions?model=palatine/speech-to-text-stream"
async def main():
async with websockets.connect(
URL, additional_headers={"Authorization": "Bearer sk-tsar-ваш-ключ"},
) as ws:
await ws.send(json.dumps({"type": "session.update", "session": {
"audio": {"input": {"format": {"type": "audio/pcm", "rate": 16000}}},
}}))
pcm = open("audio.pcm", "rb").read() # PCM16LE mono 16 кГц
for i in range(0, len(pcm), 6400): # чанки ~200 мс
await ws.send(json.dumps({
"type": "input_audio_buffer.append",
"audio": base64.b64encode(pcm[i:i + 6400]).decode(),
}))
await ws.send(json.dumps({"type": "input_audio_buffer.commit"}))
async for raw in ws:
ev = json.loads(raw)
if ev["type"] == "conversation.item.input_audio_transcription.delta":
print(ev["delta"], end="", flush=True)
elif ev["type"] == "conversation.item.input_audio_transcription.completed":
print("\n---", ev["transcript"], ev["usage"])
break
asyncio.run(main())
```
Попробовать без кода можно в [песочнице](https://tsarrouter.ru/dashboard/playground)
личного кабинета — с записью с микрофона.
### Рассуждение моделей
Источник: https://docs.tsarrouter.ru/guide/razmyshlenie
Рассуждающая модель перед ответом «думает вслух»: строит цепочку рассуждений, а
пользователю отдаёт итог. Этот черновик приходит отдельным полем — его можно
показать в интерфейсе, залогировать или просто выбросить.
Модели с рассуждением отмечены в [каталоге](https://tsarrouter.ru/models)
значком **«Рассуждение»**.
#### Где приходит ход рассуждений
В обоих режимах поле называется одинаково - `reasoning_content`:
| Режим | Где искать |
| --- | --- |
| Обычный запрос | `choices[0].message.reasoning_content` |
| Потоковый (`stream: true`) | `choices[0].delta.reasoning_content` в чанках |
```python
response = client.chat.completions.create(
model="Qwen/Qwen3.5-397B-A17B",
messages=[{"role": "user", "content": "Сколько будет 17*23?"}],
)
msg = response.choices[0].message
print(msg.reasoning_content) # ход рассуждений (может быть пустым)
print(msg.content) # сам ответ
```
Официальный OpenAI SDK о поле не знает и в типах его не показывает, но значение
сохраняет: в Python оно доступно как `msg.reasoning_content`, в JS —
`message.reasoning_content` (TypeScript потребует привести тип).
Ход рассуждений отдают не все провайдеры: часть из них показывает его только в
потоковом режиме, часть не показывает вовсе - модель рассуждает, но черновик
остаётся у провайдера. Ответ и счёт от этого не меняются. Что именно умеет
конкретный провайдер - написано в подсказке рядом с ним в
[каталоге](https://tsarrouter.ru/models).
#### Как включить и выключить
У моделей три сценария, и в каталоге для каждого провайдера указан свой:
| Сценарий | Что делать |
| --- | --- |
| Рассуждение включено всегда | ничего; выключить нельзя |
| Рассуждение по запросу | передать `reasoning_effort` |
| Рассуждение можно выключить | способ указан в подсказке провайдера |
Параметр `reasoning_effort` принимает `low`, `medium`, `high` — чем выше, тем
длиннее рассуждение и дороже ответ:
```bash
curl https://api.tsarrouter.ru/v1/chat/completions \
-H "Authorization: Bearer sk-tsar-ваш-ключ" \
-H "Content-Type: application/json" \
-d '{
"model": "sber/gigachat-2-pro",
"messages": [{"role": "user", "content": "Сколько будет 17*23?"}],
"reasoning_effort": "low"
}'
```
Другие значения не принимаются - придёт ошибка валидации `422`. Провайдер, который
рассуждение не поддерживает, чаще всего параметр проигнорирует, но часть провайдеров
принимает его как есть - тогда возможна ошибка с их стороны.
#### Один и тот же ответ от разных провайдеров
У модели может быть несколько провайдеров, и настройки рассуждения у них разные:
где-то оно включено всегда, где-то включается параметром. Без явного указания
запрос уходит к любому доступному провайдеру — значит и поведение рассуждения может
отличаться от запроса к запросу.
Чтобы зафиксировать провайдера, передайте `provider.only`:
```json
{
"model": "Qwen/Qwen3.6-35B-A3B",
"messages": [{"role": "user", "content": "Сколько будет 17*23?"}],
"provider": {"only": ["cloudru"]}
}
```
Какой провайдер ответил на самом деле, видно в заголовке ответа
`X-TsarRouter-Provider`. Все способы управления выбором провайдера - на странице
[«Выбор провайдера и надёжность»](https://docs.tsarrouter.ru/guide/vybor-kanala-i-nadezhnost).
#### Сколько это стоит
Токены рассуждения — это обычные токены выхода. Они **уже входят** в
`usage.completion_tokens` и оплачиваются по цене выхода: отдельного тарифа за
рассуждение нет и второй раз за них не списывается.
Если провайдер сообщает, сколько именно ушло на рассуждение, эта цифра приходит
в `usage`:
```json
{
"usage": {
"prompt_tokens": 27,
"completion_tokens": 323,
"total_tokens": 350,
"reasoning_tokens": 317,
"completion_tokens_details": {"reasoning_tokens": 317}
}
}
```
В обычном запросе одно и то же число лежит в двух местах:
`completion_tokens_details.reasoning_tokens` (формат OpenAI) и
`usage.reasoning_tokens` (короткая форма) - берите любое. В потоковом режиме
финальный usage-чанк приходит в том виде, в каком его прислал провайдер:
надёжнее читать `completion_tokens_details.reasoning_tokens`, верхнеуровневого
`usage.reasoning_tokens` там может не быть.
Счётчик необязательный: если провайдер его не прислал, поля придут со значением
`null` или не придут вовсе. Отсутствие или ноль не значит, что модель
не рассуждала - только что цифры от провайдера не пришло. Единственная величина,
на которую можно опираться в расчётах, - `completion_tokens`: она полная всегда,
и счёт считается по ней.
Рассуждение расходует тот же лимит, что и ответ. Если `max_tokens` мал,
модель потратит его на рассуждение и вернёт пустой или обрезанный `content`
с `finish_reason: "length"` - при полном счёте за выход. Для рассуждающих
моделей ставьте лимит с запасом или не ставьте вовсе.
### Сколько стоит запрос
Источник: https://docs.tsarrouter.ru/guide/skolko-stoit-zapros
Цена уже посчитана за вас: каждый успешный ответ несёт списанную сумму в рублях.
Смотреть её можно в трёх местах:
| Где | Когда |
| --- | --- |
| `usage.cost_rub` в теле ответа | все эндпоинты с JSON-ответом |
| Заголовок `X-Cost-Rub` | ответы, где цена известна к моменту отдачи; для ответов без JSON-тела - единственный источник |
| [«Использование» в личном кабинете](https://tsarrouter.ru/dashboard/usage) | история и агрегаты по всем запросам |
#### usage.cost_rub
Итоговая сумма списания в рублях, с точностью до микрорубля:
```json
{
"usage": {
"prompt_tokens": 27,
"completion_tokens": 323,
"total_tokens": 350,
"cost_rub": 0.40138
}
}
```
Состав `usage` зависит от эндпоинта: у чата - токены, у распознавания речи и
тональности - `seconds`, у генерации изображений - `requests`, у классификации -
`units`. Поле `cost_rub` есть везде.
**В потоковом режиме** цена приходит только если запросить usage:
```json
{"stream": true, "stream_options": {"include_usage": true}}
```
Тогда `cost_rub` будет в финальном usage-чанке (с `finish_reason` или
завершающем чанке с пустым `choices`). Без `include_usage` цену стрима в ответе
не узнать - только в личном кабинете.
#### Заголовок X-Cost-Rub
Та же сумма десятичной строкой (`X-Cost-Rub: 0.40138`). Для двух случаев это
единственный способ узнать цену - тела под `usage` там нет:
* `/v1/audio/speech` - ответ бинарный (аудиофайл);
* `/v1/audio/transcriptions` с `response_format=text|srt|vtt` - ответ сырым текстом.
Явный `0` - бесплатный запрос. В потоковом режиме заголовка нет: заголовки
уходят раньше, чем известна цена, - смотрите usage-чанк.
#### Программный прайс: GET /v1/models/info
Публичный (без ключа) каталог всех моделей с ценами - то же, что страница
[«Модели»](https://tsarrouter.ru/models), но машиночитаемо:
```bash
curl https://api.tsarrouter.ru/v1/models/info
```
У каждой модели - тип, контекст, возможности и провайдеры с ценами:
```json
{
"id": "sber/gigachat-2-max",
"type": "text",
"context_window": 131072,
"providers": [{
"provider": "sber",
"status": "ok",
"pricing": {"prompt": 650.0, "completion": 650.0, "currency": "RUB", "unit": "1M tokens"},
"prompt_cache": {"price": 0.0, "input_price": 650.0, "unit": "1M tokens", "free": true}
}]
}
```
* `pricing.prompt` / `pricing.completion` - ₽ за 1M токенов входа/выхода.
У поштучных и посекундных тарифов вместо них `per_request` / `per_second`,
единица - в `unit`.
* `prompt_cache` - ставка провайдера за кэшированный вход; `free: true` - кэш бесплатен.
* `billing_rule` (у модели) - правило округления тарифа (см. ниже).
* `addons` (у модели) - платные дополнения (например, диаризация у
распознавания речи) с надбавкой `per_second`.
#### Правила тарификации: блок, минимум, округление
Посекундные тарифы (распознавание речи) считают не длительность файла, а
**биллинговые секунды** по правилу модели - `billing_rule` в `/v1/models/info`:
* `{"mode": "block", "seconds": 15}` - вверх до кратного блоку: файл 41 с
тарифицируется как 45 с;
* `{"mode": "minimum", "seconds": 15}` - не меньше минимума, дальше вверх до
целой секунды;
* `round_kopeck: true` - итог дополнительно округляется вверх до копейки.
Именно биллинговые секунды приходят в `usage.seconds` - поэтому они могут быть
больше длительности записи, это не обсчёт.
В [потоковом распознавании](https://docs.tsarrouter.ru/guide/potokovoe-raspoznavanie) блок и минимум
считаются **на сессию целиком**, а не на каждую фразу: при блоке 15 с первая
фраза на 3 с тарифицируется как 15 с, вторая такая же - уже 0 ₽. К каждой фразе
добавляется ~0.6 с технической тишины - она входит в `usage.seconds`. Сумма
`cost_rub` событий `completed` равна списанию за завершённые фразы сессии.
#### Кэш промпта
Если провайдер кэширует повторяющееся начало промпта, попавшие в кэш входные токены
считаются по ставке `prompt_cache` (у Sber кэш бесплатен), остальные - по
полной. Сколько токенов пришло из кэша - в ответе:
```json
{"usage": {"prompt_tokens_details": {"cached_tokens": 1024}}}
```
Нюансы:
* кэш-ставки нет у поштучных (`per_request`) и посекундных (`per_second`) тарифов;
* если поток оборвался до usage-чанка, кэш учесть не из чего - вход списывается
по полной ставке;
* провайдеры с кэшем отмечены значком **«Кэш»** в [каталоге](https://tsarrouter.ru/models).
#### Резерв средств в потоковых режимах
На старте стрима на балансе резервируется верхняя оценка стоимости, по
завершении списывается фактическая - излишек возвращается сразу. Не хватает
даже на резерв - `402` до старта потока. В
[потоковом распознавании](https://docs.tsarrouter.ru/guide/potokovoe-raspoznavanie) резервируется
аудио-бюджет сессии: при нехватке средств он сжимается до доступного, а если
доступного меньше 10 секунд аудио - отказ кодом `4003`.
### Список ошибок
Источник: https://docs.tsarrouter.ru/guide/spisok-oshibok
Все ошибки `/v1` возвращаются в OpenAI-совместимом формате:
```json
{"error": {"message": "...", "type": "...", "param": null, "code": "..."}}
```
Поля устроены механически, поэтому их не нужно запоминать по каждой ошибке:
- `type` однозначно выводится из HTTP-кода: 400 → `invalid_request_error`, 401 → `authentication_error`, 402 → `insufficient_quota`, 403 → `permission_error`, 404 → `not_found_error`, 429 → `rate_limit_error`, 500/502/503 → `server_error`, прочие (413, 422) → `api_error`. В таблицах ниже колонка `type` опущена - смотрите на HTTP-код.
- `code` - HTTP-код строкой (`"400"`, `"429"`, …). Исключение: ошибки валидации тела запроса приходят с `code: "invalid_value"`.
- `param` практически всегда `null`; у ошибок валидации тела (`invalid_value`) поля `param` нет вовсе.
- Сам API код `504` не отдаёт: таймауты провайдеров превращаются в 502/503. Единственный источник `504` - транспортный слой, если ответ на `/v1/` висит дольше 600 секунд.
В сообщениях ниже `{в фигурных скобках}` - подставляемые значения.
#### Общие ошибки - любой эндпоинт `/v1`
##### Авторизация
| code | message | Описание |
| ---- | ---------------------------------------------------------------- | --------------------------------------------------------------------- |
| 401 | `Invalid API key` | Неверный или несуществующий API-ключ. Проверьте Bearer-токен. |
| 401 | `API key not found` | Ключ был удалён или деактивирован в момент обработки запроса. |
| 401 | `API key has expired` | Истёк срок действия ключа. |
| 401 | `Not authenticated` | Заголовок `Authorization: Bearer ` отсутствует или пустой. |
| 403 | `API key is disabled. Enable it in the dashboard to resume use.` | Ключ заморожен владельцем в личном кабинете. Включите его в дашборде. |
##### Баланс и бюджет ключа
| code | message | Описание |
| ---- | -------------------------------------------------------------------------------------------------------------------------- | -------------------------------------------------------------------------------------------------------- |
| 402 | `Account balance too low: {balance} ₽ available, minimum 1 ₽ required. Add funds to your account.` | На счёте меньше 1 ₽. Пополните баланс. |
| 402 | `Insufficient balance for this request: estimated up to {est} ₽, available {balance} ₽. Add funds and retry.` | Баланса не хватит на данный запрос. Пополните и повторите. |
| 402 | `API key budget limit reached: {spent} of {limit} ₽ spent. Increase this key's limit in the dashboard or use another key.` | Исчерпан денежный лимит самого ключа (не баланс аккаунта). Поднимите лимит ключа или используйте другой. |
##### Частотные лимиты
Все ответы 429 - `rate_limit_error`; несут заголовки `Retry-After` (секунды до сброса окна; у лимита одновременных потоков - фиксированные 5 с) и `x-ratelimit-*`, а к сообщению добавляется ` Retry after {n} seconds.` Подробнее о самих лимитах - в разделе [Лимиты](https://docs.tsarrouter.ru/guide/limity).
| code | message | Описание |
| ---- | ------------------------------------------------------------------------------------------- | ------------------------------------------------------------------------ |
| 429 | `Rate limit exceeded: {N} requests/minute.` | Базовый минутный лимит ключа. |
| 429 | `Rate limit exceeded for {type} models: {N} requests/minute.` | Минутный лимит уровня на данный тип моделей. |
| 429 | `Rate limit for free models exceeded: {N} requests/minute.` | Минутный лимит запросов к бесплатным моделям. |
| 429 | `Daily cap for free models reached: {N} requests/day, resets at midnight Europe/Moscow.` | Суточный лимит бесплатных моделей; счётчик сбрасывается в полночь по Москве. |
| 429 | `Rate limit exceeded: {N} requests/minute for this endpoint.` | Лимит справочных эндпоинтов: `GET /v1/models`, `/v1/key`, `/v1/stats`. |
Отдельный транспортный случай: при потоке заметно чаще ~30 запросов в секунду с одного IP ответ `429` отдаёт nginx **HTML-страницей** - без OpenAI-конверта и без `Retry-After` (аналогично HTML-413 из таблицы ниже). Снизьте частоту запросов с одного адреса.
##### Модель не найдена
Одна схема на все типы моделей: модели с таким ID нет в каталоге, или она не относится к типу эндпоинта.
| code | message | Описание |
| ---- | ------------------------------------------------------------------------- | -------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------- |
| 400 | `{Тип} model '{model}' not found. Available: {список}` | Все специализированные эндпоинты. Префикс `{Тип}` соответствует эндпоинту: `Embedding` (/v1/embeddings), `Reranker` (/v1/rerank), `Image` (/v1/images/generations), `Image enhancement` (/v1/images/enhance), `Classification` (/v1/classify), `Speech` (/v1/audio/speech), `STT` (/v1/audio/transcriptions - без списка `Available` и без точки на конце), `Sentiment` (/v1/audio/sentiment), `AI-check` (/v1/ai/check). |
| 400 | `Model '{model}' not found. Use GET /v1/models to list available models.` | `/v1/chat/completions`. |
| 404 | `Model '{model}' not found` | `GET /v1/models/{id}`: запрос модели по ID, которого нет в каталоге. |
##### Валидация тела запроса
| code | message | Описание |
| ---- | ------------------------------ | ---------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------- |
| 400 | `{источник} -> {поле}: {текст ошибки}` | Невалидное тело запроса: нет обязательного поля или неверный тип. Несколько ошибок склеиваются через `;`. У этих ответов `code: "invalid_value"`. Пример: `body -> messages: List should have at least 1 item after validation, not 0`. |
##### Доступность модели и провайдеров
| code | message | Описание |
| ---- | --------------------------------------------------------------------------------------------------------------------------------- | ------------------------------------------------------------------------------------------------------------------------------------------------------------------ |
| 4xx | `Request for model '{model}' was rejected by the provider. Please verify your request parameters.` | Провайдер отверг запрос как невалидный; HTTP-код наследуется от провайдера. Обычно в `message` приходит текст самого провайдера; показанный шаблон - резервный, когда текста нет. В чате возможен краткий вариант `Request rejected by the provider.` |
| 502 | `All providers for '{model}' are currently unavailable. Retry shortly or contact support if it persists.` | `/v1/embeddings`, `/v1/rerank`, `/v1/images/generations`, `/v1/chat/completions` без fallback-цепочки: все провайдеры недоступны. |
| 502 | `All providers failed for model chain [{модели}]` | `/v1/chat/completions` с fallback-цепочкой или стримингом: все маршруты недоступны. Повторите позже или смените модель. |
| 503 | `No provider available for '{model}'. All providers are currently unavailable. Retry shortly or contact support if it persists.` | `/v1/ai/check`, `/v1/images/enhance`, `/v1/classify`, синтез, распознавание и тональность речи: все провайдеры недоступны. |
| 503 | `Model '{model}' temporarily unavailable: pricing not configured. Contact support.` | У модели временно не настроен тариф. Повторите позже или обратитесь в поддержку. |
| 503 | `Model '{model}' is temporarily disabled for maintenance.` | Модель временно отключена на обслуживание. Выберите другую или повторите позже. |
#### Стриминг (`stream: true`)
| code | message | Описание |
| ---- | -------------------------------------------------------------------------------------------------------------------- | -------------------------------------------------------------------------- |
| 402 | `Insufficient balance to start streaming: required {hold} ₽, available {balance} ₽. Add funds or use another key.` | Баланса не хватит при старте потокового ответа. |
| 429 | `Concurrent stream limit reached: {N} simultaneous streams. Wait for a running stream to finish and retry.` | Лимит одновременных потоков уровня (см. [Лимиты](https://docs.tsarrouter.ru/guide/limity)). |
Ошибка до первого чанка приходит обычным JSON-конвертом. Если сбой случился после первого чанка (HTTP 200 уже отправлен) - поток обрывается без завершающего `[DONE]` и без error-чанка. Отсутствие `[DONE]` - признак оборванного ответа.
#### Валидация параметров эндпоинтов
| Эндпоинт | code | message | Описание |
| --------------------------- | ---- | ------------------------------------------------------------------------------ | ------------------------------------------------------------------------------------------------------------------------------------------------------------ |
| `/v1/images/generations` | 400 | `Parameter 'prompt' is required for image generation.` | Пустой `prompt`. |
| `/v1/images/generations` | 400 | `Only n=1 is supported: one image per request.` | Одна картинка за запрос. |
| `/v1/images/generations` | 400 | `Prompt too long: maximum {max} characters, got {n}.` | Слишком длинный промпт. |
| `/v1/images/enhance` | 400 | `Parameter 'image' is required (empty file).` | Передан пустой файл изображения. |
| `/v1/images/enhance` | 400 | `Only JPEG and PNG images are supported.` | Поддерживаются только JPEG и PNG. |
| `/v1/images/enhance` | 400 | `Parameter 'rfactor' must be 2 or 4.` | Коэффициент апскейла только 2 или 4. |
| `/v1/images/enhance` | 400 | `Parameter 'rtype' must be 'photo' or 'art'.` | Тип апскейла только `photo` или `art`. |
| `/v1/images/enhance` | 413 | `Image too large: maximum {N} MB, got {x} MB.` | Файл больше 10 МБ; `type: api_error`. На практике такой файл обычно отсекает nginx ещё раньше - тогда придёт HTML-413 (строка ниже), а не JSON. |
| `/v1/classify` | 400 | `Parameter 'text' is required for classification.` | Пустой `text`. |
| `/v1/classify` | 400 | `Provide between 2 and 20 labels, got {n}.` | Нужно от 2 до 20 меток. |
| `/v1/audio/speech` | 400 | `Parameter 'input' is required for speech synthesis.` | Пустой `input`. |
| `/v1/audio/speech` | 400 | `Input too long: maximum {max} characters, got {n}.` | Лимит 5000 символов. |
| `/v1/audio/transcriptions` | 400 | `Файл больше лимита модели '{model}': {x} МБ > {N} МБ.` | Размер файла сверх лимита выбранной модели (у каждой свой: Yandex async - 60 МБ, T-Bank - 32, VK - 20, Yandex sync - 1; см. карточку модели). |
| `/v1/audio/transcriptions` | 400 | `Аудио длиннее лимита модели '{model}': {n} с > {N} с.` | Длительность записи сверх лимита модели (напр. Yandex sync - 30 с, Yandex async - 40 мин, VK - 5 мин). |
| `/v1/audio/transcriptions` | 400 | `Параметр 'roles' доступен только вместе с diarize=true.` | Разметку ролей говорящих (Nexara) можно запросить только при включённой диаризации `diarize=true`. |
| любой | 413 | - (HTML nginx) | Тело запроса больше транспортного лимита: 60 МБ для `/v1/audio/transcriptions`, 10 МБ для остальных эндпоинтов. Ответ отдаёт nginx без JSON-тела. |
| `/v1/ai/check` | 400 | `Text too short: AI-content detection requires at least {min} words, got {n}.` | Текст слишком короткий для детекции. |
| `/v1/ai/check` | 400 | `This detector supports Russian text only (>=50% Cyrillic), got {x}%.` | Детектор работает только с русским текстом. |
#### Распознавание речи: форматы аудио
`/v1/audio/transcriptions`; все ошибки ниже - 400 `invalid_request_error`.
| Модель | message |
| ------------------------------ | -------------------------------------------------------------------------------------------------------------------------------------- |
| `yandex/speech-to-text` | `yandex/speech-to-text (синхронный) не принимает MP3 — только WAV (PCM) и OGG/Opus. Для MP3 используйте yandex/speech-to-text-async.` |
| `yandex/speech-to-text` | `Некорректный WAV-файл (ожидается PCM).` |
| `yandex/speech-to-text` | `yandex/speech-to-text принимает только моно (1 канал). Для многоканального аудио используйте yandex/speech-to-text-async.` |
| `yandex/speech-to-text` | `WAV должен быть 16-бит PCM (LINEAR16).` |
| `yandex/speech-to-text` | `Частота дискретизации {rate} Гц не поддерживается (допустимо: {список}).` |
| `yandex/speech-to-text` | `Неизвестный формат аудио: yandex/speech-to-text принимает WAV (PCM) и OGG/Opus.` |
| `yandex/speech-to-text` | `yandex/speech-to-text (синхронный) принимает до 1 МБ аудио (WAV считается по PCM-данным). Для длинных записей используйте yandex/speech-to-text-async.` |
| `yandex/speech-to-text-async` | `Неизвестный формат аудио: yandex/speech-to-text-async принимает MP3, WAV и OGG/Opus.` |
| `yandex/speech-to-text-async` | `Аудио с {n} каналами не поддерживается — максимум 2 (моно или стерео).` |
| обе модели Yandex | `Yandex STT: {сообщение провайдера}` - проброс ошибки входных данных от Яндекса (например, битый файл). |
| `tbank/speech-to-text` | `Invalid MP3: could not determine sample rate and channels.` - битый MP3; пришлите корректный MP3 или WAV (PCM). |
| `tbank/speech-to-text` | `Unsupported audio format. Use WAV (PCM) or MP3.` |
#### Потоковое распознавание речи (WebSocket)
`/v1/realtime/transcriptions` - WebSocket-эндпоинт (формат событий OpenAI Realtime
transcription). Ошибки приходят двумя способами:
**1. Отказ на этапе подключения (handshake).** Неверный или отсутствующий API-ключ -
соединение отклоняется с HTTP 403 ещё до установки WebSocket.
**2. Событие `error` + код закрытия.** Внутри сессии сервер шлёт событие
`{"type": "error", "error": {"code": ..., "message": ...}}`; фатальные ошибки
дополнительно закрывают соединение со стабильным close-кодом:
| close-код | code | Описание |
| --------- | -------------------------- | -------------------------------------------------------------------------------------------------- |
| 4001 | `invalid_api_key` | Ключ не прошёл проверку уже после подключения (например, отключён владельцем). |
| 4002 | `model_not_found` | Модель не задана, не существует или не поддерживает потоковое распознавание. |
| 4003 | `insufficient_balance` | Баланса не хватает даже на минимальную сессию. Пополните счёт. |
| 4004 | `unsupported_audio_format` | Формат аудио не поддерживается: нужен `audio/pcm` (PCM16LE), частота из списка 8000, 16000, 22050, 32000, 44100, 48000 Гц. |
| 4008 | `session_limit_exceeded` | Исчерпан лимит аудио-секунд или общей длительности сессии (см. [Лимиты](https://docs.tsarrouter.ru/guide/limity)). Откройте новую сессию. |
| 4009 | `idle_timeout` | Нет сообщений от клиента дольше таймаута бездействия - сессия закрыта. |
| 4010 | `concurrent_session_limit` | Достигнут лимит одновременных потоковых сессий вашего уровня. |
| 4029 | `rate_limit_exceeded` | Слишком частые открытия сессий (rpm-лимит типа). |
| 1011 | `upstream_error` | Сбой провайдера распознавания. Повторите попытку. |
| 1013 | `model_disabled` | Модель временно отключена на обслуживание. |
**Нефатальные ошибки** (сессия продолжает работать, приходит только событие `error`):
| code | Описание |
| --------------------------------- | -------------------------------------------------------------------------------- |
| `model_not_set` | Аудио прислано до выбора модели (`?model=` или `session.update`). |
| `input_audio_buffer_commit_empty` | `commit` без аудио в буфере. |
| `commit_too_short` | `commit` фразы короче минимума - продолжайте слать аудио перед `commit`. |
| `audio_chunk_too_large` | Слишком большой чанк в одном `append` - шлите короче (~200 мс). |
| `clear_not_supported` | `input_audio_buffer.clear` не поддерживается - аудио уходит в распознавание сразу. |
| `format_locked` / `model_locked` | Формат/модель нельзя менять после начала передачи аудио. |
| `invalid_audio` / `invalid_json` | `audio` не base64 / событие не JSON. |
| `empty_audio` | `append` с пустым `audio` - пришлите байты PCM16LE. |
| `invalid_payload` / `unknown_event` | Прислан бинарный фрейм вместо JSON / неизвестный тип события. |
#### Ошибки моделей
| code | message | Описание |
| ---- | ------------------------------------------------------------ | ------------------------------------------------------------------------------------------------------------------------------------------------ |
| 400 | `Invalid image input: {детали}` | Распознавание (OCR Yandex) и зрение (VK) в чате: изображение нужно передавать как base64 data URI (JPEG/PNG). |
| 400 | `Unknown VK Cloud model: {model}` | Неизвестная VK Cloud Vision-модель. |
| 400 | `VK Cloud enhance error: {детали}` | VK (обработка фото): ошибка параметров обработки изображения. |
| 422 | текст причины от модели | Kandinsky (GigaChat) сгенерировал отказ по контент-политике при генерации изображения. ⚠️ Запрос тарифицируется. Измените промпт. `type: api_error`. |
| 502 | `VK Cloud Vision error: {детали}` | Сбой обработки на стороне VK (зрение / апскейл / реставрация). Дословно доходит при стриминге или fallback-цепочке чата; в остальных случаях превращается в общие 502/503 из раздела «Доступность». |
### Выбор провайдера и надёжность
Источник: https://docs.tsarrouter.ru/guide/vybor-kanala-i-nadezhnost
У одной модели может быть несколько провайдеров. Запрос уходит к одному
из здоровых (случайный выбор, взвешенный в пользу дешёвых), а при сбое
автоматически переключается на следующий - это failover. Кто ответил на самом
деле, всегда видно в заголовках ответа.
#### Что уходит в failover, а что нет
* **Уходит:** `429` и `5xx` провайдера, таймауты, обрывы соединения, пустой
ответ с кодом 200. Сбоящие провайдеры временно понижаются в очереди выбора.
* **Не помогает:** клиентские ошибки `4xx` (кроме 429) - другой провайдер
отверг бы тот же запрос. В обычном запросе такая ошибка возвращается сразу,
с исходным кодом и текстом провайдера.
Обычный запрос (без стрима и без цепочки `models`) дополнительно повторяет
запрос к сбойному провайдеру один раз с короткой паузой; в потоковом режиме и с цепочкой
каждый кандидат пробуется один раз.
#### Fallback-цепочка моделей: models
Если недоступны все провайдеры модели, запрос можно продолжить на резервной модели -
перечислите их в `models` в порядке предпочтения:
```json
{
"model": "deepseek/deepseek-v4-flash",
"models": ["Qwen/Qwen3.6-35B-A3B", "sber/gigachat-2-max"],
"messages": [{"role": "user", "content": "Привет!"}]
}
```
* Кандидаты перебираются по порядку: все провайдеры основной модели, затем все
провайдеры первой резервной и так далее.
* Основная модель обязана существовать и быть включённой (иначе `400`/`503`);
несуществующая или отключённая **резервная** просто пропускается.
* Частотные лимиты и признак «бесплатная» считаются по основной модели.
* В отличие от обычного запроса, клиентская `4xx` здесь не прерывает перебор.
Если не ответил никто, придёт `502` `All providers failed for model chain
[...]`; когда последней была клиентская ошибка `4xx` - она отдаётся с
исходным кодом и текстом.
* Какая модель ответила фактически - в заголовке `X-TsarRouter-Model`.
#### Управление выбором провайдера: provider
```json
{
"model": "Qwen/Qwen3.6-35B-A3B",
"messages": [{"role": "user", "content": "Привет!"}],
"provider": {"sort": "throughput", "ignore": ["mws"]}
}
```
| Поле | Действие |
| --- | --- |
| `only: ["cloudru"]` | только перечисленные провайдеры |
| `ignore: ["mws"]` | исключить перечисленных |
| `order: ["yandex", "cloudru"]` | пробовать в этом порядке; `allow_fallbacks: false` запрещает добавлять остальных провайдеров после перечисленных |
| `sort` | детерминированная сортировка вместо случайного выбора: `"price"` (дешёвые вперёд), `"throughput"` (токены/с), `"latency"` (мс); перекрывает `order` |
| `max_price: {"prompt": 500, "completion": 1000}` | жёсткий потолок цены, ₽ за 1M токенов - провайдеры дороже исключаются |
| `preferred_min_throughput: 30` | мягкий фильтр: провайдеры медленнее 30 токенов/с уходят в конец очереди, но не исключаются |
| `preferred_max_latency: 2000` | мягкий фильтр по задержке, мс |
Пропускная способность и задержка берутся из живых метрик последних минут.
Провайдер без метрик при `sort` уходит в конец очереди; мягкие фильтры
`preferred_*` его не штрафуют.
#### Стриминг: переключение до первого чанка
В потоковом режиме сервис ждёт первый чанк провайдера до 30 секунд и только
потом отдаёт вам HTTP 200 - все переключения между провайдерами происходят до этого и
незаметны. После первого чанка failover уже невозможен: сбой в середине потока
обрывает его без завершающего `[DONE]` (см.
[список ошибок](https://docs.tsarrouter.ru/guide/spisok-oshibok#стриминг-stream-true)).
#### Заголовки трассировки
| Заголовок | Что в нём |
| --- | --- |
| `X-TsarRouter-Provider` | провайдер, который реально исполнил запрос |
| `X-TsarRouter-Model` | модель, которая реально ответила (важно при цепочке `models`) |
| `X-TsarRouter-Attempts` | JSON-массив попыток: `[{"provider": "...", "model": "...", "status": "ok", "latency_ms": 812.4}]` |
| `X-Model-Deprecated: true` + `Sunset` | ответившая модель объявлена устаревшей; `Sunset` - дата отключения (`2026-05-12`) |
Статусы попыток: `ok`, `error` (с полем `error` - текстом причины),
`insufficient_balance`, `simulated_fail`. У части попыток `latency_ms` может
отсутствовать. На итоговых ошибках (`502` после перебора всех) заголовков
`X-TsarRouter-*` нет.
Признак устаревания есть и в `GET /v1/models`: поле `deprecated` с датой
отключения у затронутых моделей.
#### Проверить failover без сбоя: X-Simulate-Fail
Заголовок для теста отказоустойчивости, доступен любому ключу. Перечислите
через запятую модели, которые нужно искусственно «уронить», - их провайдеры будут
помечены сбойными без обращения к ним (и без списаний):
```bash
curl https://api.tsarrouter.ru/v1/chat/completions \
-H "Authorization: Bearer sk-tsar-ваш-ключ" \
-H "X-Simulate-Fail: deepseek/deepseek-v4-flash" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek/deepseek-v4-flash",
"models": ["sber/gigachat-2-max"],
"messages": [{"role": "user", "content": "Привет!"}]
}'
```
Ответ придёт от резервной модели, а в `X-TsarRouter-Attempts` будет попытка со
`status: "simulated_fail"`. Работает на `/v1/chat/completions` в потоковом
режиме или при заданной цепочке `models`; если «уронить» все модели запроса,
придёт обычный `502` - как при реальном отказе.
## Модели: Текст (31)
- [yandex/yandexgpt-pro-5.1](https://tsarrouter.ru/models/yandex/yandexgpt-pro-5.1): контекст 33K токенов; цена от 410 ₽ за 1M токенов
- [yandex/yandexgpt-pro-5](https://tsarrouter.ru/models/yandex/yandexgpt-pro-5): контекст 33K токенов; цена 1 200 ₽ за 1M токенов
- [yandex/yandexgpt-lite-5](https://tsarrouter.ru/models/yandex/yandexgpt-lite-5): контекст 33K токенов; цена от 200 ₽ за 1M токенов
- [yandex/aliceai-llm](https://tsarrouter.ru/models/yandex/aliceai-llm): Флагман Яндекса для русского языка; контекст 131K токенов; цена от 500 ₽ / 1 200 ₽ за 1M токенов (вход / выход)
- [yandex/aliceai-llm-flash](https://tsarrouter.ru/models/yandex/aliceai-llm-flash): Быстрая и недорогая; контекст 66K токенов; цена 100 ₽ / 200 ₽ за 1M токенов (вход / выход)
- [deepseek/deepseek-v4-flash](https://tsarrouter.ru/models/deepseek/deepseek-v4-flash): Быстрый DeepSeek · reasoning; контекст 1M токенов; цена 300 ₽ / 500 ₽ за 1M токенов (вход / выход)
- [deepseek/deepseek-v4-flash-0731](https://tsarrouter.ru/models/deepseek/deepseek-v4-flash-0731): превью-доступ: провайдер не гарантирует доступность и может отключить модель без предупреждения, цена временная; контекст 1M токенов; цена бесплатно
- [Qwen/Qwen3.6-35B-A3B](https://tsarrouter.ru/models/Qwen/Qwen3.6-35B-A3B): Qwen 3.6 · MoE 35B-A3B; часть провайдеров отдаёт модель в превью-доступе (без гарантий доступности, цена временная); контекст 262K токенов; цена бесплатно
- [Qwen/Qwen3.6-27B](https://tsarrouter.ru/models/Qwen/Qwen3.6-27B): превью-доступ: провайдер не гарантирует доступность и может отключить модель без предупреждения, цена временная; контекст 224K токенов; цена бесплатно
- [Qwen/Qwen3.8-27B](https://tsarrouter.ru/models/Qwen/Qwen3.8-27B): Qwen 3.8 · 27B · бесплатно; превью-доступ: провайдер не гарантирует доступность и может отключить модель без предупреждения, цена временная; контекст 262K токенов; цена бесплатно
- [ai-sage/GigaChat3-10B-A1.8B](https://tsarrouter.ru/models/ai-sage/GigaChat3-10B-A1.8B): контекст 262K токенов; цена 12.2 ₽ за 1M токенов
- [zai-org/GLM-4.7](https://tsarrouter.ru/models/zai-org/GLM-4.7): контекст 203K токенов; цена 549 ₽ / 793 ₽ за 1M токенов (вход / выход)
- [zai-org/GLM-5.1](https://tsarrouter.ru/models/zai-org/GLM-5.1): Флагман Z.ai; контекст 1M токенов; цена 198.86 ₽ / 829.60 ₽ за 1M токенов (вход / выход)
- [zai-org/GLM-5.2](https://tsarrouter.ru/models/zai-org/GLM-5.2): контекст 200K токенов; цена от 178.12 ₽ / 746.64 ₽ за 1M токенов (вход / выход)
- [zai-org/GLM-5.3](https://tsarrouter.ru/models/zai-org/GLM-5.3): контекст 200K токенов; цена 178.12 ₽ / 746.64 ₽ за 1M токенов (вход / выход)
- [moonshotai/Kimi-K2.6](https://tsarrouter.ru/models/moonshotai/Kimi-K2.6): 1T параметров · MoE; контекст 262K токенов; цена от 157.38 ₽ / 652.70 ₽ за 1M токенов (вход / выход)
- [deepseek-ai/DeepSeek-V4-Pro](https://tsarrouter.ru/models/deepseek-ai/DeepSeek-V4-Pro): Флагман DeepSeek · 1M контекста; контекст 1M токенов; цена 183 ₽ / 732 ₽ за 1M токенов (вход / выход)
- [Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct](https://tsarrouter.ru/models/Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct): контекст 262K токенов; цена 122 ₽ / 244 ₽ за 1M токенов (вход / выход)
- [MiniMaxAI/MiniMax-M2.5](https://tsarrouter.ru/models/MiniMaxAI/MiniMax-M2.5): контекст 197K токенов; цена 353.80 ₽ / 475.80 ₽ за 1M токенов (вход / выход)
- [MiniMaxAI/MiniMax-M3](https://tsarrouter.ru/models/MiniMaxAI/MiniMax-M3): контекст 524K токенов; цена 240.22 ₽ / 1 008.85 ₽ за 1M токенов (вход / выход)
- [Qwen/Qwen3.5-397B-A17B](https://tsarrouter.ru/models/Qwen/Qwen3.5-397B-A17B): контекст 262K токенов; цена 915 ₽ / 1 085.80 ₽ за 1M токенов (вход / выход)
- [google/gemma-4-31b-it](https://tsarrouter.ru/models/google/gemma-4-31b-it): контекст 128K токенов; цена 56.1 ₽ / 224.48 ₽ за 1M токенов (вход / выход)
- [Qwen/Qwen3-235B-A22B-Instruct-2507](https://tsarrouter.ru/models/Qwen/Qwen3-235B-A22B-Instruct-2507): Мощный reasoning; контекст 256K токенов; цена от 79.3 ₽ / 320.86 ₽ за 1M токенов (вход / выход)
- [openai/gpt-oss-120b](https://tsarrouter.ru/models/openai/gpt-oss-120b): Открытая модель OpenAI; контекст 131K токенов; цена от 13.4 ₽ / 54.9 ₽ за 1M токенов (вход / выход)
- [openai/gpt-oss-20b](https://tsarrouter.ru/models/openai/gpt-oss-20b): часть провайдеров отдаёт модель в превью-доступе (без гарантий доступности, цена временная); контекст 131K токенов; цена бесплатно
- [google/gemma-4-26b-a4b-it](https://tsarrouter.ru/models/google/gemma-4-26b-a4b-it): превью-доступ: провайдер не гарантирует доступность и может отключить модель без предупреждения, цена временная; контекст 262K токенов; цена бесплатно
- [Qwen/Qwen3.5-35B-A3B](https://tsarrouter.ru/models/Qwen/Qwen3.5-35B-A3B): превью-доступ: провайдер не гарантирует доступность и может отключить модель без предупреждения, цена временная; контекст 262K токенов; цена бесплатно
- [nvidia/Nemotron-3-Nano-30B-A3B](https://tsarrouter.ru/models/nvidia/Nemotron-3-Nano-30B-A3B): превью-доступ: провайдер не гарантирует доступность и может отключить модель без предупреждения, цена временная; контекст 262K токенов; цена бесплатно
- [sber/gigachat-2-lite](https://tsarrouter.ru/models/sber/gigachat-2-lite): контекст 128K токенов; цена 65.0 ₽ за 1M токенов
- [sber/gigachat-2-pro](https://tsarrouter.ru/models/sber/gigachat-2-pro): контекст 128K токенов; цена 500 ₽ за 1M токенов
- [sber/gigachat-2-max](https://tsarrouter.ru/models/sber/gigachat-2-max): Флагман GigaChat; контекст 131K токенов; цена от 569.34 ₽ за 1M токенов
## Модели: Эмбеддинг (12)
- [yandex/text-search-doc](https://tsarrouter.ru/models/yandex/text-search-doc): контекст 2K токенов; цена 10.1 ₽ за 1M токенов
- [yandex/text-search-query](https://tsarrouter.ru/models/yandex/text-search-query): контекст 2K токенов; цена 10.1 ₽ за 1M токенов
- [yandex/text-embeddings-doc-v2](https://tsarrouter.ru/models/yandex/text-embeddings-doc-v2): контекст 2K токенов; цена 10.1 ₽ за 1M токенов
- [yandex/text-embeddings-query-v2](https://tsarrouter.ru/models/yandex/text-embeddings-query-v2): контекст 2K токенов; цена 10.1 ₽ за 1M токенов
- [Qwen/Qwen3-Embedding-0.6B](https://tsarrouter.ru/models/Qwen/Qwen3-Embedding-0.6B): контекст 33K токенов; цена 0.85 ₽ за 1M токенов
- [BAAI/bge-m3](https://tsarrouter.ru/models/BAAI/bge-m3): контекст 8K токенов; цена от 0.61 ₽ за 1M токенов
- [Qwen/Qwen3-VL-Embedding-2B](https://tsarrouter.ru/models/Qwen/Qwen3-VL-Embedding-2B): контекст 33K токенов; цена 73.2 ₽ за 1M токенов
- [Qwen/Qwen3-VL-Embedding-8B](https://tsarrouter.ru/models/Qwen/Qwen3-VL-Embedding-8B): контекст 33K токенов; цена 85.4 ₽ за 1M токенов
- [sber/gigachat-embeddings](https://tsarrouter.ru/models/sber/gigachat-embeddings): контекст 0.5K токенов; цена 14.0 ₽ за 1M токенов
- [sber/gigachat-embeddings-2](https://tsarrouter.ru/models/sber/gigachat-embeddings-2): контекст 0.5K токенов; цена 14.0 ₽ за 1M токенов
- [sber/gigaembeddings-3b](https://tsarrouter.ru/models/sber/gigaembeddings-3b): контекст 4.1K токенов; цена 14.0 ₽ за 1M токенов
- [sber/embeddings-gigar](https://tsarrouter.ru/models/sber/embeddings-gigar): контекст 4.1K токенов; цена 14.0 ₽ за 1M токенов
## Модели: Реранкер (4)
- [Qwen/Qwen3-Reranker-0.6B](https://tsarrouter.ru/models/Qwen/Qwen3-Reranker-0.6B): контекст 41K токенов; цена 0.85 ₽ за 1M токенов
- [BAAI/bge-reranker-v2-m3](https://tsarrouter.ru/models/BAAI/bge-reranker-v2-m3): контекст 8.2K токенов; цена 0.24 ₽ за 1M токенов
- [Qwen/Qwen3-VL-Reranker-2B](https://tsarrouter.ru/models/Qwen/Qwen3-VL-Reranker-2B): контекст 33K токенов; цена 54.9 ₽ за 1M токенов
- [Qwen/Qwen3-VL-Reranker-8B](https://tsarrouter.ru/models/Qwen/Qwen3-VL-Reranker-8B): контекст 33K токенов; цена 85.4 ₽ за 1M токенов
## Модели: Vision OCR (21)
- [deepseek-ai/DeepSeek-OCR-2](https://tsarrouter.ru/models/deepseek-ai/DeepSeek-OCR-2): цена 54.9 ₽ / 61.0 ₽ за 1M токенов (вход / выход)
- [yandex/ocr-page](https://tsarrouter.ru/models/yandex/ocr-page): Распознавание печатного текста (текст по строкам); цена 0.1321 ₽/запрос
- [yandex/ocr-page-column-sort](https://tsarrouter.ru/models/yandex/ocr-page-column-sort): Распознавание печатного текста с сортировкой по колонкам; цена 0.1321 ₽/запрос
- [yandex/ocr-handwritten](https://tsarrouter.ru/models/yandex/ocr-handwritten): Распознавание рукописного и печатного текста; цена 1.52 ₽/запрос
- [yandex/ocr-table](https://tsarrouter.ru/models/yandex/ocr-table): Распознавание таблиц; цена 1.22 ₽/запрос
- [yandex/ocr-markdown](https://tsarrouter.ru/models/yandex/ocr-markdown): Распознавание текста, вывод в формате Markdown; цена 0.1321 ₽/запрос
- [yandex/ocr-math-markdown](https://tsarrouter.ru/models/yandex/ocr-math-markdown): Распознавание текста и математических формул (Markdown); цена 0.1321 ₽/запрос
- [yandex/ocr-passport](https://tsarrouter.ru/models/yandex/ocr-passport): Распознавание данных паспорта; цена 0.71 ₽/запрос
- [yandex/ocr-driver-license-front](https://tsarrouter.ru/models/yandex/ocr-driver-license-front): Водительское удостоверение — лицевая сторона; цена 0.71 ₽/запрос
- [yandex/ocr-driver-license-back](https://tsarrouter.ru/models/yandex/ocr-driver-license-back): Водительское удостоверение — оборотная сторона; цена 0.71 ₽/запрос
- [yandex/ocr-vehicle-registration-front](https://tsarrouter.ru/models/yandex/ocr-vehicle-registration-front): СТС (свидетельство о регистрации ТС) — лицевая сторона; цена 0.71 ₽/запрос
- [yandex/ocr-vehicle-registration-back](https://tsarrouter.ru/models/yandex/ocr-vehicle-registration-back): СТС (свидетельство о регистрации ТС) — оборотная сторона; цена 0.71 ₽/запрос
- [yandex/ocr-license-plates](https://tsarrouter.ru/models/yandex/ocr-license-plates): Распознавание автомобильных номерных знаков; цена 0.1321 ₽/запрос
- [vkcloud/car-number](https://tsarrouter.ru/models/vkcloud/car-number): Распознавание автомобильных номеров (VK Cloud Vision); цена 0.06 ₽/запрос
- [vkcloud/text-recognize](https://tsarrouter.ru/models/vkcloud/text-recognize): Распознавание текста в документах (VK Cloud Vision); цена 0.06 ₽/запрос
- [vkcloud/scene-text](https://tsarrouter.ru/models/vkcloud/scene-text): Распознавание текста на уличных фотографиях (VK Cloud Vision); цена 0.06 ₽/запрос
- [vkcloud/adult-detect](https://tsarrouter.ru/models/vkcloud/adult-detect): Определение контента 18+ на изображении (VK Cloud Vision); цена 0.06 ₽/запрос
- [vkcloud/doc-recognize](https://tsarrouter.ru/models/vkcloud/doc-recognize): Распознавание полей документов (паспорт и др.) (VK Cloud Vision); цена 0.06 ₽/запрос
- [vkcloud/object-detect](https://tsarrouter.ru/models/vkcloud/object-detect): Распознавание объектов на изображении (VK Cloud Vision); цена 0.06 ₽/запрос
- [vkcloud/scene-detect](https://tsarrouter.ru/models/vkcloud/scene-detect): Распознавание сцен на изображении (VK Cloud Vision); цена 0.06 ₽/запрос
- [vkcloud/pedestrian-detect](https://tsarrouter.ru/models/vkcloud/pedestrian-detect): Распознавание людей на изображении (VK Cloud Vision); цена 0.06 ₽/запрос
## Модели: Расшифровка речи (STT) (9)
- [openai/whisper-large-v3](https://tsarrouter.ru/models/openai/whisper-large-v3): Whisper large-v3 — мультиязычное распознавание речи. Основной канал Nexara (пословные таймкоды, платные допы: диаризация, роли, фильтрация мата), резерв — Cloud.ru и MTS (Preview, посегментные метки); часть провайдеров отдаёт модель в превью-доступе (без гарантий доступности, цена временная); контекст 0.4K токенов; цена до 0.60 ₽/мин
- [nexara/speech-to-text-ru](https://tsarrouter.ru/models/nexara/speech-to-text-ru): Nexara RU — российская модель распознавания, заточенная под русскую речь. Пословные таймкоды, субтитры SRT/VTT, платные допы: диаризация, роли, фильтрация мата; цена 0.36 ₽/мин
- [palatine/speech-to-text](https://tsarrouter.ru/models/palatine/speech-to-text): Palatine — российская модель распознавания речи: транскрибация с пословными метками, субтитры SRT/VTT; цена 0.29 ₽/мин
- [palatine/speech-to-text-diarize](https://tsarrouter.ru/models/palatine/speech-to-text-diarize): Palatine — разделение записи по дикторам: метки говорящих и границы реплик, без расшифровки текста. Текст — отдельной моделью palatine/speech-to-text; цена 0.30 ₽/мин
- [tbank/speech-to-text](https://tsarrouter.ru/models/tbank/speech-to-text): T-Bank VoiceKit — российское распознавание речи (синхронная обработка файла), пословные таймкоды и авто-пунктуация; цена 0.38 ₽/мин
- [yandex/speech-to-text](https://tsarrouter.ru/models/yandex/speech-to-text): Yandex SpeechKit — синхронное распознавание речи: мгновенный ответ на короткие записи до 30 секунд. WAV и OGG/Opus, русский и другие языки; цена 0.65 ₽/мин; тарификация блоками по 15 с
- [yandex/speech-to-text-async](https://tsarrouter.ru/models/yandex/speech-to-text-async): Yandex SpeechKit — асинхронное распознавание длинных записей: диаризация (кто и что сказал), пословные таймкоды, авто-определение языка. MP3, WAV и OGG/Opus; цена 0.61 ₽/мин; минимум 15 с, далее посекундно, неполная секунда - как полная
- [ai-sage/GigaAM-v3](https://tsarrouter.ru/models/ai-sage/GigaAM-v3): GigaAM-v3 (Сбер) - российская модель распознавания русской речи. Сквозная расшифровка сразу с пунктуацией, заглавными буквами и числами в цифрах, посегментные метки времени; превью-доступ: провайдер не гарантирует доступность и может отключить модель без предупреждения, цена временная; цена бесплатно
- [palatine/speech-to-text-stream](https://tsarrouter.ru/models/palatine/speech-to-text-stream): Palatine — потоковое распознавание речи в реальном времени: WebSocket-сессия, промежуточные результаты по мере речи (формат событий OpenAI Realtime transcription). Вход — PCM 16 бит, 8–48 кГц; цена 0.29 ₽/мин
## Модели: Синтез речи (TTS) (1)
- [yandex/yandex-tts](https://tsarrouter.ru/models/yandex/yandex-tts): Yandex SpeechKit v3 — синтез речи из текста. 14 голосов на выбор, амплуа, управление скоростью и тембром, TTS-разметка (ударения, паузы, акценты, фонемы). На выходе MP3/OGG/WAV. Языки: рус/англ/каз/узб/ивр; цена 0.1626 ₽/250 симв.; неполный блок из 250 символов считается полным
## Модели: Изображения (2)
- [yandex/aliceai-image-art](https://tsarrouter.ru/models/yandex/aliceai-image-art): Alice AI ART 3.0 — генерация изображений по текстовому описанию (Яндекс). До 500 символов промпта, на выходе JPEG; цена 2.23 ₽/запрос
- [sber/kandinsky](https://tsarrouter.ru/models/sber/kandinsky): Кандинский — генерация изображений по тексту (встроенный text2image GigaChat, Сбер). До 1000 символов промпта, на выходе JPEG 1024×1024. Хорошо рисует короткие надписи на русском; длинный текст в кадре — нечитаемо; цена 0.65 ₽/запрос
## Модели: Другие (7)
- [sber/GigaCheckClassification](https://tsarrouter.ru/models/sber/GigaCheckClassification): GigaCheck (Сбер) — классификация текста целиком: написан человеком или сгенерирован нейросетью (ai/human). При вердикте «ai» интервал ai_intervals покрывает весь текст ([0, длина]), без разбивки на фрагменты — для пофрагментной разметки используйте Detection. Только русский язык, минимум 20 слов; цена 500 ₽ за 1M токенов
- [sber/GigaCheckDetection](https://tsarrouter.ru/models/sber/GigaCheckDetection): GigaCheck (Сбер) — детекция ИИ-фрагментов в тексте: классы ai/human/mixed и интервалы сгенерированных кусков (ai_intervals). Пофрагментная разбивка даётся только при вердикте «mixed»; при «ai» интервал покрывает весь текст, при «human» — пуст. Только русский язык, минимум 20 слов; цена 500 ₽ за 1M токенов
- [yandex/text-classifier-lite](https://tsarrouter.ru/models/yandex/text-classifier-lite): Относит текст к одному из 2–20 ваших классов. Работает без примеров (zero-shot) или с примерами для точности (few-shot). База — YandexGPT Lite: дешевле, подходит для большинства задач; цена 0.1525 ₽/1000 вх. токенов; неполный блок из 1000 входных токенов считается полным
- [yandex/text-classifier-pro](https://tsarrouter.ru/models/yandex/text-classifier-pro): То же, что text-classifier-lite, но на базе YandexGPT Pro — точнее на сложных и неоднозначных текстах. Те же 2–20 классов, zero-shot или few-shot. Дороже Lite, особенно на длинных текстах; цена 0.1525 ₽/250 вх. токенов; неполный блок из 250 входных токенов считается полным
- [vkcloud/photo-improve](https://tsarrouter.ru/models/vkcloud/photo-improve): Реставрация фотографий (VK Cloud Vision): убирает дефекты и шум, а для чёрно-белых снимков восстанавливает цвет. Возвращает все доступные варианты (улучшенный, раскрашенный, улучшенный+раскрашенный). Если фото уже хорошего качества, улучшение может не вернуться; цена 0.06 ₽/запрос
- [vkcloud/photo-resolution](https://tsarrouter.ru/models/vkcloud/photo-resolution): Увеличение разрешения изображения (VK Cloud Vision): апскейл ×2 или ×4 с восстановлением деталей. Параметр rtype — photo (фотографии) или art (рисунки/арт); цена 0.06 ₽/запрос
- [palatine/speech-sentiment](https://tsarrouter.ru/models/palatine/speech-sentiment): Palatine — анализ тональности речи: определяет эмоциональную окраску по аудио или видео, выдаёт вероятности по 5 классам (от очень негативной до очень позитивной); цена 0.39 ₽/мин
## Бенчмарки
Собственные прогоны на моделях, развёрнутых в России. Ниже - только действующие модели и актуальные наборы тестов; баллы по шкале 0-100. Снятые с рейтинга модели - в выгрузках, с признаком active=false.
Лицензия: CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Лицензия CC BY 4.0 распространяется только на результаты замеров, выполненных сервисом ЦАРЬ РОУТЕР. Методики и наборы заданий остаются собственностью их правообладателей и используются на их условиях.
Подпись при цитировании: Источник: ЦАРЬ РОУТЕР, https://tsarrouter.ru/benchmarks (CC BY 4.0)
Результаты обновлены: 04.09.2026.
Выгрузки: [benchmarks.csv](https://tsarrouter.ru/benchmarks.csv), [benchmarks.json](https://tsarrouter.ru/benchmarks.json)
### Царь Индекс
Среднее четырёх величин: LiveBench (Среднее), MRCR v2 (среднее по измеренным окнам), Bullshit Detection Benchmark (Распознал (2)), claw-eval (Claw Score). Только модели, у которых есть результат в каждой из четырёх.
- [Qwen3.6-35B-A3B (medium)](https://tsarrouter.ru/models/Qwen/Qwen3.6-35B-A3B) (Qwen/Qwen3.6-35B-A3B): Царь Индекс 59.0
- [Qwen3.8-27B (medium, INT4)](https://tsarrouter.ru/models/Qwen/Qwen3.8-27B) (Qwen/Qwen3.8-27B): Царь Индекс 58.5
- [DeepSeek V4 Flash (medium)](https://tsarrouter.ru/models/deepseek/deepseek-v4-flash) (deepseek/deepseek-v4-flash): Царь Индекс 50.9
- [gpt-oss-120b (medium)](https://tsarrouter.ru/models/openai/gpt-oss-120b) (openai/gpt-oss-120b): Царь Индекс 37.9
- [Qwen3.5-35B-A3B](https://tsarrouter.ru/models/Qwen/Qwen3.5-35B-A3B) (Qwen/Qwen3.5-35B-A3B): Царь Индекс 35.5
- [Gemma-4-26b-a4b-it](https://tsarrouter.ru/models/google/gemma-4-26b-a4b-it) (google/gemma-4-26b-a4b-it): Царь Индекс 33.9
- [AliceAI-LLM (128k)](https://tsarrouter.ru/models/yandex/aliceai-llm) (yandex/aliceai-llm): Царь Индекс 33.9
- [AliceAI-LLM Flash](https://tsarrouter.ru/models/yandex/aliceai-llm-flash) (yandex/aliceai-llm-flash): Царь Индекс 32.0
- [Qwen3-Coder-Next-32B](https://tsarrouter.ru/models/Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct) (Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct): Царь Индекс 29.6
- [Qwen3-235B](https://tsarrouter.ru/models/Qwen/Qwen3-235B-A22B-Instruct-2507) (Qwen/Qwen3-235B-A22B-Instruct-2507): Царь Индекс 29.0
- [GLM-4.7](https://tsarrouter.ru/models/zai-org/GLM-4.7) (zai-org/GLM-4.7): Царь Индекс 27.5
- [gpt-oss-20b (medium)](https://tsarrouter.ru/models/openai/gpt-oss-20b) (openai/gpt-oss-20b): Царь Индекс 23.6
- [GigaChat-2-Max (Sber, high)](https://tsarrouter.ru/models/sber/gigachat-2-max) (sber/gigachat-2-max): Царь Индекс 21.0
- [GigaChat-2-Pro (high)](https://tsarrouter.ru/models/sber/gigachat-2-pro) (sber/gigachat-2-pro): Царь Индекс 20.9
- [GigaChat-2-Pro](https://tsarrouter.ru/models/sber/gigachat-2-pro) (sber/gigachat-2-pro): Царь Индекс 19.9
- [GigaChat-2-Max (Sber)](https://tsarrouter.ru/models/sber/gigachat-2-max) (sber/gigachat-2-max): Царь Индекс 18.7
- [GigaChat-2-Lite (high)](https://tsarrouter.ru/models/sber/gigachat-2-lite) (sber/gigachat-2-lite): Царь Индекс 16.4
- [GigaChat-2-Lite](https://tsarrouter.ru/models/sber/gigachat-2-lite) (sber/gigachat-2-lite): Царь Индекс 15.6
- [GigaChat3-10B](https://tsarrouter.ru/models/ai-sage/GigaChat3-10B-A1.8B) (ai-sage/GigaChat3-10B-A1.8B): Царь Индекс 15.4
### LiveBench
Автоматический бенчмарк с регулярно обновляемыми вопросами. Математика, рассуждение, следование инструкциям, анализ данных, язык и код. Все ответы проверяются без LLM-судей - только точное сравнение с эталонным ответом.
- [Qwen3.8-27B (medium, INT4)](https://tsarrouter.ru/models/Qwen/Qwen3.8-27B) (Qwen/Qwen3.8-27B): Среднее 82.4; Math 89.2; Reasoning 93.9; Instruction Following 89.1; Data Analysis 74.6; Language 70.8; Coding 76.6
- [DeepSeek V4 Flash (medium)](https://tsarrouter.ru/models/deepseek/deepseek-v4-flash) (deepseek/deepseek-v4-flash): Среднее 78.7; Math 76.0; Reasoning 90.0; Instruction Following 92.0; Data Analysis 73.1; Language 78.0; Coding 62.9
- [gpt-oss-120b (medium)](https://tsarrouter.ru/models/openai/gpt-oss-120b) (openai/gpt-oss-120b): Среднее 73.5; Math 70.4; Reasoning 81.1; Instruction Following 77.1; Data Analysis 59.8; Language 78.5; Coding 74.4
- [Qwen3.6-35B-A3B (medium)](https://tsarrouter.ru/models/Qwen/Qwen3.6-35B-A3B) (Qwen/Qwen3.6-35B-A3B): Среднее 69.8; Math 46.9; Reasoning 76.4; Instruction Following 94.4; Data Analysis 76.7; Language 50.3; Coding 73.9
- [Gemma-4-26b-a4b-it](https://tsarrouter.ru/models/google/gemma-4-26b-a4b-it) (google/gemma-4-26b-a4b-it): Среднее 67.6; Math 73.2; Reasoning 76.4; Instruction Following 76.2; Data Analysis 65.1; Language 46.0; Coding 68.7
- [Qwen3.5-35B-A3B](https://tsarrouter.ru/models/Qwen/Qwen3.5-35B-A3B) (Qwen/Qwen3.5-35B-A3B): Среднее 64.4; Math 32.1; Reasoning 79.2; Instruction Following 95.0; Data Analysis 65.5; Language 50.0; Coding 64.4
- [AliceAI-LLM (128k)](https://tsarrouter.ru/models/yandex/aliceai-llm) (yandex/aliceai-llm): Среднее 60.2; Math 66.8; Reasoning 60.2; Instruction Following 64.9; Data Analysis 59.6; Language 42.5; Coding 67.3
- [AliceAI-LLM Flash](https://tsarrouter.ru/models/yandex/aliceai-llm-flash) (yandex/aliceai-llm-flash): Среднее 57.1; Math 62.5; Reasoning 55.6; Instruction Following 59.4; Data Analysis 64.2; Language 32.5; Coding 68.6
- [gpt-oss-20b (medium)](https://tsarrouter.ru/models/openai/gpt-oss-20b) (openai/gpt-oss-20b): Среднее 55.8; Math 55.1; Reasoning 62.0; Instruction Following 75.8; Data Analysis 64.6; Language 14.0; Coding 63.0
- [GigaChat-2-Max (Sber, high)](https://tsarrouter.ru/models/sber/gigachat-2-max) (sber/gigachat-2-max): Среднее 46.1; Math 44.7; Reasoning 34.8; Instruction Following 65.2; Data Analysis 53.7; Language 28.8; Coding 49.6
- [Qwen3-Coder-Next-32B](https://tsarrouter.ru/models/Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct) (Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct): Среднее 44.8; Math 40.5; Reasoning 3.0; Instruction Following 69.2; Data Analysis 63.3; Language 24.0; Coding 68.5
- [Qwen3-235B](https://tsarrouter.ru/models/Qwen/Qwen3-235B-A22B-Instruct-2507) (Qwen/Qwen3-235B-A22B-Instruct-2507): Среднее 44.6; Math 8.0; Reasoning 50.0; Instruction Following 76.7; Data Analysis 60.3; Language 6.0; Coding 66.9
- [GLM-4.7](https://tsarrouter.ru/models/zai-org/GLM-4.7) (zai-org/GLM-4.7): Среднее 42.7; Math 30.0; Reasoning 20.0; Instruction Following 78.9; Data Analysis 66.7; Language 4.0; Coding 56.4
- [GigaChat-2-Pro](https://tsarrouter.ru/models/sber/gigachat-2-pro) (sber/gigachat-2-pro): Среднее 42.1; Math 37.3; Reasoning 36.2; Instruction Following 66.9; Data Analysis 46.6; Language 24.2; Coding 41.5
- [GigaChat-2-Max (Sber)](https://tsarrouter.ru/models/sber/gigachat-2-max) (sber/gigachat-2-max): Среднее 41.4; Math 39.3; Reasoning 32.0; Instruction Following 64.5; Data Analysis 44.0; Language 22.0; Coding 46.7
- [GigaChat-2-Pro (high)](https://tsarrouter.ru/models/sber/gigachat-2-pro) (sber/gigachat-2-pro): Среднее 39.9; Math 36.7; Reasoning 35.6; Instruction Following 65.6; Data Analysis 46.2; Language 19.8; Coding 35.8
- [GigaChat-2-Lite (high)](https://tsarrouter.ru/models/sber/gigachat-2-lite) (sber/gigachat-2-lite): Среднее 29.1; Math 28.0; Reasoning 25.9; Instruction Following 55.9; Data Analysis 29.1; Language 15.8; Coding 20.0
- [GigaChat-2-Lite](https://tsarrouter.ru/models/sber/gigachat-2-lite) (sber/gigachat-2-lite): Среднее 27.1; Math 23.5; Reasoning 27.2; Instruction Following 55.7; Data Analysis 24.1; Language 7.5; Coding 24.7
- [GigaChat3-10B](https://tsarrouter.ru/models/ai-sage/GigaChat3-10B-A1.8B) (ai-sage/GigaChat3-10B-A1.8B): Среднее 20.9; Math 24.3; Reasoning 5.0; Instruction Following 42.2; Data Analysis 32.8; Language 0.7; Coding 20.7
### Контекстное окно (MRCR v2)
Тест DeepMind (MRCR, multi-round coreference resolution) на работу с длинным контекстом: в диалоге модель должна точно воспроизвести один конкретный из восьми похожих ответов ассистента. Оценивается точность при увеличении размера контекста. Инструменты модели не предоставлялись.
- [DeepSeek V4 Pro (medium)](https://tsarrouter.ru/models/deepseek-ai/DeepSeek-V4-Pro) (deepseek-ai/DeepSeek-V4-Pro): 4K 100.0; 8K 85.1; 16K 91.2; 32K 67.9; 64K 75.4; 128K 28.0
- [Qwen3.6-35B-A3B (medium)](https://tsarrouter.ru/models/Qwen/Qwen3.6-35B-A3B) (Qwen/Qwen3.6-35B-A3B): 4K 100.0; 8K 95.1; 16K 95.5; 32K 70.8; 64K 60.7
- [Qwen3.8-27B (medium, INT4)](https://tsarrouter.ru/models/Qwen/Qwen3.8-27B) (Qwen/Qwen3.8-27B): 4K 100.0; 8K 100.0; 16K 100.0; 32K 80.3; 64K 21.9
- [DeepSeek V4 Flash (medium)](https://tsarrouter.ru/models/deepseek/deepseek-v4-flash) (deepseek/deepseek-v4-flash): 4K 99.8; 8K 85.3; 16K 67.1; 32K 46.4; 64K 17.3; 128K 70.7
- [gpt-oss-120b (medium)](https://tsarrouter.ru/models/openai/gpt-oss-120b) (openai/gpt-oss-120b): 4K 78.4; 8K 32.8; 16K 30.4; 32K 17.8
- [AliceAI-LLM (128k)](https://tsarrouter.ru/models/yandex/aliceai-llm) (yandex/aliceai-llm): 4K 46.4; 8K 36.3; 16K 29.6; 32K 17.4
- [Qwen3-235B](https://tsarrouter.ru/models/Qwen/Qwen3-235B-A22B-Instruct-2507) (Qwen/Qwen3-235B-A22B-Instruct-2507): 4K 31.9; 8K 27.0; 16K 24.2; 32K 16.2; 64K 17.1
- [Gemma-4-26b-a4b-it](https://tsarrouter.ru/models/google/gemma-4-26b-a4b-it) (google/gemma-4-26b-a4b-it): 4K 36.1; 8K 36.7; 16K 16.1; 32K 19.3
- [Qwen3-Coder-Next-32B](https://tsarrouter.ru/models/Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct) (Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct): 4K 31.2; 8K 17.4; 16K 13.1; 32K 13.9; 64K 17.2
- [AliceAI-LLM Flash](https://tsarrouter.ru/models/yandex/aliceai-llm-flash) (yandex/aliceai-llm-flash): 4K 16.9; 8K 22.1; 16K 19.4
- [gpt-oss-20b (medium)](https://tsarrouter.ru/models/openai/gpt-oss-20b) (openai/gpt-oss-20b): 4K 27.9; 8K 12.6; 16K 9.9; 32K 5.8
- [GLM-4.7](https://tsarrouter.ru/models/zai-org/GLM-4.7) (zai-org/GLM-4.7): 4K 16.5; 8K 14.1; 16K 13.8; 32K 8.6; 64K 3.1
- [GigaChat-2-Pro (high)](https://tsarrouter.ru/models/sber/gigachat-2-pro) (sber/gigachat-2-pro): 4K 12.7; 8K 12.4; 16K 13.6; 32K 15.7
- [GigaChat-2-Lite](https://tsarrouter.ru/models/sber/gigachat-2-lite) (sber/gigachat-2-lite): 4K 7.2; 8K 17.0; 16K 14.4; 32K 8.9
- [GigaChat-2-Pro](https://tsarrouter.ru/models/sber/gigachat-2-pro) (sber/gigachat-2-pro): 4K 11.8; 8K 12.7; 16K 8.5; 32K 7.6
- [GigaChat-2-Lite (high)](https://tsarrouter.ru/models/sber/gigachat-2-lite) (sber/gigachat-2-lite): 4K 8.5; 8K 11.7; 16K 9.7; 32K 7.9
- [GigaChat-2-Max (Sber)](https://tsarrouter.ru/models/sber/gigachat-2-max) (sber/gigachat-2-max): 4K 14.3; 8K 10.3; 16K 9.6; 32K 3.3
- [GigaChat-2-Max (Sber, high)](https://tsarrouter.ru/models/sber/gigachat-2-max) (sber/gigachat-2-max): 4K 13.8; 8K 8.7; 16K 10.4; 32K 3.0
- [Qwen3.5-35B-A3B](https://tsarrouter.ru/models/Qwen/Qwen3.5-35B-A3B) (Qwen/Qwen3.5-35B-A3B): 4K 15.5; 8K 2.2; 16K 4.0; 32K 5.0; 64K 3.2
- [GigaChat3-10B](https://tsarrouter.ru/models/ai-sage/GigaChat3-10B-A1.8B) (ai-sage/GigaChat3-10B-A1.8B): 4K 4.8; 8K 6.6; 16K 14.0; 32K 2.4; 64K 0.8
### Bullshit Detection Benchmark
Тест на распознавание бессмысленных вопросов (petergpt/bullshit-benchmark, набор v1). 55 вопросов, распределённых по 10 техникам. Три судьи (Claude Sonnet 4.6, GPT-5.2, Gemini 3.1 Pro) оценивают ответы: 2 = распознал, 1 = частично, 0 = не распознал. Итоговый балл = распознал% + частично%/2. Сортировка по итоговому баллу; в Царь Индекс идёт только доля «Распознал (2)».
- [Qwen3.6-35B-A3B (medium)](https://tsarrouter.ru/models/Qwen/Qwen3.6-35B-A3B) (Qwen/Qwen3.6-35B-A3B): Распознал (2) 46.1; Частично (1) 20.0; Не распознал (0) 33.9
- [Qwen3.5-35B-A3B](https://tsarrouter.ru/models/Qwen/Qwen3.5-35B-A3B) (Qwen/Qwen3.5-35B-A3B): Распознал (2) 37.0; Частично (1) 25.5; Не распознал (0) 37.6
- [Qwen3-Coder-Next-32B](https://tsarrouter.ru/models/Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct) (Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct): Распознал (2) 27.3; Частично (1) 25.5; Не распознал (0) 47.3
- [Qwen3-235B](https://tsarrouter.ru/models/Qwen/Qwen3-235B-A22B-Instruct-2507) (Qwen/Qwen3-235B-A22B-Instruct-2507): Распознал (2) 22.4; Частично (1) 23.6; Не распознал (0) 53.9
- [Qwen3.8-27B (medium, INT4)](https://tsarrouter.ru/models/Qwen/Qwen3.8-27B) (Qwen/Qwen3.8-27B): Распознал (2) 27.9; Частично (1) 9.3; Не распознал (0) 62.8
- [AliceAI-LLM Flash](https://tsarrouter.ru/models/yandex/aliceai-llm-flash) (yandex/aliceai-llm-flash): Распознал (2) 24.8; Частично (1) 7.3; Не распознал (0) 67.9
- [GLM-4.7](https://tsarrouter.ru/models/zai-org/GLM-4.7) (zai-org/GLM-4.7): Распознал (2) 20.4; Частично (1) 12.2; Не распознал (0) 67.3
- [AliceAI-LLM (128k)](https://tsarrouter.ru/models/yandex/aliceai-llm) (yandex/aliceai-llm): Распознал (2) 18.8; Частично (1) 12.1; Не распознал (0) 69.1
- [DeepSeek V4 Flash (medium)](https://tsarrouter.ru/models/deepseek/deepseek-v4-flash) (deepseek/deepseek-v4-flash): Распознал (2) 22.4; Частично (1) 4.2; Не распознал (0) 73.3
- [DeepSeek V4 Pro (medium)](https://tsarrouter.ru/models/deepseek-ai/DeepSeek-V4-Pro) (deepseek-ai/DeepSeek-V4-Pro): Распознал (2) 15.8; Частично (1) 10.9; Не распознал (0) 73.3
- [GigaChat3-10B](https://tsarrouter.ru/models/ai-sage/GigaChat3-10B-A1.8B) (ai-sage/GigaChat3-10B-A1.8B): Распознал (2) 11.1; Частично (1) 9.3; Не распознал (0) 79.6
- [Gemma-4-26b-a4b-it](https://tsarrouter.ru/models/google/gemma-4-26b-a4b-it) (google/gemma-4-26b-a4b-it): Распознал (2) 11.5; Частично (1) 5.5; Не распознал (0) 83.0
- [GigaChat-2-Pro (high)](https://tsarrouter.ru/models/sber/gigachat-2-pro) (sber/gigachat-2-pro): Распознал (2) 7.3; Частично (1) 9.7; Не распознал (0) 83.0
- [gpt-oss-120b (medium)](https://tsarrouter.ru/models/openai/gpt-oss-120b) (openai/gpt-oss-120b): Распознал (2) 7.9; Частично (1) 6.7; Не распознал (0) 85.5
- [GigaChat-2-Pro](https://tsarrouter.ru/models/sber/gigachat-2-pro) (sber/gigachat-2-pro): Распознал (2) 5.5; Частично (1) 10.9; Не распознал (0) 83.6
- [GigaChat-2-Lite (high)](https://tsarrouter.ru/models/sber/gigachat-2-lite) (sber/gigachat-2-lite): Распознал (2) 4.2; Частично (1) 7.9; Не распознал (0) 87.9
- [gpt-oss-20b (medium)](https://tsarrouter.ru/models/openai/gpt-oss-20b) (openai/gpt-oss-20b): Распознал (2) 3.9; Частично (1) 7.8; Не распознал (0) 88.2
- [GigaChat-2-Max (Sber, high)](https://tsarrouter.ru/models/sber/gigachat-2-max) (sber/gigachat-2-max): Распознал (2) 4.2; Частично (1) 5.5; Не распознал (0) 90.3
- [GigaChat-2-Max (Sber)](https://tsarrouter.ru/models/sber/gigachat-2-max) (sber/gigachat-2-max): Распознал (2) 2.4; Частично (1) 4.8; Не распознал (0) 92.7
- [GigaChat-2-Lite](https://tsarrouter.ru/models/sber/gigachat-2-lite) (sber/gigachat-2-lite): Распознал (2) 1.8; Частично (1) 3.6; Не распознал (0) 94.5
### claw-eval (Agent Tasks)
Оценка агентских способностей модели: 300 задач (планирование, инструменты, многошаговое выполнение). Claw Score - наш сводный балл, взвешенное среднее (completion×0.1 + pass@1×0.7 + robustness×0.1 + safety×0.1); он не совпадает с метрикой Pass^3 официального лидерборда claw-eval - у нас один прогон вместо трёх и другой судья. Completion - доля выполненных подзадач. Robustness - стабильность (не зациклился, не упал). Safety - безопасность (не выполнил деструктивных действий). Pass@1 - задачи, решённые полностью.
- [Qwen3.8-27B (medium, INT4)](https://tsarrouter.ru/models/Qwen/Qwen3.8-27B) (Qwen/Qwen3.8-27B): Claw Score 43.4; Pass@1 28.7; Completion 38.4; Robustness 95.9; Safety 99.0
- [DeepSeek V4 Flash (medium)](https://tsarrouter.ru/models/deepseek/deepseek-v4-flash) (deepseek/deepseek-v4-flash): Claw Score 38.1; Pass@1 24.3; Completion 33.6; Robustness 80.7; Safety 96.3
- [Qwen3.6-35B-A3B (medium)](https://tsarrouter.ru/models/Qwen/Qwen3.6-35B-A3B) (Qwen/Qwen3.6-35B-A3B): Claw Score 35.8; Pass@1 20.3; Completion 29.3; Robustness 89.0; Safety 97.0
- [GLM-4.7](https://tsarrouter.ru/models/zai-org/GLM-4.7) (zai-org/GLM-4.7): Claw Score 35.6; Pass@1 18.8; Completion 29.1; Robustness 97.1; Safety 97.7
- [Qwen3.5-35B-A3B](https://tsarrouter.ru/models/Qwen/Qwen3.5-35B-A3B) (Qwen/Qwen3.5-35B-A3B): Claw Score 34.6; Pass@1 17.7; Completion 31.7; Robustness 93.3; Safety 96.8
- [gpt-oss-120b (medium)](https://tsarrouter.ru/models/openai/gpt-oss-120b) (openai/gpt-oss-120b): Claw Score 30.5; Pass@1 12.1; Completion 24.3; Robustness 97.3; Safety 98.3
- [Gemma-4-26b-a4b-it](https://tsarrouter.ru/models/google/gemma-4-26b-a4b-it) (google/gemma-4-26b-a4b-it): Claw Score 29.5; Pass@1 10.7; Completion 24.6; Robustness 97.1; Safety 99.0
- [Qwen3-Coder-Next-32B](https://tsarrouter.ru/models/Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct) (Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct): Claw Score 27.9; Pass@1 10.4; Completion 20.5; Robustness 90.2; Safety 95.6
- [AliceAI-LLM Flash](https://tsarrouter.ru/models/yandex/aliceai-llm-flash) (yandex/aliceai-llm-flash): Claw Score 26.5; Pass@1 7.3; Completion 20.0; Robustness 95.7; Safety 97.7
- [Qwen3-235B](https://tsarrouter.ru/models/Qwen/Qwen3-235B-A22B-Instruct-2507) (Qwen/Qwen3-235B-A22B-Instruct-2507): Claw Score 25.9; Pass@1 7.2; Completion 18.5; Robustness 93.2; Safety 96.9
- [GigaChat-2-Max (Sber, high)](https://tsarrouter.ru/models/sber/gigachat-2-max) (sber/gigachat-2-max): Claw Score 24.9; Pass@1 5.3; Completion 18.4; Robustness 95.2; Safety 98.3
- [AliceAI-LLM (128k)](https://tsarrouter.ru/models/yandex/aliceai-llm) (yandex/aliceai-llm): Claw Score 24.0; Pass@1 4.3; Completion 18.1; Robustness 94.9; Safety 97.0
- [GigaChat3-10B](https://tsarrouter.ru/models/ai-sage/GigaChat3-10B-A1.8B) (ai-sage/GigaChat3-10B-A1.8B): Claw Score 23.7; Pass@1 4.5; Completion 14.9; Robustness 93.5; Safety 97.0
- [GigaChat-2-Pro (high)](https://tsarrouter.ru/models/sber/gigachat-2-pro) (sber/gigachat-2-pro): Claw Score 22.8; Pass@1 2.7; Completion 14.7; Robustness 96.0; Safety 98.3
- [GigaChat-2-Lite (high)](https://tsarrouter.ru/models/sber/gigachat-2-lite) (sber/gigachat-2-lite): Claw Score 22.7; Pass@1 2.7; Completion 12.0; Robustness 96.7; Safety 99.3
- [GigaChat-2-Pro](https://tsarrouter.ru/models/sber/gigachat-2-pro) (sber/gigachat-2-pro): Claw Score 22.0; Pass@1 2.1; Completion 8.5; Robustness 98.6; Safety 98.3
- [GigaChat-2-Lite](https://tsarrouter.ru/models/sber/gigachat-2-lite) (sber/gigachat-2-lite): Claw Score 21.6; Pass@1 2.0; Completion 9.0; Robustness 96.3; Safety 96.9
- [GigaChat-2-Max (Sber)](https://tsarrouter.ru/models/sber/gigachat-2-max) (sber/gigachat-2-max): Claw Score 21.6; Pass@1 1.4; Completion 7.9; Robustness 98.1; Safety 99.7
- [gpt-oss-20b (medium)](https://tsarrouter.ru/models/openai/gpt-oss-20b) (openai/gpt-oss-20b): Claw Score 20.7; Pass@1 0.0; Completion 13.7; Robustness 96.0; Safety 97.5
### Стоимость прогонов
Расход бенчмарк-ключа за всё время, по данным биллинга. Включает прогоны неактуальных наборов, смоук-тесты и повторы, а не только опубликованные здесь сьюты. Прогоны до 28.07.2026 пересчитаны с учётом кэша промпта. 0 ₽ - прогон не тарифицировался.
- DeepSeek V4 Flash (medium) (deepseek/deepseek-v4-flash): 8184 ₽, 3290 запросов
- Qwen3.5-35B-A3B (Qwen/Qwen3.5-35B-A3B): 6902 ₽, 7197 запросов
- Qwen3.6-35B-A3B (medium) (Qwen/Qwen3.6-35B-A3B): 5804 ₽, 2782 запроса
- GigaChat-2-Max (Sber, high) (sber/gigachat-2-max): 3691 ₽, 2064 запроса
- AliceAI-LLM (128k) (yandex/aliceai-llm): 3615 ₽, 1755 запросов
- gpt-oss-120b (medium) (openai/gpt-oss-120b): 2426 ₽, 16479 запросов
- GigaChat-2-Pro (sber/gigachat-2-pro): 2143 ₽, 5826 запросов
- GigaChat-2-Pro (high) (sber/gigachat-2-pro): 1948 ₽, 2001 запрос
- GigaChat-2-Max (Sber) (sber/gigachat-2-max): 1881 ₽, 1818 запросов
- gpt-oss-20b (medium) (openai/gpt-oss-20b): 1288 ₽, 1886 запросов
- Qwen3-235B (Qwen/Qwen3-235B-A22B-Instruct-2507): 1189 ₽, 11418 запросов
- AliceAI-LLM Flash (yandex/aliceai-llm-flash): 802 ₽, 2271 запрос
- GigaChat-2-Lite (sber/gigachat-2-lite): 747 ₽, 6084 запроса
- GigaChat3-10B (ai-sage/GigaChat3-10B-A1.8B): 605 ₽, 15938 запросов
- GigaChat-2-Lite (high) (sber/gigachat-2-lite): 413 ₽, 3046 запросов
- Qwen3-Coder-Next-32B (Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct): 0 ₽, 21377 запросов
- Qwen3.8-27B (medium, INT4) (Qwen/Qwen3.8-27B): 0 ₽, 2463 запроса
- GLM-4.7 (zai-org/GLM-4.7): 0 ₽, 17826 запросов
- Gemma-4-26b-a4b-it (google/gemma-4-26b-a4b-it): 0 ₽, 3100 запросов
## Статус сервиса
Живой мониторинг: https://status.tsarrouter.ru - опрос каждой модели по расписанию, страница обновляется сама.
Под мониторингом 47 моделей каталога - это не весь каталог, полный состав в разделах «Модели» выше. Сейчас отвечают 47.
Аптайм ниже - за последние 24 часа, по модели целиком: если модель доступна у нескольких провайдеров, берётся лучший из них, потому что запрос уходит на живой автоматически.
Срез на момент генерации файла, не история. Актуальное состояние - всегда на странице статуса.
- aliceai-llm: отвечает, аптайм 24 ч 100.00%
- aliceai-llm-flash: отвечает, аптайм 24 ч 100.00%
- bge-m3: отвечает, аптайм 24 ч 100.00%
- bge-reranker-v2-m3: отвечает, аптайм 24 ч 100.00%
- deepseek-v4-flash: отвечает, аптайм 24 ч 100.00%
- deepseek-v4-flash-0731: отвечает, аптайм 24 ч 100.00%
- DeepSeek-V4-Pro: отвечает, аптайм 24 ч 100.00%
- embeddings-gigar: отвечает, аптайм 24 ч 100.00%
- gemma-4-26b-a4b-it: отвечает, аптайм 24 ч 100.00%
- gemma-4-31b-it: отвечает, аптайм 24 ч 100.00%
- gigachat-2-lite: отвечает, аптайм 24 ч 100.00%
- gigachat-2-max: отвечает, аптайм 24 ч 100.00%
- gigachat-2-pro: отвечает, аптайм 24 ч 100.00%
- gigachat-embeddings: отвечает, аптайм 24 ч 100.00%
- gigachat-embeddings-2: отвечает, аптайм 24 ч 100.00%
- GigaChat3-10B-A1.8B: отвечает, аптайм 24 ч 100.00%
- gigaembeddings-3b: отвечает, аптайм 24 ч 100.00%
- GLM-4.7: отвечает, аптайм 24 ч 100.00%
- GLM-5.1: отвечает, аптайм 24 ч 100.00%
- GLM-5.2: отвечает, аптайм 24 ч 100.00%
- gpt-oss-120b: отвечает, аптайм 24 ч 100.00%
- gpt-oss-20b: отвечает, аптайм 24 ч 100.00%
- Kimi-K2.6: отвечает, аптайм 24 ч 100.00%
- MiniMax-M2.5: отвечает, аптайм 24 ч 100.00%
- MiniMax-M3: отвечает, аптайм 24 ч 100.00%
- Nemotron-3-Nano-30B-A3B: отвечает, аптайм 24 ч 100.00%
- Qwen3-235B-A22B-Instruct-2507: отвечает, аптайм 24 ч 100.00%
- Qwen3-Coder-Next-32B-A3.2B-Instruct: отвечает, аптайм 24 ч 100.00%
- Qwen3-Embedding-0.6B: отвечает, аптайм 24 ч 100.00%
- Qwen3-Reranker-0.6B: отвечает, аптайм 24 ч 100.00%
- Qwen3-VL-Embedding-2B: отвечает, аптайм 24 ч 100.00%
- Qwen3-VL-Embedding-8B: отвечает, аптайм 24 ч 100.00%
- Qwen3-VL-Reranker-2B: отвечает, аптайм 24 ч 100.00%
- Qwen3-VL-Reranker-8B: отвечает, аптайм 24 ч 100.00%
- Qwen3.5-35B-A3B: отвечает, аптайм 24 ч 100.00%
- Qwen3.5-397B-A17B: отвечает, аптайм 24 ч 100.00%
- Qwen3.6-27B: отвечает, аптайм 24 ч 100.00%
- Qwen3.6-35B-A3B: отвечает, аптайм 24 ч 100.00%
- Qwen3.8-27B: отвечает, аптайм 24 ч 100.00%
- text-embeddings-doc-v2: отвечает, аптайм 24 ч 100.00%
- text-embeddings-query-v2: отвечает, аптайм 24 ч 100.00%
- text-search-doc: отвечает, аптайм 24 ч 100.00%
- text-search-query: отвечает, аптайм 24 ч 100.00%
- whisper-large-v3: отвечает, аптайм 24 ч 100.00%
- yandexgpt-lite-5: отвечает, аптайм 24 ч 100.00%
- yandexgpt-pro-5: отвечает, аптайм 24 ч 100.00%
- yandexgpt-pro-5.1: отвечает, аптайм 24 ч 100.00%
## Правовые документы
- [Публичная оферта](https://tsarrouter.ru/offer)
- [Политика конфиденциальности](https://tsarrouter.ru/privacy)
- [Согласие на обработку персональных данных](https://tsarrouter.ru/consent)
- [Политика использования cookie](https://tsarrouter.ru/cookies)