# Царь Роутер (TsarRouter) - полная выгрузка > Агрегатор российских и open-source нейросетей: единый OpenAI-совместимый API к моделям, развёрнутым в России (провайдеры: Яндекс, Сбер, MTS, Cloud.ru, VK и другие). Оплата российской банковской картой или через СБП, цены в рублях. Base URL API: `https://api.tsarrouter.ru/v1` - совместим с OpenAI SDK, ключи формата `sk-tsar-...`. Моделей в каталоге: 87. Этот файл генерируется автоматически из живого реестра моделей - состав и цены всегда актуальны. Бесплатные модели: если провайдер даёт модель бесплатно, ниже она помечена «бесплатно» и работает даже с нулевым балансом - пользоваться можно без пополнения. Состав меняется. Модели с пометкой «превью-доступ» бесплатны временно и без гарантий доступности. Цены «за запрос»: у синтеза речи (TTS) и классификаторов текста вызов тарифицируется блоками (по умолчанию 250 символов или токенов, у отдельных моделей размер блока другой), поэтому длинный запрос стоит кратно указанной ставке - считайте её нижней границей. У OCR, обработки и генерации изображений «за запрос» означает ровно один вызов. Персональные данные: оператор ПДн, рег. № 77-26-557111 в реестре Роскомнадзора. Все модели развёрнуты в ЦОД России - запросы не уходят за рубеж (152-ФЗ). Это llms-full.txt: весь публичный текст сайта и документации одним файлом. Короткая версия с оглавлением и ссылками - https://tsarrouter.ru/llms.txt. ## Оглавление - ## О сервисе - ## Быстрый старт - ## Документация - ### Старт - ### Быстрый старт - ### История изменений - ### Лимиты - ### Потоковое распознавание речи - ### Рассуждение моделей - ### Сколько стоит запрос - ### Список ошибок - ### Выбор провайдера и надёжность - ## Модели: Текст (31) - ## Модели: Эмбеддинг (12) - ## Модели: Реранкер (4) - ## Модели: Vision OCR (21) - ## Модели: Расшифровка речи (STT) (9) - ## Модели: Синтез речи (TTS) (1) - ## Модели: Изображения (2) - ## Модели: Другие (7) - ## Бенчмарки - ## Статус сервиса - ## Правовые документы ## О сервисе Единый OpenAI-совместимый API к моделям, развёрнутым в России. Меняете base_url - и всё работает: один ключ, оплата только за использование. - Подключение за 2 минуты: используете OpenAI SDK - просто поменяйте base_url. LangChain, curl, любой HTTP-клиент работают без нового SDK. - Автоподбор провайдера: вы указываете модель - если она доступна у нескольких провайдеров, система сама направит запрос на самый быстрый и дешёвый. - Запасные модели: укажите список моделей на замену - если основная не отвечает ни у одного провайдера, запрос автоматически уйдёт на следующую из списка. - 0% наценки на токены: цены провайдеров без наценки, комиссия 15% при пополнении - и всё. Платите только за то, что используете. - Оплата российской картой и СБП: пополнение от 100 ₽ картой любого российского банка (МИР, Visa, Mastercard) или по QR-коду через СБП. Неиспользованный остаток можно вернуть - условия в оферте https://tsarrouter.ru/offer. - Бесплатные модели: если провайдер даёт модель бесплатно, она доступна за 0 ₽ и работает даже с нулевым балансом. Состав меняется, актуальный список - https://tsarrouter.ru/models?caps=free. - Прозрачные тир-лимиты: лимиты запросов опубликованы целиком и растут с пополнением, без «обратитесь в отдел продаж». Сетка лимитов - https://docs.tsarrouter.ru/guide/limity. - Собственные бенчмарки: скорость и качество моделей тестируем сами и публикуем как есть, это не копия чужих таблиц - https://tsarrouter.ru/benchmarks. - Открытая документация: быстрый старт, примеры кода, справочник ошибок и лимитов - https://docs.tsarrouter.ru. Исходники в открытом репозитории https://gitverse.ru/tsartech/tsarrouter-docs, предложить правку может каждый. - Данные в России - 152-ФЗ: оператор персональных данных, рег. № 77-26-557111 в реестре Роскомнадзора. Все модели развёрнуты в ЦОД России, запросы не уходят за рубеж. Ссылки: - [Каталог моделей](https://tsarrouter.ru/models): все модели с ценами, статусом и контекстом - [models.csv](https://tsarrouter.ru/models.csv): каталог с ценами по провайдерам, машиночитаемо (CSV) - [models.json](https://tsarrouter.ru/models.json): то же в JSON - [Бенчмарки](https://tsarrouter.ru/benchmarks): Царь Индекс и собственные замеры качества, сводка ниже - [Изменения каталога](https://tsarrouter.ru/changelog): добавления и снятия моделей - [Статус сервиса](https://status.tsarrouter.ru): аптайм по каждой модели ## Быстрый старт Совместимо с OpenAI SDK: меняется только base_url и ключ. ```python from openai import OpenAI client = OpenAI( base_url="https://api.tsarrouter.ru/v1", api_key="sk-tsar-...", ) response = client.chat.completions.create( model="yandex/yandexgpt-pro-5.1", messages=[{"role": "user", "content": "Привет, ЦАРЬ!"}], ) print(response.choices[0].message.content) ``` Полное руководство - https://docs.tsarrouter.ru/guide. ## Документация Ниже - полный текст страниц https://docs.tsarrouter.ru, как он лежит в исходниках (markdown с элементами MDX). Таблицы лимитов подставлены живые. ### Старт Источник: https://docs.tsarrouter.ru/api Страница в работе. ### Быстрый старт Источник: https://docs.tsarrouter.ru/guide Сервис ЦАРЬ РОУТЕР находится на стадии **бета-тестирования**. 1. Если вы сталкиваетесь с ошибками в том числе 429 (превышение лимитов), то сообщите нам по почте [support@tsarrouter.ru](mailto:support@tsarrouter.ru) 2. Действуют лимиты запросов по уровням - подробнее на странице [Лимиты](https://docs.tsarrouter.ru/guide/limity). 3. Что еще находится в работе: 1. Добавление новых моделей и отладка текущих моделей. 2. Добавление эндпоинтов 3. И т.д. 4. На странице [Истории изменений](https://docs.tsarrouter.ru/guide/istoriya-izmenenij) можно узнать какие модели добавились/изменились/удалились и другие изменения сервиса. Спасибо, желаем удачного использования! #### 1. Базовый URL ``` https://api.tsarrouter.ru/v1 ``` Это адрес, который вы подставляете вместо `base_url` OpenAI. Все эндпоинты совместимы с форматом OpenAI. #### 2. Ключ Зарегистрируйтесь в [личном кабинете](https://tsarrouter.ru/dashboard) и создайте API-ключ. Формат: `sk-tsar-` + 40 hex-символов. Один ключ открывает доступ ко всем моделям всех провайдеров. Передавайте ключ в заголовке `Authorization`: ``` Authorization: Bearer sk-tsar-ваш-ключ ``` #### 3. Первый запрос ```python from openai import OpenAI client = OpenAI( base_url="https://api.tsarrouter.ru/v1", api_key="sk-tsar-ваш-ключ", ) response = client.chat.completions.create( model="yandex/yandexgpt-pro-5.1", messages=[{"role": "user", "content": "Привет!"}], ) print(response.choices[0].message.content) ``` ```javascript import OpenAI from "openai"; const client = new OpenAI({ baseURL: "https://api.tsarrouter.ru/v1", apiKey: "sk-tsar-ваш-ключ", }); const response = await client.chat.completions.create({ model: "sber/gigachat-2-max", messages: [{ role: "user", content: "Привет!" }], }); console.log(response.choices[0].message.content); ``` ```bash curl https://api.tsarrouter.ru/v1/chat/completions \ -H "Authorization: Bearer sk-tsar-ваш-ключ" \ -H "Content-Type: application/json" \ -d '{ "model": "yandex/yandexgpt-pro-5.1", "messages": [{"role": "user", "content": "Привет!"}] }' ``` #### 4. Названия моделей Все модели используют формат `provider/model`: `yandex/yandexgpt-pro-5.1`, `sber/gigachat-2-max`, `BAAI/bge-m3`. > **Регистр имеет значение.** `sber/gigachat-2-max` ≠ `Sber/gigachat-2-max`. Актуальный каталог моделей с ценами - на странице "[Модели](https://tsarrouter.ru/models)". Список идентификаторов можно получить и запросом (цен этот листинг не отдаёт): ```python from openai import OpenAI client = OpenAI( base_url="https://api.tsarrouter.ru/v1", api_key="sk-tsar-ваш-ключ", ) models = client.models.list() for model in models.data: print(model.id) ``` ```javascript import OpenAI from "openai"; const client = new OpenAI({ baseURL: "https://api.tsarrouter.ru/v1", apiKey: "sk-tsar-ваш-ключ", }); const models = await client.models.list(); for (const model of models.data) { console.log(model.id); } ``` ```bash curl https://api.tsarrouter.ru/v1/models \ -H "Authorization: Bearer sk-tsar-ваш-ключ" ``` ### История изменений Источник: https://docs.tsarrouter.ru/guide/istoriya-izmenenij ##### 03.09.2026 * **Анонсировано:** * 30 сентября провайдер **Yandex Cloud** отключает модель `Qwen/Qwen3-235B-A22B-Instruct-2507`. Вместе с уходом этой модели у **MWS** 9 сентября она станет недоступна полностью * 30 октября провайдер **Yandex Cloud** отключает модели `openai/gpt-oss-20b` и `openai/gpt-oss-120b` - обе остаются у других провайдеров * 31 октября провайдер **Sber GigaChat** прекращает работу GigaChat API. Часть моделей линейки останется доступна через провайдера **Cloud.ru**; какие именно - уточняем и сообщим отдельно ##### 02.09.2026 * **Анонсировано:** * 9 сентября провайдер **MWS** отключает модель `Qwen/Qwen3-235B-A22B-Instruct-2507` - модель остаётся у провайдера **Yandex Cloud** ##### 31.08.2026 * **Добавлено:** * `ai-sage/GigaAM-v3` - модель распознавания речи. ##### 30.08.2026 * **Изменено:** * Суточный лимит бесплатных моделей теперь растёт с уровнем аккаунта: | Уровень лимита | Было | Стало | | --- | --- | --- | | 0 | 250 | 250 | | 1 | 1000 | 500 | | 2 | 1000 | 1000 | | 3 | 1000 | 2000 | ##### 27.08.2026 * **Добавлено:** * Бесплатные текстовые модели: `deepseek/deepseek-v4-flash-0731`, `Qwen/Qwen3.5-35B-A3B`, `Qwen/Qwen3.6-27B`, `Qwen/Qwen3.8-27B` * **Изменено:** * У моделей `nvidia/Nemotron-3-Nano-30B-A3B` и `Qwen/Qwen3.5-35B-A3B` на канале immers.cloud проставлен бейдж квантования **INT4** * Обновлены цены канала **Timeweb Cloud**. Ставки за 1 млн токенов, вход / выход: | Модель | Предыдущая цена | Новая цена | | --- | --- | --- | | `zai-org/GLM-5.2` | 2318,00 / 2318,00 ₽ | 267,00 / 1120,00 ₽ | | `openai/gpt-oss-120b` | 68,00 / 67,50 ₽ | 20,00 / 82,00 ₽ | ##### 26.08.2026 * **Удалено:** * Бесплатные текстовые модели: `deepseek/deepseek-v4-flash-0731` и `Qwen/Qwen3.5-35B-A3B` - канал immers.cloud снял их публичные эндпоинты ##### 24.08.2026 * **Удалено:** * Бесплатные текстовые модели: `Qwen/Qwen3.6-27B` и `Qwen/Qwen3.8-27B` * Бесплатный канал **immers.cloud** у модели `openai/gpt-oss-20b` - модель остаётся на канале **Yandex Cloud** ##### 21.08.2026 * **Изменено:** * Обновлены цены канала **MWS**. Ставки за 1 млн токенов, вход / выход: | Модель | Предыдущая цена | Новая цена | | --- | --- | --- | | `openai/gpt-oss-120b` | 3,40 / 13,50 ₽ | 13,42 / 54,90 ₽ | | `zai-org/GLM-5.2` | 115,00 / 463,00 ₽ | 178,12 / 746,64 ₽ | | `Qwen/Qwen3-235B-A22B-Instruct-2507` | 61,00 / 244,00 ₽ | 79,30 / 320,86 ₽ | | `Qwen/Qwen3.6-35B-A3B` | 54,00 / 219,00 ₽ | 70,76 / 283,04 ₽ | | `google/gemma-4-31b-it` | 54,00 / 219,00 ₽ | 56,12 / 224,48 ₽ | | `moonshotai/Kimi-K2.6` | 183,00 / 732,00 ₽ | 157,38 / 652,70 ₽ | У моделей с несколькими каналами цены остальных каналов не изменились - актуальные ставки каждого канала видны в [каталоге](https://tsarrouter.ru/models). ##### 19.08.2026 * **Изменено:** * Бесплатные модели на уровне 0 (аккаунт без пополнений) - суточный лимит поднят с 50 до 250 запросов. Минутный лимит (20 запросов/мин) и лимиты остальных уровней не изменились. ##### 18.08.2026 * **Добавлено:** * Бесплатная модель `Qwen/Qwen3.8-27B` - контекст 262K, распознавание изображений, вызов функций и структурированный ответ. * **Изменено:** * У моделей `Qwen/Qwen3.8-27B`, `Qwen/Qwen3.6-27B` и `Qwen/Qwen3.6-35B-A3B` на канале immers.cloud заработало размышление. Раньше оно было отключено, теперь включено по умолчанию: ход рассуждений приходит в `reasoning_content`, уровень задаётся `reasoning_effort` (low, medium, high), выключить можно через `reasoning_options` (mode: DISABLED) - подробности в разделе [«Рассуждение моделей»](https://docs.tsarrouter.ru/guide/razmyshlenie). ##### 17.08.2026 * **Добавлено:** * Три бесплатные модели: `deepseek/deepseek-v4-flash-0731`, `Qwen/Qwen3.6-35B-A3B` и `Qwen/Qwen3.6-27B`. У DeepSeek рассуждение по умолчанию выключено. Для сложных задач оно включается параметром `reasoning_effort` (low/medium/high), ход рассуждений приходит в `reasoning_content`; * Значки квантования (NVFP4, INT4) у каналов в [каталоге](https://tsarrouter.ru/models): сжатая версия модели быстрее и дешевле в размещении, но может отвечать чуть слабее полной; * Обновлена смена пароля на странице [«Аккаунт»](https://tsarrouter.ru/dashboard/account); * Переключатель **Стоимость / Объём** на графике [«Использование»](https://tsarrouter.ru/dashboard/usage): если вы пользуетесь бесплатными моделями, график стоимости пуст - теперь расход виден в токенах, а у нетокенных моделей в минутах, символах или штуках. * **Исправлено:** * Фильтр «Кэш» в [каталоге](https://tsarrouter.ru/models) * **Удалено:** * `yandex/yandex-art` (YandexART 2.0) - Яндекс выводит модель 18.08.2026, запросы к ней перестанут работать. Перейдите на `yandex/aliceai-image-art` (Alice AI ART 3.0) - она уже в каталоге, достаточно поменять имя модели в запросе. ##### 11.08.2026 * **Добавлено:** * Разделы руководства [«Сколько стоит запрос»](https://docs.tsarrouter.ru/guide/skolko-stoit-zapros) и [«Выбор канала и надёжность»](https://docs.tsarrouter.ru/guide/vybor-kanala-i-nadezhnost). * **Изменено:** * `GET /v1/key` и `GET /v1/limits` больше не отдают служебные поля `is_service` и `enforcement`; * Заголовки `X-TsarRouter-*` теперь читаются браузерными клиентами (добавлены в CORS). ##### 10.08.2026 * **Изменено:** * Страница [«Использование» в личном кабинете](https://tsarrouter.ru/dashboard/usage) переработана: разрезы по моделям / ключам / провайдерам, фильтры одним рядом чипов, серии в журнале, сортировка по всей выборке, выгрузка CSV, разбивка кэша на графике. * **Исправлено:** * Графики расходов режут сутки по местному времени пользователя - раньше столбики могли сдвигаться относительно журнала. ##### 30.07.2026 * **Добавлено:** * Раздел руководства [«Рассуждение моделей»](https://docs.tsarrouter.ru/guide/razmyshlenie); * `reasoning_effort` у моделей GigaChat и счётчик токенов рассуждения в `usage` - подробности в новом разделе. * **Изменено:** * Ход рассуждений в обычном запросе теперь приходит в `choices[0].message.reasoning_content` (как в потоковом); прежнее имя `reasoning` не отдаётся. ##### 28.07.2026 * **Добавлено:** * `usage.prompt_tokens_details.cached_tokens` - сколько входных токенов пришло из кэша повторяющегося начала промпта; * Значок **«Кэш»** у моделей и каналов в [каталоге](https://tsarrouter.ru/models), в подсказке - ставка за кэшированный вход; * Разбивка расхода «новый вход / из кэша / выход» на странице [«Использование» в личном кабинете](https://tsarrouter.ru/dashboard/usage). * **Изменено:** * Там, где у канала есть отдельная ставка за кэшированный вход, он считается по ней - дешевле обычного входа. Где такой ставки нет, вход считается как раньше, по полной цене. ##### 18.07.2026 * **Добавлено:** * Платные дополнения к распознаванию речи Nexara на `/v1/audio/transcriptions` - включаются параметрами запроса, тарифицируются надбавкой к минуте: * диаризация (разделение по дикторам) - `diarize=true` (плюс `num_speakers`, `diarization_setting`); * определение ролей говорящих - `roles` (`auto` или список названий; только вместе с диаризацией); * фильтрация нецензурной лексики - `profanity_filter=true`. * `nexara/speech-to-text-ru` - модель распознавания Nexara, заточенная под русскую речь. * **Изменено:** * Распознавание Nexara теперь основной канал общей модели `openai/whisper-large-v3` (резерв - Cloud.ru и MTS). Прежнее имя `nexara/speech-to-text` продолжает работать. ##### 15.07.2026 * **Добавлена:** * GLM-5.2 (MWS) - рассуждающая модель Z.ai, контекст 200K токенов. ##### 04.07.2026 * **Изменено:** * Сетка лимитов по уровням теперь **действует** - запросы сверх лимита получают `429`. Ваши актуальные лимиты - на странице [«Лимиты» в личном кабинете](https://tsarrouter.ru/dashboard/limits) и через [`GET /v1/key`](https://docs.tsarrouter.ru/guide/limity#get-v1key). ##### 03.07.2026 * **Добавлено:** * Заголовки `x-ratelimit-limit-requests` / `x-ratelimit-remaining-requests` / `x-ratelimit-reset-requests` на авторизованных ответах `/v1` и честный `Retry-After` в каждом `429` (см. [Лимиты](https://docs.tsarrouter.ru/guide/limity)); * `GET /v1/key` - уровень аккаунта, действующая сетка лимитов и бюджет ключа; * Страница [«Лимиты» в личном кабинете](https://tsarrouter.ru/dashboard/limits); * Опубликована сетка лимитов по уровням. * **Изменено:** * Все отказы по лимитам теперь возвращают единый код `429` (раньше часть отвечала `503`); * Оферта: новый п. 2.8 о технических лимитах (редакция от 03.07.2026). ##### 02.07.2026 * **Добавлены:** * Распознавание речи Yandex SpeechKit - синхронное (`yandex/speech-to-text`, записи до 30 с) и асинхронное (`yandex/speech-to-text-async`, до 40 мин, диаризация до 2 дикторов, пословные таймкоды, авто-определение языка). * **Изменено:** * Лимит загрузки аудио на `/v1/audio/transcriptions` поднят до 60 МБ; размер и длительность файла теперь проверяются по лимитам выбранной модели с понятной ошибкой 400 (см. [список ошибок](https://docs.tsarrouter.ru/guide/spisok-oshibok)). ##### 27.06.2026 * **Добавлены:** * MiniMax M3 (Cloud.ru); * Анализ тональности речи (Palatine). * Gemma 3 27B (MWS) ##### 26.06.2026 * **Удалена:** * DeepSeek V3.2 (Yandex) - запросы автоматически перенаправляются на DeepSeek V4 Flash. ##### 23.06.2026 * **Обновление линейки MWS.** Добавлены: * Gemma 4 31B, * Kimi K2.6, * Qwen3.6 35B. * Удалены: * Qwen3 Coder 480B, * Qwen3 ASR, * Qwen3 TTS. ##### 21.06.2026 * **Добавлены:** * Улучшение и повышение разрешения фото (VK Cloud). ##### 16.06.2026 * **Добавлена:** * Синтез речи Qwen3 TTS (MWS, превью). * **Удалена:** * GLM-4.6 ##### 15.06.2026 * **Добавлены:** * Генерация изображений Kandinsky (Sber); * Распознавание и синтез речи (VK Cloud). ##### 14.06.2026 * **Добавлены типы моделей:** * Синтез речи (Yandex SpeechKit v3); * Генерация изображений (YandexART, Alice); * Классификация текста (Yandex); * Детекторы ИИ-контента (GigaCheck, Sber). ##### 13.06.2026 * **Добавлены провайдеры распознавания речи (STT) с вариантами диаризации:** * Nexara, * Palatine, * T-Bank, * VK Cloud. ##### 12.06.2026 * **Добавлены:** * Qwen3.5 35B; * Gemma 4 26B; * Nemotron 3 Nano (Immers Cloud). ##### 05.06.2026 * **Добавлена:** * Qwen3 ASR (распознавание речи, MTS). ##### 29.05.2026 * **Добавлены:** * DeepSeek V4 Pro (Cloud.ru); * Kimi K2.6 (Cloud.ru); * GLM-5.1. ##### 28.05.2026 * **Добавлены:** * DeepSeek V4 Flash (Yandex); * Alice Flash; * Эмбеддинги Yandex v2; * Распознавание речи Whisper (Cloud.ru). ##### 27.05.2026 * **Добавлены:** * компьютерное зрение VK Cloud - 8 детекторов и OCR-моделей. ##### 24.05.2026 * **Добавлены:** * OCR Yandex (13 моделей: документы, таблицы, рукописный текст, паспорта и др.); * DeepSeek OCR. ##### 17.05.2026 * **Добавлены:** * YandexGPT Pro 5 и 5.1, * YandexGPT Lite 5. * Подключён новый провайдер Timeweb Cloud с моделями Yandex. ##### 12.05.2026 * **Добавлены (Cloud.ru):** * MiniMax M2.5, * Qwen3.5 397B, * Qwen3.6 35B, * VL-эмбеддеры, * Реранкеры Qwen3. ##### 11.05.2026 * **Обновление моделей Cloud.ru.** Удалены: * MiniMax M2, * Qwen3 Next 80B, * GLM-4.7 Flash, * вся линейка T-pro и T-lite. ##### 27.04.2026 * **Добавлены:** * Kimi K2 (MTS); * Gemma 3 27B (Cloud.ru). ##### 11.04.2026 * **Добавлено распознавание речи:** * Whisper (Cloud.ru), * SpeechKit (Yandex). ##### 10.04.2026 * **Добавлены:** GigaChat 2 Lite, Pro, Max (Sber). ##### 06.04.2026 * **Добавлены:** * DeepSeek V3.2, * Qwen3.5 35B (Yandex). ##### 10.02.2026 * **Добавлены:** * Модели Yandex (YandexGPT, Alice, Gemma 3), * Эмбеддинги Sber и Yandex. ##### 08.02.2026 * **Запуск Царь Роутера.** Стартовый каталог Cloud.ru: GigaChat, линейка GLM, Qwen3 (Coder/Next/Instruct), T-pro и T-lite, gpt-oss, а также эмбеддеры и реранкеры. ### Лимиты Источник: https://docs.tsarrouter.ru/guide/limity Лимиты считаются на аккаунт целиком (по всем вашим ключам) и зависят от уровня. Запросы сверх лимита получают ответ `429`. Актуальные значения именно для вашего аккаунта всегда доступны без документации: на странице [«Лимиты» в личном кабинете](https://tsarrouter.ru/dashboard/limits) и через [`GET /v1/key`](#get-v1key). #### Уровни Лимиты зависят от уровня аккаунта. Уровень определяется суммой пополнений за всё время (пополнения минус возвраты; промокоды не учитываются) и повышается автоматически - обычно в течение минуты после оплаты. | Уровень | Условие | Общий лимит, запросов/мин | | --- | --- | --- | | Уровень 0 | Без пополнений | 120 | | Уровень 1 | Пополнения от 1 000 ₽ | 600 | | Уровень 2 | Пополнения от 10 000 ₽ | 1 200 | | Уровень 3 | Пополнения от 50 000 ₽ | 2 400 | Нужны индивидуальные лимиты - напишите на [support@tsarrouter.ru](mailto:support@tsarrouter.ru). #### Сетка по типам моделей Лимиты действуют **на аккаунт целиком** (по всем вашим ключам сразу), окно - 60 секунд. Одновременно действуют общий лимит уровня и лимит каждого типа моделей - срабатывает более строгий из них: | Тип моделей | Уровень 0 | Уровень 1 | Уровень 2 | Уровень 3 | | --- | --- | --- | --- | --- | | Текст | 20 | 60 | 120 | 240 | | Эмбеддинг | 60 | 300 | 600 | 1 200 | | Реранкер | 60 | 300 | 600 | 1 200 | | Vision OCR | 12 | 30 | 60 | 120 | | Расшифровка речи (STT) | 60 | 300 | 600 | 1 200 | | Синтез речи (TTS) | 120 | 600 | 1 200 | 2 400 | | Изображения | 30 | 60 | 120 | 240 | | Детектор ИИ-текста | 30 | 60 | 120 | 240 | | Классификатор | 12 | 30 | 60 | 120 | | Обработка изображений | 30 | 60 | 120 | 240 | | Анализ тональности речи | 30 | 60 | 120 | 240 | | Потоковая расшифровка речи | 5 | 10 | 20 | 40 | Дополнительно: | Лимит | Уровень 0 | Уровень 1 | Уровень 2 | Уровень 3 | | --- | --- | --- | --- | --- | | Бесплатные модели, запросов/мин | 20 | 20 | 20 | 20 | | Бесплатные модели, запросов/сутки (МСК) | 250 | 500 | 1 000 | 2 000 | | Одновременные потоковые ответы | 5 | 20 | 50 | 100 | | `GET /v1/models`, запросов/мин | 600 | 1 200 | 1 200 | 1 200 | | `GET /v1/stats`, запросов/мин | 30 | 60 | 60 | 60 | #### Ответ 429 и заголовки При превышении лимита API возвращает `429` в OpenAI-совместимом формате (`rate_limit_error`, см. [список ошибок](https://docs.tsarrouter.ru/guide/spisok-oshibok)). Отклонённый запрос **не тратит квоту** (единственное исключение: отказ по лимиту типа успевает занять слот общего лимита). В `429` есть `Retry-After` - секунды до освобождения окна; у лимита одновременных потоков значение фиксированное - 5 секунд. Успешные и ошибочные ответы авторизованных эндпоинтов `/v1/*` несут заголовки самого ограничивающего действующего лимита: ``` x-ratelimit-limit-requests: 120 x-ratelimit-remaining-requests: 119 x-ratelimit-reset-requests: 60 ``` * `limit` - размер лимита, `remaining` - осталось в текущем окне, `reset` - секунды до сброса окна. * Заголовки приходят на авторизованные `/v1`-ответы - как успешные, так и `429`. Исключение - ранние отказы, когда запрос не дошёл до проверки лимитов: `401` (неверный или просроченный ключ), `403` (ключ отключён), `400` валидации тела приходят без них. * У потоковых ответов значения фиксируются в момент старта потока. Рекомендуемая обработка: при `429` подождите `Retry-After` секунд и повторите запрос с экспоненциальной задержкой на случай повторного отказа. #### GET /v1/key Статус своего ключа: уровень, действующая сетка лимитов и бюджет ключа. Авторизация - тем же Bearer-ключом, чей статус запрашивается. ```bash curl https://tsarrouter.ru/v1/key \ -H "Authorization: Bearer $TSAR_API_KEY" ``` ```json { "data": { "label": "my-key", "tier": 2, "expires_at": "2026-12-31T23:59:59Z", "available_rub": 376.55, "limits": { "total_rpm": 1200, "per_type_rpm": {"text": 120, "embedding": 600, "...": 0}, "free_rpm": 20, "free_requests_per_day": 1000, "concurrent_streams": 50, "get_models_rpm": 1200, "get_stats_rpm": 60 }, "budget": { "type": "monthly", "amount_rub": 500.0, "spent_rub": 123.45, "remaining_rub": 376.55, "resets_at": "2026-08-01T00:00:00Z" } } } ``` * Если поддержка выдала ключу [индивидуальный лимит](#уровни), он приходит в `limits.individual_rpm` и отражается в самой сетке (`total_rpm`). * `expires_at` - когда ключ перестанет действовать; `null` - бессрочный. Отключённый или просроченный ключ статус не читает (`403`/`401`). * `available_rub` - сколько рублей доступно этому ключу. Ключ без бюджета видит баланс аккаунта; ключ с бюджетом - остаток своего бюджета, но не больше доступных средств аккаунта (бюджетный ключ может быть выдан подрядчику, поэтому сам баланс аккаунта ему не сообщается). Если баланс аккаунта меньше 1 ₽, поле отдаёт `0` - столько платных запросов и пройдёт. * У некоторых старых ключей `available_rub` может отдавать `null`. * Блокировки по деньгам (`402`): платные запросы - когда баланс аккаунта меньше 1 ₽ (бесплатные модели продолжают работать); любые запросы ключа, включая бесплатные, - когда израсходован весь его бюджет (`spent_rub` достиг `amount_rub`). * `budget` - денежный лимит самого ключа из личного кабинета (не баланс аккаунта). `remaining_rub` - остаток бюджета; `resets_at` - момент сброса счётчика для периодических бюджетов (`daily` - полночь UTC, `weekly` - понедельник, `monthly` - первое число месяца), `null` - без автосброса. У ключа без бюджета поля `budget` равны `null`, кроме `spent_rub` - накопленного расхода ключа (информационно). * Все метки времени - ISO 8601, UTC (`Z`). * Машиночитаемые русские названия типов из `per_type_rpm` отдаёт публичный `GET /v1/model-types`. * Полная сетка лимитов по всем уровням машиночитаемо - публичный `GET /v1/limits` (без авторизации); таблицы этой страницы рендерятся из него. ### Потоковое распознавание речи Источник: https://docs.tsarrouter.ru/guide/potokovoe-raspoznavanie Потоковое распознавание превращает речь в текст **по мере произнесения**: вы шлёте аудио-чанки в WebSocket, сервер отвечает промежуточными результатами (`delta`) и финальной транскрипцией. Подходит для живых субтитров, диктовки и транскрипции звонков. Модели с этим режимом отмечены в [каталоге](https://tsarrouter.ru/models) бейджем «Потоковая». Формат событий совместим с OpenAI Realtime API (transcription-режим) — при переносе клиентского кода достаточно сменить URL. #### Подключение ``` wss://api.tsarrouter.ru/v1/realtime/transcriptions?model= ``` Два способа авторизации: | Способ | Как | Для кого | | --- | --- | --- | | Заголовок | `Authorization: Bearer <ключ>` | серверные клиенты | | Subprotocol | `["realtime", "openai-insecure-api-key.<ключ>"]` | браузер (заголовки в WebSocket недоступны) | Оба держат ключ вне URL. Передавать ключ query-параметром нельзя — секрет попал бы в журналы сервера. Модель задаётся query-параметром `?model=` или событием `session.update` (поле `session.audio.input.transcription.model`). #### События Клиент → сервер: | Событие | Назначение | | --- | --- | | `session.update` | Настроить формат аудио и/или модель (до первого аудио) | | `input_audio_buffer.append` | Чанк аудио: `{"audio": ""}`, рекомендуем ~200 мс | | `input_audio_buffer.commit` | Конец фразы — запросить финальную транскрипцию | Сервер → клиент: | Событие | Назначение | | --- | --- | | `session.created` / `session.updated` | Подтверждение сессии и настроек | | `conversation.item.input_audio_transcription.delta` | Прирост текста по мере речи | | `input_audio_buffer.committed` | Фраза принята в финализацию | | `conversation.item.input_audio_transcription.completed` | Финальный текст + `usage.seconds` | | `error` | Ошибка; фатальные дополнительно закрывают соединение ([коды](https://docs.tsarrouter.ru/guide/spisok-oshibok#потоковое-распознавание-речи-websocket)) | Серверного VAD нет: конец фразы задаёт клиент событием `commit` (`turn_detection: null`). #### Формат аудио Сырой **PCM16LE mono** (`audio/pcm`). Частота дискретизации - строго одна из: 8000, 16000, 22050, 32000, 44100, 48000 Гц (по умолчанию 16000). Промежуточные значения не принимаются: например, 24000 Гц - частота по умолчанию в примерах OpenAI Realtime - закроет сессию кодом 4004. Частота задаётся в `session.update`: ```json {"type": "session.update", "session": {"audio": {"input": {"format": {"type": "audio/pcm", "rate": 16000}}}}} ``` #### Биллинг и лимиты Тарификация посекундная — по длительности **принятого аудио** (не времени соединения: паузы между чанками бесплатны). Списанные секунды каждой фразы приходят в `usage.seconds` события `completed`. На старте сессии на балансе резервируется стоимость аудио-бюджета сессии, по завершении списывается только фактическое — остаток возвращается сразу. Лимиты сессий (аудио-бюджет, одновременные сессии, таймаут бездействия) зависят от уровня аккаунта — см. [Лимиты](https://docs.tsarrouter.ru/guide/limity). #### Пример (Python) ```python # pip install websockets import asyncio, base64, json, websockets URL = "wss://api.tsarrouter.ru/v1/realtime/transcriptions?model=palatine/speech-to-text-stream" async def main(): async with websockets.connect( URL, additional_headers={"Authorization": "Bearer sk-tsar-ваш-ключ"}, ) as ws: await ws.send(json.dumps({"type": "session.update", "session": { "audio": {"input": {"format": {"type": "audio/pcm", "rate": 16000}}}, }})) pcm = open("audio.pcm", "rb").read() # PCM16LE mono 16 кГц for i in range(0, len(pcm), 6400): # чанки ~200 мс await ws.send(json.dumps({ "type": "input_audio_buffer.append", "audio": base64.b64encode(pcm[i:i + 6400]).decode(), })) await ws.send(json.dumps({"type": "input_audio_buffer.commit"})) async for raw in ws: ev = json.loads(raw) if ev["type"] == "conversation.item.input_audio_transcription.delta": print(ev["delta"], end="", flush=True) elif ev["type"] == "conversation.item.input_audio_transcription.completed": print("\n---", ev["transcript"], ev["usage"]) break asyncio.run(main()) ``` Попробовать без кода можно в [песочнице](https://tsarrouter.ru/dashboard/playground) личного кабинета — с записью с микрофона. ### Рассуждение моделей Источник: https://docs.tsarrouter.ru/guide/razmyshlenie Рассуждающая модель перед ответом «думает вслух»: строит цепочку рассуждений, а пользователю отдаёт итог. Этот черновик приходит отдельным полем — его можно показать в интерфейсе, залогировать или просто выбросить. Модели с рассуждением отмечены в [каталоге](https://tsarrouter.ru/models) значком **«Рассуждение»**. #### Где приходит ход рассуждений В обоих режимах поле называется одинаково - `reasoning_content`: | Режим | Где искать | | --- | --- | | Обычный запрос | `choices[0].message.reasoning_content` | | Потоковый (`stream: true`) | `choices[0].delta.reasoning_content` в чанках | ```python response = client.chat.completions.create( model="Qwen/Qwen3.5-397B-A17B", messages=[{"role": "user", "content": "Сколько будет 17*23?"}], ) msg = response.choices[0].message print(msg.reasoning_content) # ход рассуждений (может быть пустым) print(msg.content) # сам ответ ``` Официальный OpenAI SDK о поле не знает и в типах его не показывает, но значение сохраняет: в Python оно доступно как `msg.reasoning_content`, в JS — `message.reasoning_content` (TypeScript потребует привести тип). Ход рассуждений отдают не все провайдеры: часть из них показывает его только в потоковом режиме, часть не показывает вовсе - модель рассуждает, но черновик остаётся у провайдера. Ответ и счёт от этого не меняются. Что именно умеет конкретный провайдер - написано в подсказке рядом с ним в [каталоге](https://tsarrouter.ru/models). #### Как включить и выключить У моделей три сценария, и в каталоге для каждого провайдера указан свой: | Сценарий | Что делать | | --- | --- | | Рассуждение включено всегда | ничего; выключить нельзя | | Рассуждение по запросу | передать `reasoning_effort` | | Рассуждение можно выключить | способ указан в подсказке провайдера | Параметр `reasoning_effort` принимает `low`, `medium`, `high` — чем выше, тем длиннее рассуждение и дороже ответ: ```bash curl https://api.tsarrouter.ru/v1/chat/completions \ -H "Authorization: Bearer sk-tsar-ваш-ключ" \ -H "Content-Type: application/json" \ -d '{ "model": "sber/gigachat-2-pro", "messages": [{"role": "user", "content": "Сколько будет 17*23?"}], "reasoning_effort": "low" }' ``` Другие значения не принимаются - придёт ошибка валидации `422`. Провайдер, который рассуждение не поддерживает, чаще всего параметр проигнорирует, но часть провайдеров принимает его как есть - тогда возможна ошибка с их стороны. #### Один и тот же ответ от разных провайдеров У модели может быть несколько провайдеров, и настройки рассуждения у них разные: где-то оно включено всегда, где-то включается параметром. Без явного указания запрос уходит к любому доступному провайдеру — значит и поведение рассуждения может отличаться от запроса к запросу. Чтобы зафиксировать провайдера, передайте `provider.only`: ```json { "model": "Qwen/Qwen3.6-35B-A3B", "messages": [{"role": "user", "content": "Сколько будет 17*23?"}], "provider": {"only": ["cloudru"]} } ``` Какой провайдер ответил на самом деле, видно в заголовке ответа `X-TsarRouter-Provider`. Все способы управления выбором провайдера - на странице [«Выбор провайдера и надёжность»](https://docs.tsarrouter.ru/guide/vybor-kanala-i-nadezhnost). #### Сколько это стоит Токены рассуждения — это обычные токены выхода. Они **уже входят** в `usage.completion_tokens` и оплачиваются по цене выхода: отдельного тарифа за рассуждение нет и второй раз за них не списывается. Если провайдер сообщает, сколько именно ушло на рассуждение, эта цифра приходит в `usage`: ```json { "usage": { "prompt_tokens": 27, "completion_tokens": 323, "total_tokens": 350, "reasoning_tokens": 317, "completion_tokens_details": {"reasoning_tokens": 317} } } ``` В обычном запросе одно и то же число лежит в двух местах: `completion_tokens_details.reasoning_tokens` (формат OpenAI) и `usage.reasoning_tokens` (короткая форма) - берите любое. В потоковом режиме финальный usage-чанк приходит в том виде, в каком его прислал провайдер: надёжнее читать `completion_tokens_details.reasoning_tokens`, верхнеуровневого `usage.reasoning_tokens` там может не быть. Счётчик необязательный: если провайдер его не прислал, поля придут со значением `null` или не придут вовсе. Отсутствие или ноль не значит, что модель не рассуждала - только что цифры от провайдера не пришло. Единственная величина, на которую можно опираться в расчётах, - `completion_tokens`: она полная всегда, и счёт считается по ней. Рассуждение расходует тот же лимит, что и ответ. Если `max_tokens` мал, модель потратит его на рассуждение и вернёт пустой или обрезанный `content` с `finish_reason: "length"` - при полном счёте за выход. Для рассуждающих моделей ставьте лимит с запасом или не ставьте вовсе. ### Сколько стоит запрос Источник: https://docs.tsarrouter.ru/guide/skolko-stoit-zapros Цена уже посчитана за вас: каждый успешный ответ несёт списанную сумму в рублях. Смотреть её можно в трёх местах: | Где | Когда | | --- | --- | | `usage.cost_rub` в теле ответа | все эндпоинты с JSON-ответом | | Заголовок `X-Cost-Rub` | ответы, где цена известна к моменту отдачи; для ответов без JSON-тела - единственный источник | | [«Использование» в личном кабинете](https://tsarrouter.ru/dashboard/usage) | история и агрегаты по всем запросам | #### usage.cost_rub Итоговая сумма списания в рублях, с точностью до микрорубля: ```json { "usage": { "prompt_tokens": 27, "completion_tokens": 323, "total_tokens": 350, "cost_rub": 0.40138 } } ``` Состав `usage` зависит от эндпоинта: у чата - токены, у распознавания речи и тональности - `seconds`, у генерации изображений - `requests`, у классификации - `units`. Поле `cost_rub` есть везде. **В потоковом режиме** цена приходит только если запросить usage: ```json {"stream": true, "stream_options": {"include_usage": true}} ``` Тогда `cost_rub` будет в финальном usage-чанке (с `finish_reason` или завершающем чанке с пустым `choices`). Без `include_usage` цену стрима в ответе не узнать - только в личном кабинете. #### Заголовок X-Cost-Rub Та же сумма десятичной строкой (`X-Cost-Rub: 0.40138`). Для двух случаев это единственный способ узнать цену - тела под `usage` там нет: * `/v1/audio/speech` - ответ бинарный (аудиофайл); * `/v1/audio/transcriptions` с `response_format=text|srt|vtt` - ответ сырым текстом. Явный `0` - бесплатный запрос. В потоковом режиме заголовка нет: заголовки уходят раньше, чем известна цена, - смотрите usage-чанк. #### Программный прайс: GET /v1/models/info Публичный (без ключа) каталог всех моделей с ценами - то же, что страница [«Модели»](https://tsarrouter.ru/models), но машиночитаемо: ```bash curl https://api.tsarrouter.ru/v1/models/info ``` У каждой модели - тип, контекст, возможности и провайдеры с ценами: ```json { "id": "sber/gigachat-2-max", "type": "text", "context_window": 131072, "providers": [{ "provider": "sber", "status": "ok", "pricing": {"prompt": 650.0, "completion": 650.0, "currency": "RUB", "unit": "1M tokens"}, "prompt_cache": {"price": 0.0, "input_price": 650.0, "unit": "1M tokens", "free": true} }] } ``` * `pricing.prompt` / `pricing.completion` - ₽ за 1M токенов входа/выхода. У поштучных и посекундных тарифов вместо них `per_request` / `per_second`, единица - в `unit`. * `prompt_cache` - ставка провайдера за кэшированный вход; `free: true` - кэш бесплатен. * `billing_rule` (у модели) - правило округления тарифа (см. ниже). * `addons` (у модели) - платные дополнения (например, диаризация у распознавания речи) с надбавкой `per_second`. #### Правила тарификации: блок, минимум, округление Посекундные тарифы (распознавание речи) считают не длительность файла, а **биллинговые секунды** по правилу модели - `billing_rule` в `/v1/models/info`: * `{"mode": "block", "seconds": 15}` - вверх до кратного блоку: файл 41 с тарифицируется как 45 с; * `{"mode": "minimum", "seconds": 15}` - не меньше минимума, дальше вверх до целой секунды; * `round_kopeck: true` - итог дополнительно округляется вверх до копейки. Именно биллинговые секунды приходят в `usage.seconds` - поэтому они могут быть больше длительности записи, это не обсчёт. В [потоковом распознавании](https://docs.tsarrouter.ru/guide/potokovoe-raspoznavanie) блок и минимум считаются **на сессию целиком**, а не на каждую фразу: при блоке 15 с первая фраза на 3 с тарифицируется как 15 с, вторая такая же - уже 0 ₽. К каждой фразе добавляется ~0.6 с технической тишины - она входит в `usage.seconds`. Сумма `cost_rub` событий `completed` равна списанию за завершённые фразы сессии. #### Кэш промпта Если провайдер кэширует повторяющееся начало промпта, попавшие в кэш входные токены считаются по ставке `prompt_cache` (у Sber кэш бесплатен), остальные - по полной. Сколько токенов пришло из кэша - в ответе: ```json {"usage": {"prompt_tokens_details": {"cached_tokens": 1024}}} ``` Нюансы: * кэш-ставки нет у поштучных (`per_request`) и посекундных (`per_second`) тарифов; * если поток оборвался до usage-чанка, кэш учесть не из чего - вход списывается по полной ставке; * провайдеры с кэшем отмечены значком **«Кэш»** в [каталоге](https://tsarrouter.ru/models). #### Резерв средств в потоковых режимах На старте стрима на балансе резервируется верхняя оценка стоимости, по завершении списывается фактическая - излишек возвращается сразу. Не хватает даже на резерв - `402` до старта потока. В [потоковом распознавании](https://docs.tsarrouter.ru/guide/potokovoe-raspoznavanie) резервируется аудио-бюджет сессии: при нехватке средств он сжимается до доступного, а если доступного меньше 10 секунд аудио - отказ кодом `4003`. ### Список ошибок Источник: https://docs.tsarrouter.ru/guide/spisok-oshibok Все ошибки `/v1` возвращаются в OpenAI-совместимом формате: ```json {"error": {"message": "...", "type": "...", "param": null, "code": "..."}} ``` Поля устроены механически, поэтому их не нужно запоминать по каждой ошибке: - `type` однозначно выводится из HTTP-кода: 400 → `invalid_request_error`, 401 → `authentication_error`, 402 → `insufficient_quota`, 403 → `permission_error`, 404 → `not_found_error`, 429 → `rate_limit_error`, 500/502/503 → `server_error`, прочие (413, 422) → `api_error`. В таблицах ниже колонка `type` опущена - смотрите на HTTP-код. - `code` - HTTP-код строкой (`"400"`, `"429"`, …). Исключение: ошибки валидации тела запроса приходят с `code: "invalid_value"`. - `param` практически всегда `null`; у ошибок валидации тела (`invalid_value`) поля `param` нет вовсе. - Сам API код `504` не отдаёт: таймауты провайдеров превращаются в 502/503. Единственный источник `504` - транспортный слой, если ответ на `/v1/` висит дольше 600 секунд. В сообщениях ниже `{в фигурных скобках}` - подставляемые значения. #### Общие ошибки - любой эндпоинт `/v1` ##### Авторизация | code | message | Описание | | ---- | ---------------------------------------------------------------- | --------------------------------------------------------------------- | | 401 | `Invalid API key` | Неверный или несуществующий API-ключ. Проверьте Bearer-токен. | | 401 | `API key not found` | Ключ был удалён или деактивирован в момент обработки запроса. | | 401 | `API key has expired` | Истёк срок действия ключа. | | 401 | `Not authenticated` | Заголовок `Authorization: Bearer ` отсутствует или пустой. | | 403 | `API key is disabled. Enable it in the dashboard to resume use.` | Ключ заморожен владельцем в личном кабинете. Включите его в дашборде. | ##### Баланс и бюджет ключа | code | message | Описание | | ---- | -------------------------------------------------------------------------------------------------------------------------- | -------------------------------------------------------------------------------------------------------- | | 402 | `Account balance too low: {balance} ₽ available, minimum 1 ₽ required. Add funds to your account.` | На счёте меньше 1 ₽. Пополните баланс. | | 402 | `Insufficient balance for this request: estimated up to {est} ₽, available {balance} ₽. Add funds and retry.` | Баланса не хватит на данный запрос. Пополните и повторите. | | 402 | `API key budget limit reached: {spent} of {limit} ₽ spent. Increase this key's limit in the dashboard or use another key.` | Исчерпан денежный лимит самого ключа (не баланс аккаунта). Поднимите лимит ключа или используйте другой. | ##### Частотные лимиты Все ответы 429 - `rate_limit_error`; несут заголовки `Retry-After` (секунды до сброса окна; у лимита одновременных потоков - фиксированные 5 с) и `x-ratelimit-*`, а к сообщению добавляется ` Retry after {n} seconds.` Подробнее о самих лимитах - в разделе [Лимиты](https://docs.tsarrouter.ru/guide/limity). | code | message | Описание | | ---- | ------------------------------------------------------------------------------------------- | ------------------------------------------------------------------------ | | 429 | `Rate limit exceeded: {N} requests/minute.` | Базовый минутный лимит ключа. | | 429 | `Rate limit exceeded for {type} models: {N} requests/minute.` | Минутный лимит уровня на данный тип моделей. | | 429 | `Rate limit for free models exceeded: {N} requests/minute.` | Минутный лимит запросов к бесплатным моделям. | | 429 | `Daily cap for free models reached: {N} requests/day, resets at midnight Europe/Moscow.` | Суточный лимит бесплатных моделей; счётчик сбрасывается в полночь по Москве. | | 429 | `Rate limit exceeded: {N} requests/minute for this endpoint.` | Лимит справочных эндпоинтов: `GET /v1/models`, `/v1/key`, `/v1/stats`. | Отдельный транспортный случай: при потоке заметно чаще ~30 запросов в секунду с одного IP ответ `429` отдаёт nginx **HTML-страницей** - без OpenAI-конверта и без `Retry-After` (аналогично HTML-413 из таблицы ниже). Снизьте частоту запросов с одного адреса. ##### Модель не найдена Одна схема на все типы моделей: модели с таким ID нет в каталоге, или она не относится к типу эндпоинта. | code | message | Описание | | ---- | ------------------------------------------------------------------------- | -------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------- | | 400 | `{Тип} model '{model}' not found. Available: {список}` | Все специализированные эндпоинты. Префикс `{Тип}` соответствует эндпоинту: `Embedding` (/v1/embeddings), `Reranker` (/v1/rerank), `Image` (/v1/images/generations), `Image enhancement` (/v1/images/enhance), `Classification` (/v1/classify), `Speech` (/v1/audio/speech), `STT` (/v1/audio/transcriptions - без списка `Available` и без точки на конце), `Sentiment` (/v1/audio/sentiment), `AI-check` (/v1/ai/check). | | 400 | `Model '{model}' not found. Use GET /v1/models to list available models.` | `/v1/chat/completions`. | | 404 | `Model '{model}' not found` | `GET /v1/models/{id}`: запрос модели по ID, которого нет в каталоге. | ##### Валидация тела запроса | code | message | Описание | | ---- | ------------------------------ | ---------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------- | | 400 | `{источник} -> {поле}: {текст ошибки}` | Невалидное тело запроса: нет обязательного поля или неверный тип. Несколько ошибок склеиваются через `;`. У этих ответов `code: "invalid_value"`. Пример: `body -> messages: List should have at least 1 item after validation, not 0`. | ##### Доступность модели и провайдеров | code | message | Описание | | ---- | --------------------------------------------------------------------------------------------------------------------------------- | ------------------------------------------------------------------------------------------------------------------------------------------------------------------ | | 4xx | `Request for model '{model}' was rejected by the provider. Please verify your request parameters.` | Провайдер отверг запрос как невалидный; HTTP-код наследуется от провайдера. Обычно в `message` приходит текст самого провайдера; показанный шаблон - резервный, когда текста нет. В чате возможен краткий вариант `Request rejected by the provider.` | | 502 | `All providers for '{model}' are currently unavailable. Retry shortly or contact support if it persists.` | `/v1/embeddings`, `/v1/rerank`, `/v1/images/generations`, `/v1/chat/completions` без fallback-цепочки: все провайдеры недоступны. | | 502 | `All providers failed for model chain [{модели}]` | `/v1/chat/completions` с fallback-цепочкой или стримингом: все маршруты недоступны. Повторите позже или смените модель. | | 503 | `No provider available for '{model}'. All providers are currently unavailable. Retry shortly or contact support if it persists.` | `/v1/ai/check`, `/v1/images/enhance`, `/v1/classify`, синтез, распознавание и тональность речи: все провайдеры недоступны. | | 503 | `Model '{model}' temporarily unavailable: pricing not configured. Contact support.` | У модели временно не настроен тариф. Повторите позже или обратитесь в поддержку. | | 503 | `Model '{model}' is temporarily disabled for maintenance.` | Модель временно отключена на обслуживание. Выберите другую или повторите позже. | #### Стриминг (`stream: true`) | code | message | Описание | | ---- | -------------------------------------------------------------------------------------------------------------------- | -------------------------------------------------------------------------- | | 402 | `Insufficient balance to start streaming: required {hold} ₽, available {balance} ₽. Add funds or use another key.` | Баланса не хватит при старте потокового ответа. | | 429 | `Concurrent stream limit reached: {N} simultaneous streams. Wait for a running stream to finish and retry.` | Лимит одновременных потоков уровня (см. [Лимиты](https://docs.tsarrouter.ru/guide/limity)). | Ошибка до первого чанка приходит обычным JSON-конвертом. Если сбой случился после первого чанка (HTTP 200 уже отправлен) - поток обрывается без завершающего `[DONE]` и без error-чанка. Отсутствие `[DONE]` - признак оборванного ответа. #### Валидация параметров эндпоинтов | Эндпоинт | code | message | Описание | | --------------------------- | ---- | ------------------------------------------------------------------------------ | ------------------------------------------------------------------------------------------------------------------------------------------------------------ | | `/v1/images/generations` | 400 | `Parameter 'prompt' is required for image generation.` | Пустой `prompt`. | | `/v1/images/generations` | 400 | `Only n=1 is supported: one image per request.` | Одна картинка за запрос. | | `/v1/images/generations` | 400 | `Prompt too long: maximum {max} characters, got {n}.` | Слишком длинный промпт. | | `/v1/images/enhance` | 400 | `Parameter 'image' is required (empty file).` | Передан пустой файл изображения. | | `/v1/images/enhance` | 400 | `Only JPEG and PNG images are supported.` | Поддерживаются только JPEG и PNG. | | `/v1/images/enhance` | 400 | `Parameter 'rfactor' must be 2 or 4.` | Коэффициент апскейла только 2 или 4. | | `/v1/images/enhance` | 400 | `Parameter 'rtype' must be 'photo' or 'art'.` | Тип апскейла только `photo` или `art`. | | `/v1/images/enhance` | 413 | `Image too large: maximum {N} MB, got {x} MB.` | Файл больше 10 МБ; `type: api_error`. На практике такой файл обычно отсекает nginx ещё раньше - тогда придёт HTML-413 (строка ниже), а не JSON. | | `/v1/classify` | 400 | `Parameter 'text' is required for classification.` | Пустой `text`. | | `/v1/classify` | 400 | `Provide between 2 and 20 labels, got {n}.` | Нужно от 2 до 20 меток. | | `/v1/audio/speech` | 400 | `Parameter 'input' is required for speech synthesis.` | Пустой `input`. | | `/v1/audio/speech` | 400 | `Input too long: maximum {max} characters, got {n}.` | Лимит 5000 символов. | | `/v1/audio/transcriptions` | 400 | `Файл больше лимита модели '{model}': {x} МБ > {N} МБ.` | Размер файла сверх лимита выбранной модели (у каждой свой: Yandex async - 60 МБ, T-Bank - 32, VK - 20, Yandex sync - 1; см. карточку модели). | | `/v1/audio/transcriptions` | 400 | `Аудио длиннее лимита модели '{model}': {n} с > {N} с.` | Длительность записи сверх лимита модели (напр. Yandex sync - 30 с, Yandex async - 40 мин, VK - 5 мин). | | `/v1/audio/transcriptions` | 400 | `Параметр 'roles' доступен только вместе с diarize=true.` | Разметку ролей говорящих (Nexara) можно запросить только при включённой диаризации `diarize=true`. | | любой | 413 | - (HTML nginx) | Тело запроса больше транспортного лимита: 60 МБ для `/v1/audio/transcriptions`, 10 МБ для остальных эндпоинтов. Ответ отдаёт nginx без JSON-тела. | | `/v1/ai/check` | 400 | `Text too short: AI-content detection requires at least {min} words, got {n}.` | Текст слишком короткий для детекции. | | `/v1/ai/check` | 400 | `This detector supports Russian text only (>=50% Cyrillic), got {x}%.` | Детектор работает только с русским текстом. | #### Распознавание речи: форматы аудио `/v1/audio/transcriptions`; все ошибки ниже - 400 `invalid_request_error`. | Модель | message | | ------------------------------ | -------------------------------------------------------------------------------------------------------------------------------------- | | `yandex/speech-to-text` | `yandex/speech-to-text (синхронный) не принимает MP3 — только WAV (PCM) и OGG/Opus. Для MP3 используйте yandex/speech-to-text-async.` | | `yandex/speech-to-text` | `Некорректный WAV-файл (ожидается PCM).` | | `yandex/speech-to-text` | `yandex/speech-to-text принимает только моно (1 канал). Для многоканального аудио используйте yandex/speech-to-text-async.` | | `yandex/speech-to-text` | `WAV должен быть 16-бит PCM (LINEAR16).` | | `yandex/speech-to-text` | `Частота дискретизации {rate} Гц не поддерживается (допустимо: {список}).` | | `yandex/speech-to-text` | `Неизвестный формат аудио: yandex/speech-to-text принимает WAV (PCM) и OGG/Opus.` | | `yandex/speech-to-text` | `yandex/speech-to-text (синхронный) принимает до 1 МБ аудио (WAV считается по PCM-данным). Для длинных записей используйте yandex/speech-to-text-async.` | | `yandex/speech-to-text-async` | `Неизвестный формат аудио: yandex/speech-to-text-async принимает MP3, WAV и OGG/Opus.` | | `yandex/speech-to-text-async` | `Аудио с {n} каналами не поддерживается — максимум 2 (моно или стерео).` | | обе модели Yandex | `Yandex STT: {сообщение провайдера}` - проброс ошибки входных данных от Яндекса (например, битый файл). | | `tbank/speech-to-text` | `Invalid MP3: could not determine sample rate and channels.` - битый MP3; пришлите корректный MP3 или WAV (PCM). | | `tbank/speech-to-text` | `Unsupported audio format. Use WAV (PCM) or MP3.` | #### Потоковое распознавание речи (WebSocket) `/v1/realtime/transcriptions` - WebSocket-эндпоинт (формат событий OpenAI Realtime transcription). Ошибки приходят двумя способами: **1. Отказ на этапе подключения (handshake).** Неверный или отсутствующий API-ключ - соединение отклоняется с HTTP 403 ещё до установки WebSocket. **2. Событие `error` + код закрытия.** Внутри сессии сервер шлёт событие `{"type": "error", "error": {"code": ..., "message": ...}}`; фатальные ошибки дополнительно закрывают соединение со стабильным close-кодом: | close-код | code | Описание | | --------- | -------------------------- | -------------------------------------------------------------------------------------------------- | | 4001 | `invalid_api_key` | Ключ не прошёл проверку уже после подключения (например, отключён владельцем). | | 4002 | `model_not_found` | Модель не задана, не существует или не поддерживает потоковое распознавание. | | 4003 | `insufficient_balance` | Баланса не хватает даже на минимальную сессию. Пополните счёт. | | 4004 | `unsupported_audio_format` | Формат аудио не поддерживается: нужен `audio/pcm` (PCM16LE), частота из списка 8000, 16000, 22050, 32000, 44100, 48000 Гц. | | 4008 | `session_limit_exceeded` | Исчерпан лимит аудио-секунд или общей длительности сессии (см. [Лимиты](https://docs.tsarrouter.ru/guide/limity)). Откройте новую сессию. | | 4009 | `idle_timeout` | Нет сообщений от клиента дольше таймаута бездействия - сессия закрыта. | | 4010 | `concurrent_session_limit` | Достигнут лимит одновременных потоковых сессий вашего уровня. | | 4029 | `rate_limit_exceeded` | Слишком частые открытия сессий (rpm-лимит типа). | | 1011 | `upstream_error` | Сбой провайдера распознавания. Повторите попытку. | | 1013 | `model_disabled` | Модель временно отключена на обслуживание. | **Нефатальные ошибки** (сессия продолжает работать, приходит только событие `error`): | code | Описание | | --------------------------------- | -------------------------------------------------------------------------------- | | `model_not_set` | Аудио прислано до выбора модели (`?model=` или `session.update`). | | `input_audio_buffer_commit_empty` | `commit` без аудио в буфере. | | `commit_too_short` | `commit` фразы короче минимума - продолжайте слать аудио перед `commit`. | | `audio_chunk_too_large` | Слишком большой чанк в одном `append` - шлите короче (~200 мс). | | `clear_not_supported` | `input_audio_buffer.clear` не поддерживается - аудио уходит в распознавание сразу. | | `format_locked` / `model_locked` | Формат/модель нельзя менять после начала передачи аудио. | | `invalid_audio` / `invalid_json` | `audio` не base64 / событие не JSON. | | `empty_audio` | `append` с пустым `audio` - пришлите байты PCM16LE. | | `invalid_payload` / `unknown_event` | Прислан бинарный фрейм вместо JSON / неизвестный тип события. | #### Ошибки моделей | code | message | Описание | | ---- | ------------------------------------------------------------ | ------------------------------------------------------------------------------------------------------------------------------------------------ | | 400 | `Invalid image input: {детали}` | Распознавание (OCR Yandex) и зрение (VK) в чате: изображение нужно передавать как base64 data URI (JPEG/PNG). | | 400 | `Unknown VK Cloud model: {model}` | Неизвестная VK Cloud Vision-модель. | | 400 | `VK Cloud enhance error: {детали}` | VK (обработка фото): ошибка параметров обработки изображения. | | 422 | текст причины от модели | Kandinsky (GigaChat) сгенерировал отказ по контент-политике при генерации изображения. ⚠️ Запрос тарифицируется. Измените промпт. `type: api_error`. | | 502 | `VK Cloud Vision error: {детали}` | Сбой обработки на стороне VK (зрение / апскейл / реставрация). Дословно доходит при стриминге или fallback-цепочке чата; в остальных случаях превращается в общие 502/503 из раздела «Доступность». | ### Выбор провайдера и надёжность Источник: https://docs.tsarrouter.ru/guide/vybor-kanala-i-nadezhnost У одной модели может быть несколько провайдеров. Запрос уходит к одному из здоровых (случайный выбор, взвешенный в пользу дешёвых), а при сбое автоматически переключается на следующий - это failover. Кто ответил на самом деле, всегда видно в заголовках ответа. #### Что уходит в failover, а что нет * **Уходит:** `429` и `5xx` провайдера, таймауты, обрывы соединения, пустой ответ с кодом 200. Сбоящие провайдеры временно понижаются в очереди выбора. * **Не помогает:** клиентские ошибки `4xx` (кроме 429) - другой провайдер отверг бы тот же запрос. В обычном запросе такая ошибка возвращается сразу, с исходным кодом и текстом провайдера. Обычный запрос (без стрима и без цепочки `models`) дополнительно повторяет запрос к сбойному провайдеру один раз с короткой паузой; в потоковом режиме и с цепочкой каждый кандидат пробуется один раз. #### Fallback-цепочка моделей: models Если недоступны все провайдеры модели, запрос можно продолжить на резервной модели - перечислите их в `models` в порядке предпочтения: ```json { "model": "deepseek/deepseek-v4-flash", "models": ["Qwen/Qwen3.6-35B-A3B", "sber/gigachat-2-max"], "messages": [{"role": "user", "content": "Привет!"}] } ``` * Кандидаты перебираются по порядку: все провайдеры основной модели, затем все провайдеры первой резервной и так далее. * Основная модель обязана существовать и быть включённой (иначе `400`/`503`); несуществующая или отключённая **резервная** просто пропускается. * Частотные лимиты и признак «бесплатная» считаются по основной модели. * В отличие от обычного запроса, клиентская `4xx` здесь не прерывает перебор. Если не ответил никто, придёт `502` `All providers failed for model chain [...]`; когда последней была клиентская ошибка `4xx` - она отдаётся с исходным кодом и текстом. * Какая модель ответила фактически - в заголовке `X-TsarRouter-Model`. #### Управление выбором провайдера: provider ```json { "model": "Qwen/Qwen3.6-35B-A3B", "messages": [{"role": "user", "content": "Привет!"}], "provider": {"sort": "throughput", "ignore": ["mws"]} } ``` | Поле | Действие | | --- | --- | | `only: ["cloudru"]` | только перечисленные провайдеры | | `ignore: ["mws"]` | исключить перечисленных | | `order: ["yandex", "cloudru"]` | пробовать в этом порядке; `allow_fallbacks: false` запрещает добавлять остальных провайдеров после перечисленных | | `sort` | детерминированная сортировка вместо случайного выбора: `"price"` (дешёвые вперёд), `"throughput"` (токены/с), `"latency"` (мс); перекрывает `order` | | `max_price: {"prompt": 500, "completion": 1000}` | жёсткий потолок цены, ₽ за 1M токенов - провайдеры дороже исключаются | | `preferred_min_throughput: 30` | мягкий фильтр: провайдеры медленнее 30 токенов/с уходят в конец очереди, но не исключаются | | `preferred_max_latency: 2000` | мягкий фильтр по задержке, мс | Пропускная способность и задержка берутся из живых метрик последних минут. Провайдер без метрик при `sort` уходит в конец очереди; мягкие фильтры `preferred_*` его не штрафуют. #### Стриминг: переключение до первого чанка В потоковом режиме сервис ждёт первый чанк провайдера до 30 секунд и только потом отдаёт вам HTTP 200 - все переключения между провайдерами происходят до этого и незаметны. После первого чанка failover уже невозможен: сбой в середине потока обрывает его без завершающего `[DONE]` (см. [список ошибок](https://docs.tsarrouter.ru/guide/spisok-oshibok#стриминг-stream-true)). #### Заголовки трассировки | Заголовок | Что в нём | | --- | --- | | `X-TsarRouter-Provider` | провайдер, который реально исполнил запрос | | `X-TsarRouter-Model` | модель, которая реально ответила (важно при цепочке `models`) | | `X-TsarRouter-Attempts` | JSON-массив попыток: `[{"provider": "...", "model": "...", "status": "ok", "latency_ms": 812.4}]` | | `X-Model-Deprecated: true` + `Sunset` | ответившая модель объявлена устаревшей; `Sunset` - дата отключения (`2026-05-12`) | Статусы попыток: `ok`, `error` (с полем `error` - текстом причины), `insufficient_balance`, `simulated_fail`. У части попыток `latency_ms` может отсутствовать. На итоговых ошибках (`502` после перебора всех) заголовков `X-TsarRouter-*` нет. Признак устаревания есть и в `GET /v1/models`: поле `deprecated` с датой отключения у затронутых моделей. #### Проверить failover без сбоя: X-Simulate-Fail Заголовок для теста отказоустойчивости, доступен любому ключу. Перечислите через запятую модели, которые нужно искусственно «уронить», - их провайдеры будут помечены сбойными без обращения к ним (и без списаний): ```bash curl https://api.tsarrouter.ru/v1/chat/completions \ -H "Authorization: Bearer sk-tsar-ваш-ключ" \ -H "X-Simulate-Fail: deepseek/deepseek-v4-flash" \ -H "Content-Type: application/json" \ -d '{ "model": "deepseek/deepseek-v4-flash", "models": ["sber/gigachat-2-max"], "messages": [{"role": "user", "content": "Привет!"}] }' ``` Ответ придёт от резервной модели, а в `X-TsarRouter-Attempts` будет попытка со `status: "simulated_fail"`. Работает на `/v1/chat/completions` в потоковом режиме или при заданной цепочке `models`; если «уронить» все модели запроса, придёт обычный `502` - как при реальном отказе. ## Модели: Текст (31) - [yandex/yandexgpt-pro-5.1](https://tsarrouter.ru/models/yandex/yandexgpt-pro-5.1): контекст 33K токенов; цена от 410 ₽ за 1M токенов - [yandex/yandexgpt-pro-5](https://tsarrouter.ru/models/yandex/yandexgpt-pro-5): контекст 33K токенов; цена 1 200 ₽ за 1M токенов - [yandex/yandexgpt-lite-5](https://tsarrouter.ru/models/yandex/yandexgpt-lite-5): контекст 33K токенов; цена от 200 ₽ за 1M токенов - [yandex/aliceai-llm](https://tsarrouter.ru/models/yandex/aliceai-llm): Флагман Яндекса для русского языка; контекст 131K токенов; цена от 500 ₽ / 1 200 ₽ за 1M токенов (вход / выход) - [yandex/aliceai-llm-flash](https://tsarrouter.ru/models/yandex/aliceai-llm-flash): Быстрая и недорогая; контекст 66K токенов; цена 100 ₽ / 200 ₽ за 1M токенов (вход / выход) - [deepseek/deepseek-v4-flash](https://tsarrouter.ru/models/deepseek/deepseek-v4-flash): Быстрый DeepSeek · reasoning; контекст 1M токенов; цена 300 ₽ / 500 ₽ за 1M токенов (вход / выход) - [deepseek/deepseek-v4-flash-0731](https://tsarrouter.ru/models/deepseek/deepseek-v4-flash-0731): превью-доступ: провайдер не гарантирует доступность и может отключить модель без предупреждения, цена временная; контекст 1M токенов; цена бесплатно - [Qwen/Qwen3.6-35B-A3B](https://tsarrouter.ru/models/Qwen/Qwen3.6-35B-A3B): Qwen 3.6 · MoE 35B-A3B; часть провайдеров отдаёт модель в превью-доступе (без гарантий доступности, цена временная); контекст 262K токенов; цена бесплатно - [Qwen/Qwen3.6-27B](https://tsarrouter.ru/models/Qwen/Qwen3.6-27B): превью-доступ: провайдер не гарантирует доступность и может отключить модель без предупреждения, цена временная; контекст 224K токенов; цена бесплатно - [Qwen/Qwen3.8-27B](https://tsarrouter.ru/models/Qwen/Qwen3.8-27B): Qwen 3.8 · 27B · бесплатно; превью-доступ: провайдер не гарантирует доступность и может отключить модель без предупреждения, цена временная; контекст 262K токенов; цена бесплатно - [ai-sage/GigaChat3-10B-A1.8B](https://tsarrouter.ru/models/ai-sage/GigaChat3-10B-A1.8B): контекст 262K токенов; цена 12.2 ₽ за 1M токенов - [zai-org/GLM-4.7](https://tsarrouter.ru/models/zai-org/GLM-4.7): контекст 203K токенов; цена 549 ₽ / 793 ₽ за 1M токенов (вход / выход) - [zai-org/GLM-5.1](https://tsarrouter.ru/models/zai-org/GLM-5.1): Флагман Z.ai; контекст 1M токенов; цена 198.86 ₽ / 829.60 ₽ за 1M токенов (вход / выход) - [zai-org/GLM-5.2](https://tsarrouter.ru/models/zai-org/GLM-5.2): контекст 200K токенов; цена от 178.12 ₽ / 746.64 ₽ за 1M токенов (вход / выход) - [zai-org/GLM-5.3](https://tsarrouter.ru/models/zai-org/GLM-5.3): контекст 200K токенов; цена 178.12 ₽ / 746.64 ₽ за 1M токенов (вход / выход) - [moonshotai/Kimi-K2.6](https://tsarrouter.ru/models/moonshotai/Kimi-K2.6): 1T параметров · MoE; контекст 262K токенов; цена от 157.38 ₽ / 652.70 ₽ за 1M токенов (вход / выход) - [deepseek-ai/DeepSeek-V4-Pro](https://tsarrouter.ru/models/deepseek-ai/DeepSeek-V4-Pro): Флагман DeepSeek · 1M контекста; контекст 1M токенов; цена 183 ₽ / 732 ₽ за 1M токенов (вход / выход) - [Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct](https://tsarrouter.ru/models/Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct): контекст 262K токенов; цена 122 ₽ / 244 ₽ за 1M токенов (вход / выход) - [MiniMaxAI/MiniMax-M2.5](https://tsarrouter.ru/models/MiniMaxAI/MiniMax-M2.5): контекст 197K токенов; цена 353.80 ₽ / 475.80 ₽ за 1M токенов (вход / выход) - [MiniMaxAI/MiniMax-M3](https://tsarrouter.ru/models/MiniMaxAI/MiniMax-M3): контекст 524K токенов; цена 240.22 ₽ / 1 008.85 ₽ за 1M токенов (вход / выход) - [Qwen/Qwen3.5-397B-A17B](https://tsarrouter.ru/models/Qwen/Qwen3.5-397B-A17B): контекст 262K токенов; цена 915 ₽ / 1 085.80 ₽ за 1M токенов (вход / выход) - [google/gemma-4-31b-it](https://tsarrouter.ru/models/google/gemma-4-31b-it): контекст 128K токенов; цена 56.1 ₽ / 224.48 ₽ за 1M токенов (вход / выход) - [Qwen/Qwen3-235B-A22B-Instruct-2507](https://tsarrouter.ru/models/Qwen/Qwen3-235B-A22B-Instruct-2507): Мощный reasoning; контекст 256K токенов; цена от 79.3 ₽ / 320.86 ₽ за 1M токенов (вход / выход) - [openai/gpt-oss-120b](https://tsarrouter.ru/models/openai/gpt-oss-120b): Открытая модель OpenAI; контекст 131K токенов; цена от 13.4 ₽ / 54.9 ₽ за 1M токенов (вход / выход) - [openai/gpt-oss-20b](https://tsarrouter.ru/models/openai/gpt-oss-20b): часть провайдеров отдаёт модель в превью-доступе (без гарантий доступности, цена временная); контекст 131K токенов; цена бесплатно - [google/gemma-4-26b-a4b-it](https://tsarrouter.ru/models/google/gemma-4-26b-a4b-it): превью-доступ: провайдер не гарантирует доступность и может отключить модель без предупреждения, цена временная; контекст 262K токенов; цена бесплатно - [Qwen/Qwen3.5-35B-A3B](https://tsarrouter.ru/models/Qwen/Qwen3.5-35B-A3B): превью-доступ: провайдер не гарантирует доступность и может отключить модель без предупреждения, цена временная; контекст 262K токенов; цена бесплатно - [nvidia/Nemotron-3-Nano-30B-A3B](https://tsarrouter.ru/models/nvidia/Nemotron-3-Nano-30B-A3B): превью-доступ: провайдер не гарантирует доступность и может отключить модель без предупреждения, цена временная; контекст 262K токенов; цена бесплатно - [sber/gigachat-2-lite](https://tsarrouter.ru/models/sber/gigachat-2-lite): контекст 128K токенов; цена 65.0 ₽ за 1M токенов - [sber/gigachat-2-pro](https://tsarrouter.ru/models/sber/gigachat-2-pro): контекст 128K токенов; цена 500 ₽ за 1M токенов - [sber/gigachat-2-max](https://tsarrouter.ru/models/sber/gigachat-2-max): Флагман GigaChat; контекст 131K токенов; цена от 569.34 ₽ за 1M токенов ## Модели: Эмбеддинг (12) - [yandex/text-search-doc](https://tsarrouter.ru/models/yandex/text-search-doc): контекст 2K токенов; цена 10.1 ₽ за 1M токенов - [yandex/text-search-query](https://tsarrouter.ru/models/yandex/text-search-query): контекст 2K токенов; цена 10.1 ₽ за 1M токенов - [yandex/text-embeddings-doc-v2](https://tsarrouter.ru/models/yandex/text-embeddings-doc-v2): контекст 2K токенов; цена 10.1 ₽ за 1M токенов - [yandex/text-embeddings-query-v2](https://tsarrouter.ru/models/yandex/text-embeddings-query-v2): контекст 2K токенов; цена 10.1 ₽ за 1M токенов - [Qwen/Qwen3-Embedding-0.6B](https://tsarrouter.ru/models/Qwen/Qwen3-Embedding-0.6B): контекст 33K токенов; цена 0.85 ₽ за 1M токенов - [BAAI/bge-m3](https://tsarrouter.ru/models/BAAI/bge-m3): контекст 8K токенов; цена от 0.61 ₽ за 1M токенов - [Qwen/Qwen3-VL-Embedding-2B](https://tsarrouter.ru/models/Qwen/Qwen3-VL-Embedding-2B): контекст 33K токенов; цена 73.2 ₽ за 1M токенов - [Qwen/Qwen3-VL-Embedding-8B](https://tsarrouter.ru/models/Qwen/Qwen3-VL-Embedding-8B): контекст 33K токенов; цена 85.4 ₽ за 1M токенов - [sber/gigachat-embeddings](https://tsarrouter.ru/models/sber/gigachat-embeddings): контекст 0.5K токенов; цена 14.0 ₽ за 1M токенов - [sber/gigachat-embeddings-2](https://tsarrouter.ru/models/sber/gigachat-embeddings-2): контекст 0.5K токенов; цена 14.0 ₽ за 1M токенов - [sber/gigaembeddings-3b](https://tsarrouter.ru/models/sber/gigaembeddings-3b): контекст 4.1K токенов; цена 14.0 ₽ за 1M токенов - [sber/embeddings-gigar](https://tsarrouter.ru/models/sber/embeddings-gigar): контекст 4.1K токенов; цена 14.0 ₽ за 1M токенов ## Модели: Реранкер (4) - [Qwen/Qwen3-Reranker-0.6B](https://tsarrouter.ru/models/Qwen/Qwen3-Reranker-0.6B): контекст 41K токенов; цена 0.85 ₽ за 1M токенов - [BAAI/bge-reranker-v2-m3](https://tsarrouter.ru/models/BAAI/bge-reranker-v2-m3): контекст 8.2K токенов; цена 0.24 ₽ за 1M токенов - [Qwen/Qwen3-VL-Reranker-2B](https://tsarrouter.ru/models/Qwen/Qwen3-VL-Reranker-2B): контекст 33K токенов; цена 54.9 ₽ за 1M токенов - [Qwen/Qwen3-VL-Reranker-8B](https://tsarrouter.ru/models/Qwen/Qwen3-VL-Reranker-8B): контекст 33K токенов; цена 85.4 ₽ за 1M токенов ## Модели: Vision OCR (21) - [deepseek-ai/DeepSeek-OCR-2](https://tsarrouter.ru/models/deepseek-ai/DeepSeek-OCR-2): цена 54.9 ₽ / 61.0 ₽ за 1M токенов (вход / выход) - [yandex/ocr-page](https://tsarrouter.ru/models/yandex/ocr-page): Распознавание печатного текста (текст по строкам); цена 0.1321 ₽/запрос - [yandex/ocr-page-column-sort](https://tsarrouter.ru/models/yandex/ocr-page-column-sort): Распознавание печатного текста с сортировкой по колонкам; цена 0.1321 ₽/запрос - [yandex/ocr-handwritten](https://tsarrouter.ru/models/yandex/ocr-handwritten): Распознавание рукописного и печатного текста; цена 1.52 ₽/запрос - [yandex/ocr-table](https://tsarrouter.ru/models/yandex/ocr-table): Распознавание таблиц; цена 1.22 ₽/запрос - [yandex/ocr-markdown](https://tsarrouter.ru/models/yandex/ocr-markdown): Распознавание текста, вывод в формате Markdown; цена 0.1321 ₽/запрос - [yandex/ocr-math-markdown](https://tsarrouter.ru/models/yandex/ocr-math-markdown): Распознавание текста и математических формул (Markdown); цена 0.1321 ₽/запрос - [yandex/ocr-passport](https://tsarrouter.ru/models/yandex/ocr-passport): Распознавание данных паспорта; цена 0.71 ₽/запрос - [yandex/ocr-driver-license-front](https://tsarrouter.ru/models/yandex/ocr-driver-license-front): Водительское удостоверение — лицевая сторона; цена 0.71 ₽/запрос - [yandex/ocr-driver-license-back](https://tsarrouter.ru/models/yandex/ocr-driver-license-back): Водительское удостоверение — оборотная сторона; цена 0.71 ₽/запрос - [yandex/ocr-vehicle-registration-front](https://tsarrouter.ru/models/yandex/ocr-vehicle-registration-front): СТС (свидетельство о регистрации ТС) — лицевая сторона; цена 0.71 ₽/запрос - [yandex/ocr-vehicle-registration-back](https://tsarrouter.ru/models/yandex/ocr-vehicle-registration-back): СТС (свидетельство о регистрации ТС) — оборотная сторона; цена 0.71 ₽/запрос - [yandex/ocr-license-plates](https://tsarrouter.ru/models/yandex/ocr-license-plates): Распознавание автомобильных номерных знаков; цена 0.1321 ₽/запрос - [vkcloud/car-number](https://tsarrouter.ru/models/vkcloud/car-number): Распознавание автомобильных номеров (VK Cloud Vision); цена 0.06 ₽/запрос - [vkcloud/text-recognize](https://tsarrouter.ru/models/vkcloud/text-recognize): Распознавание текста в документах (VK Cloud Vision); цена 0.06 ₽/запрос - [vkcloud/scene-text](https://tsarrouter.ru/models/vkcloud/scene-text): Распознавание текста на уличных фотографиях (VK Cloud Vision); цена 0.06 ₽/запрос - [vkcloud/adult-detect](https://tsarrouter.ru/models/vkcloud/adult-detect): Определение контента 18+ на изображении (VK Cloud Vision); цена 0.06 ₽/запрос - [vkcloud/doc-recognize](https://tsarrouter.ru/models/vkcloud/doc-recognize): Распознавание полей документов (паспорт и др.) (VK Cloud Vision); цена 0.06 ₽/запрос - [vkcloud/object-detect](https://tsarrouter.ru/models/vkcloud/object-detect): Распознавание объектов на изображении (VK Cloud Vision); цена 0.06 ₽/запрос - [vkcloud/scene-detect](https://tsarrouter.ru/models/vkcloud/scene-detect): Распознавание сцен на изображении (VK Cloud Vision); цена 0.06 ₽/запрос - [vkcloud/pedestrian-detect](https://tsarrouter.ru/models/vkcloud/pedestrian-detect): Распознавание людей на изображении (VK Cloud Vision); цена 0.06 ₽/запрос ## Модели: Расшифровка речи (STT) (9) - [openai/whisper-large-v3](https://tsarrouter.ru/models/openai/whisper-large-v3): Whisper large-v3 — мультиязычное распознавание речи. Основной канал Nexara (пословные таймкоды, платные допы: диаризация, роли, фильтрация мата), резерв — Cloud.ru и MTS (Preview, посегментные метки); часть провайдеров отдаёт модель в превью-доступе (без гарантий доступности, цена временная); контекст 0.4K токенов; цена до 0.60 ₽/мин - [nexara/speech-to-text-ru](https://tsarrouter.ru/models/nexara/speech-to-text-ru): Nexara RU — российская модель распознавания, заточенная под русскую речь. Пословные таймкоды, субтитры SRT/VTT, платные допы: диаризация, роли, фильтрация мата; цена 0.36 ₽/мин - [palatine/speech-to-text](https://tsarrouter.ru/models/palatine/speech-to-text): Palatine — российская модель распознавания речи: транскрибация с пословными метками, субтитры SRT/VTT; цена 0.29 ₽/мин - [palatine/speech-to-text-diarize](https://tsarrouter.ru/models/palatine/speech-to-text-diarize): Palatine — разделение записи по дикторам: метки говорящих и границы реплик, без расшифровки текста. Текст — отдельной моделью palatine/speech-to-text; цена 0.30 ₽/мин - [tbank/speech-to-text](https://tsarrouter.ru/models/tbank/speech-to-text): T-Bank VoiceKit — российское распознавание речи (синхронная обработка файла), пословные таймкоды и авто-пунктуация; цена 0.38 ₽/мин - [yandex/speech-to-text](https://tsarrouter.ru/models/yandex/speech-to-text): Yandex SpeechKit — синхронное распознавание речи: мгновенный ответ на короткие записи до 30 секунд. WAV и OGG/Opus, русский и другие языки; цена 0.65 ₽/мин; тарификация блоками по 15 с - [yandex/speech-to-text-async](https://tsarrouter.ru/models/yandex/speech-to-text-async): Yandex SpeechKit — асинхронное распознавание длинных записей: диаризация (кто и что сказал), пословные таймкоды, авто-определение языка. MP3, WAV и OGG/Opus; цена 0.61 ₽/мин; минимум 15 с, далее посекундно, неполная секунда - как полная - [ai-sage/GigaAM-v3](https://tsarrouter.ru/models/ai-sage/GigaAM-v3): GigaAM-v3 (Сбер) - российская модель распознавания русской речи. Сквозная расшифровка сразу с пунктуацией, заглавными буквами и числами в цифрах, посегментные метки времени; превью-доступ: провайдер не гарантирует доступность и может отключить модель без предупреждения, цена временная; цена бесплатно - [palatine/speech-to-text-stream](https://tsarrouter.ru/models/palatine/speech-to-text-stream): Palatine — потоковое распознавание речи в реальном времени: WebSocket-сессия, промежуточные результаты по мере речи (формат событий OpenAI Realtime transcription). Вход — PCM 16 бит, 8–48 кГц; цена 0.29 ₽/мин ## Модели: Синтез речи (TTS) (1) - [yandex/yandex-tts](https://tsarrouter.ru/models/yandex/yandex-tts): Yandex SpeechKit v3 — синтез речи из текста. 14 голосов на выбор, амплуа, управление скоростью и тембром, TTS-разметка (ударения, паузы, акценты, фонемы). На выходе MP3/OGG/WAV. Языки: рус/англ/каз/узб/ивр; цена 0.1626 ₽/250 симв.; неполный блок из 250 символов считается полным ## Модели: Изображения (2) - [yandex/aliceai-image-art](https://tsarrouter.ru/models/yandex/aliceai-image-art): Alice AI ART 3.0 — генерация изображений по текстовому описанию (Яндекс). До 500 символов промпта, на выходе JPEG; цена 2.23 ₽/запрос - [sber/kandinsky](https://tsarrouter.ru/models/sber/kandinsky): Кандинский — генерация изображений по тексту (встроенный text2image GigaChat, Сбер). До 1000 символов промпта, на выходе JPEG 1024×1024. Хорошо рисует короткие надписи на русском; длинный текст в кадре — нечитаемо; цена 0.65 ₽/запрос ## Модели: Другие (7) - [sber/GigaCheckClassification](https://tsarrouter.ru/models/sber/GigaCheckClassification): GigaCheck (Сбер) — классификация текста целиком: написан человеком или сгенерирован нейросетью (ai/human). При вердикте «ai» интервал ai_intervals покрывает весь текст ([0, длина]), без разбивки на фрагменты — для пофрагментной разметки используйте Detection. Только русский язык, минимум 20 слов; цена 500 ₽ за 1M токенов - [sber/GigaCheckDetection](https://tsarrouter.ru/models/sber/GigaCheckDetection): GigaCheck (Сбер) — детекция ИИ-фрагментов в тексте: классы ai/human/mixed и интервалы сгенерированных кусков (ai_intervals). Пофрагментная разбивка даётся только при вердикте «mixed»; при «ai» интервал покрывает весь текст, при «human» — пуст. Только русский язык, минимум 20 слов; цена 500 ₽ за 1M токенов - [yandex/text-classifier-lite](https://tsarrouter.ru/models/yandex/text-classifier-lite): Относит текст к одному из 2–20 ваших классов. Работает без примеров (zero-shot) или с примерами для точности (few-shot). База — YandexGPT Lite: дешевле, подходит для большинства задач; цена 0.1525 ₽/1000 вх. токенов; неполный блок из 1000 входных токенов считается полным - [yandex/text-classifier-pro](https://tsarrouter.ru/models/yandex/text-classifier-pro): То же, что text-classifier-lite, но на базе YandexGPT Pro — точнее на сложных и неоднозначных текстах. Те же 2–20 классов, zero-shot или few-shot. Дороже Lite, особенно на длинных текстах; цена 0.1525 ₽/250 вх. токенов; неполный блок из 250 входных токенов считается полным - [vkcloud/photo-improve](https://tsarrouter.ru/models/vkcloud/photo-improve): Реставрация фотографий (VK Cloud Vision): убирает дефекты и шум, а для чёрно-белых снимков восстанавливает цвет. Возвращает все доступные варианты (улучшенный, раскрашенный, улучшенный+раскрашенный). Если фото уже хорошего качества, улучшение может не вернуться; цена 0.06 ₽/запрос - [vkcloud/photo-resolution](https://tsarrouter.ru/models/vkcloud/photo-resolution): Увеличение разрешения изображения (VK Cloud Vision): апскейл ×2 или ×4 с восстановлением деталей. Параметр rtype — photo (фотографии) или art (рисунки/арт); цена 0.06 ₽/запрос - [palatine/speech-sentiment](https://tsarrouter.ru/models/palatine/speech-sentiment): Palatine — анализ тональности речи: определяет эмоциональную окраску по аудио или видео, выдаёт вероятности по 5 классам (от очень негативной до очень позитивной); цена 0.39 ₽/мин ## Бенчмарки Собственные прогоны на моделях, развёрнутых в России. Ниже - только действующие модели и актуальные наборы тестов; баллы по шкале 0-100. Снятые с рейтинга модели - в выгрузках, с признаком active=false. Лицензия: CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Лицензия CC BY 4.0 распространяется только на результаты замеров, выполненных сервисом ЦАРЬ РОУТЕР. Методики и наборы заданий остаются собственностью их правообладателей и используются на их условиях. Подпись при цитировании: Источник: ЦАРЬ РОУТЕР, https://tsarrouter.ru/benchmarks (CC BY 4.0) Результаты обновлены: 04.09.2026. Выгрузки: [benchmarks.csv](https://tsarrouter.ru/benchmarks.csv), [benchmarks.json](https://tsarrouter.ru/benchmarks.json) ### Царь Индекс Среднее четырёх величин: LiveBench (Среднее), MRCR v2 (среднее по измеренным окнам), Bullshit Detection Benchmark (Распознал (2)), claw-eval (Claw Score). Только модели, у которых есть результат в каждой из четырёх. - [Qwen3.6-35B-A3B (medium)](https://tsarrouter.ru/models/Qwen/Qwen3.6-35B-A3B) (Qwen/Qwen3.6-35B-A3B): Царь Индекс 59.0 - [Qwen3.8-27B (medium, INT4)](https://tsarrouter.ru/models/Qwen/Qwen3.8-27B) (Qwen/Qwen3.8-27B): Царь Индекс 58.5 - [DeepSeek V4 Flash (medium)](https://tsarrouter.ru/models/deepseek/deepseek-v4-flash) (deepseek/deepseek-v4-flash): Царь Индекс 50.9 - [gpt-oss-120b (medium)](https://tsarrouter.ru/models/openai/gpt-oss-120b) (openai/gpt-oss-120b): Царь Индекс 37.9 - [Qwen3.5-35B-A3B](https://tsarrouter.ru/models/Qwen/Qwen3.5-35B-A3B) (Qwen/Qwen3.5-35B-A3B): Царь Индекс 35.5 - [Gemma-4-26b-a4b-it](https://tsarrouter.ru/models/google/gemma-4-26b-a4b-it) (google/gemma-4-26b-a4b-it): Царь Индекс 33.9 - [AliceAI-LLM (128k)](https://tsarrouter.ru/models/yandex/aliceai-llm) (yandex/aliceai-llm): Царь Индекс 33.9 - [AliceAI-LLM Flash](https://tsarrouter.ru/models/yandex/aliceai-llm-flash) (yandex/aliceai-llm-flash): Царь Индекс 32.0 - [Qwen3-Coder-Next-32B](https://tsarrouter.ru/models/Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct) (Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct): Царь Индекс 29.6 - [Qwen3-235B](https://tsarrouter.ru/models/Qwen/Qwen3-235B-A22B-Instruct-2507) (Qwen/Qwen3-235B-A22B-Instruct-2507): Царь Индекс 29.0 - [GLM-4.7](https://tsarrouter.ru/models/zai-org/GLM-4.7) (zai-org/GLM-4.7): Царь Индекс 27.5 - [gpt-oss-20b (medium)](https://tsarrouter.ru/models/openai/gpt-oss-20b) (openai/gpt-oss-20b): Царь Индекс 23.6 - [GigaChat-2-Max (Sber, high)](https://tsarrouter.ru/models/sber/gigachat-2-max) (sber/gigachat-2-max): Царь Индекс 21.0 - [GigaChat-2-Pro (high)](https://tsarrouter.ru/models/sber/gigachat-2-pro) (sber/gigachat-2-pro): Царь Индекс 20.9 - [GigaChat-2-Pro](https://tsarrouter.ru/models/sber/gigachat-2-pro) (sber/gigachat-2-pro): Царь Индекс 19.9 - [GigaChat-2-Max (Sber)](https://tsarrouter.ru/models/sber/gigachat-2-max) (sber/gigachat-2-max): Царь Индекс 18.7 - [GigaChat-2-Lite (high)](https://tsarrouter.ru/models/sber/gigachat-2-lite) (sber/gigachat-2-lite): Царь Индекс 16.4 - [GigaChat-2-Lite](https://tsarrouter.ru/models/sber/gigachat-2-lite) (sber/gigachat-2-lite): Царь Индекс 15.6 - [GigaChat3-10B](https://tsarrouter.ru/models/ai-sage/GigaChat3-10B-A1.8B) (ai-sage/GigaChat3-10B-A1.8B): Царь Индекс 15.4 ### LiveBench Автоматический бенчмарк с регулярно обновляемыми вопросами. Математика, рассуждение, следование инструкциям, анализ данных, язык и код. Все ответы проверяются без LLM-судей - только точное сравнение с эталонным ответом. - [Qwen3.8-27B (medium, INT4)](https://tsarrouter.ru/models/Qwen/Qwen3.8-27B) (Qwen/Qwen3.8-27B): Среднее 82.4; Math 89.2; Reasoning 93.9; Instruction Following 89.1; Data Analysis 74.6; Language 70.8; Coding 76.6 - [DeepSeek V4 Flash (medium)](https://tsarrouter.ru/models/deepseek/deepseek-v4-flash) (deepseek/deepseek-v4-flash): Среднее 78.7; Math 76.0; Reasoning 90.0; Instruction Following 92.0; Data Analysis 73.1; Language 78.0; Coding 62.9 - [gpt-oss-120b (medium)](https://tsarrouter.ru/models/openai/gpt-oss-120b) (openai/gpt-oss-120b): Среднее 73.5; Math 70.4; Reasoning 81.1; Instruction Following 77.1; Data Analysis 59.8; Language 78.5; Coding 74.4 - [Qwen3.6-35B-A3B (medium)](https://tsarrouter.ru/models/Qwen/Qwen3.6-35B-A3B) (Qwen/Qwen3.6-35B-A3B): Среднее 69.8; Math 46.9; Reasoning 76.4; Instruction Following 94.4; Data Analysis 76.7; Language 50.3; Coding 73.9 - [Gemma-4-26b-a4b-it](https://tsarrouter.ru/models/google/gemma-4-26b-a4b-it) (google/gemma-4-26b-a4b-it): Среднее 67.6; Math 73.2; Reasoning 76.4; Instruction Following 76.2; Data Analysis 65.1; Language 46.0; Coding 68.7 - [Qwen3.5-35B-A3B](https://tsarrouter.ru/models/Qwen/Qwen3.5-35B-A3B) (Qwen/Qwen3.5-35B-A3B): Среднее 64.4; Math 32.1; Reasoning 79.2; Instruction Following 95.0; Data Analysis 65.5; Language 50.0; Coding 64.4 - [AliceAI-LLM (128k)](https://tsarrouter.ru/models/yandex/aliceai-llm) (yandex/aliceai-llm): Среднее 60.2; Math 66.8; Reasoning 60.2; Instruction Following 64.9; Data Analysis 59.6; Language 42.5; Coding 67.3 - [AliceAI-LLM Flash](https://tsarrouter.ru/models/yandex/aliceai-llm-flash) (yandex/aliceai-llm-flash): Среднее 57.1; Math 62.5; Reasoning 55.6; Instruction Following 59.4; Data Analysis 64.2; Language 32.5; Coding 68.6 - [gpt-oss-20b (medium)](https://tsarrouter.ru/models/openai/gpt-oss-20b) (openai/gpt-oss-20b): Среднее 55.8; Math 55.1; Reasoning 62.0; Instruction Following 75.8; Data Analysis 64.6; Language 14.0; Coding 63.0 - [GigaChat-2-Max (Sber, high)](https://tsarrouter.ru/models/sber/gigachat-2-max) (sber/gigachat-2-max): Среднее 46.1; Math 44.7; Reasoning 34.8; Instruction Following 65.2; Data Analysis 53.7; Language 28.8; Coding 49.6 - [Qwen3-Coder-Next-32B](https://tsarrouter.ru/models/Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct) (Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct): Среднее 44.8; Math 40.5; Reasoning 3.0; Instruction Following 69.2; Data Analysis 63.3; Language 24.0; Coding 68.5 - [Qwen3-235B](https://tsarrouter.ru/models/Qwen/Qwen3-235B-A22B-Instruct-2507) (Qwen/Qwen3-235B-A22B-Instruct-2507): Среднее 44.6; Math 8.0; Reasoning 50.0; Instruction Following 76.7; Data Analysis 60.3; Language 6.0; Coding 66.9 - [GLM-4.7](https://tsarrouter.ru/models/zai-org/GLM-4.7) (zai-org/GLM-4.7): Среднее 42.7; Math 30.0; Reasoning 20.0; Instruction Following 78.9; Data Analysis 66.7; Language 4.0; Coding 56.4 - [GigaChat-2-Pro](https://tsarrouter.ru/models/sber/gigachat-2-pro) (sber/gigachat-2-pro): Среднее 42.1; Math 37.3; Reasoning 36.2; Instruction Following 66.9; Data Analysis 46.6; Language 24.2; Coding 41.5 - [GigaChat-2-Max (Sber)](https://tsarrouter.ru/models/sber/gigachat-2-max) (sber/gigachat-2-max): Среднее 41.4; Math 39.3; Reasoning 32.0; Instruction Following 64.5; Data Analysis 44.0; Language 22.0; Coding 46.7 - [GigaChat-2-Pro (high)](https://tsarrouter.ru/models/sber/gigachat-2-pro) (sber/gigachat-2-pro): Среднее 39.9; Math 36.7; Reasoning 35.6; Instruction Following 65.6; Data Analysis 46.2; Language 19.8; Coding 35.8 - [GigaChat-2-Lite (high)](https://tsarrouter.ru/models/sber/gigachat-2-lite) (sber/gigachat-2-lite): Среднее 29.1; Math 28.0; Reasoning 25.9; Instruction Following 55.9; Data Analysis 29.1; Language 15.8; Coding 20.0 - [GigaChat-2-Lite](https://tsarrouter.ru/models/sber/gigachat-2-lite) (sber/gigachat-2-lite): Среднее 27.1; Math 23.5; Reasoning 27.2; Instruction Following 55.7; Data Analysis 24.1; Language 7.5; Coding 24.7 - [GigaChat3-10B](https://tsarrouter.ru/models/ai-sage/GigaChat3-10B-A1.8B) (ai-sage/GigaChat3-10B-A1.8B): Среднее 20.9; Math 24.3; Reasoning 5.0; Instruction Following 42.2; Data Analysis 32.8; Language 0.7; Coding 20.7 ### Контекстное окно (MRCR v2) Тест DeepMind (MRCR, multi-round coreference resolution) на работу с длинным контекстом: в диалоге модель должна точно воспроизвести один конкретный из восьми похожих ответов ассистента. Оценивается точность при увеличении размера контекста. Инструменты модели не предоставлялись. - [DeepSeek V4 Pro (medium)](https://tsarrouter.ru/models/deepseek-ai/DeepSeek-V4-Pro) (deepseek-ai/DeepSeek-V4-Pro): 4K 100.0; 8K 85.1; 16K 91.2; 32K 67.9; 64K 75.4; 128K 28.0 - [Qwen3.6-35B-A3B (medium)](https://tsarrouter.ru/models/Qwen/Qwen3.6-35B-A3B) (Qwen/Qwen3.6-35B-A3B): 4K 100.0; 8K 95.1; 16K 95.5; 32K 70.8; 64K 60.7 - [Qwen3.8-27B (medium, INT4)](https://tsarrouter.ru/models/Qwen/Qwen3.8-27B) (Qwen/Qwen3.8-27B): 4K 100.0; 8K 100.0; 16K 100.0; 32K 80.3; 64K 21.9 - [DeepSeek V4 Flash (medium)](https://tsarrouter.ru/models/deepseek/deepseek-v4-flash) (deepseek/deepseek-v4-flash): 4K 99.8; 8K 85.3; 16K 67.1; 32K 46.4; 64K 17.3; 128K 70.7 - [gpt-oss-120b (medium)](https://tsarrouter.ru/models/openai/gpt-oss-120b) (openai/gpt-oss-120b): 4K 78.4; 8K 32.8; 16K 30.4; 32K 17.8 - [AliceAI-LLM (128k)](https://tsarrouter.ru/models/yandex/aliceai-llm) (yandex/aliceai-llm): 4K 46.4; 8K 36.3; 16K 29.6; 32K 17.4 - [Qwen3-235B](https://tsarrouter.ru/models/Qwen/Qwen3-235B-A22B-Instruct-2507) (Qwen/Qwen3-235B-A22B-Instruct-2507): 4K 31.9; 8K 27.0; 16K 24.2; 32K 16.2; 64K 17.1 - [Gemma-4-26b-a4b-it](https://tsarrouter.ru/models/google/gemma-4-26b-a4b-it) (google/gemma-4-26b-a4b-it): 4K 36.1; 8K 36.7; 16K 16.1; 32K 19.3 - [Qwen3-Coder-Next-32B](https://tsarrouter.ru/models/Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct) (Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct): 4K 31.2; 8K 17.4; 16K 13.1; 32K 13.9; 64K 17.2 - [AliceAI-LLM Flash](https://tsarrouter.ru/models/yandex/aliceai-llm-flash) (yandex/aliceai-llm-flash): 4K 16.9; 8K 22.1; 16K 19.4 - [gpt-oss-20b (medium)](https://tsarrouter.ru/models/openai/gpt-oss-20b) (openai/gpt-oss-20b): 4K 27.9; 8K 12.6; 16K 9.9; 32K 5.8 - [GLM-4.7](https://tsarrouter.ru/models/zai-org/GLM-4.7) (zai-org/GLM-4.7): 4K 16.5; 8K 14.1; 16K 13.8; 32K 8.6; 64K 3.1 - [GigaChat-2-Pro (high)](https://tsarrouter.ru/models/sber/gigachat-2-pro) (sber/gigachat-2-pro): 4K 12.7; 8K 12.4; 16K 13.6; 32K 15.7 - [GigaChat-2-Lite](https://tsarrouter.ru/models/sber/gigachat-2-lite) (sber/gigachat-2-lite): 4K 7.2; 8K 17.0; 16K 14.4; 32K 8.9 - [GigaChat-2-Pro](https://tsarrouter.ru/models/sber/gigachat-2-pro) (sber/gigachat-2-pro): 4K 11.8; 8K 12.7; 16K 8.5; 32K 7.6 - [GigaChat-2-Lite (high)](https://tsarrouter.ru/models/sber/gigachat-2-lite) (sber/gigachat-2-lite): 4K 8.5; 8K 11.7; 16K 9.7; 32K 7.9 - [GigaChat-2-Max (Sber)](https://tsarrouter.ru/models/sber/gigachat-2-max) (sber/gigachat-2-max): 4K 14.3; 8K 10.3; 16K 9.6; 32K 3.3 - [GigaChat-2-Max (Sber, high)](https://tsarrouter.ru/models/sber/gigachat-2-max) (sber/gigachat-2-max): 4K 13.8; 8K 8.7; 16K 10.4; 32K 3.0 - [Qwen3.5-35B-A3B](https://tsarrouter.ru/models/Qwen/Qwen3.5-35B-A3B) (Qwen/Qwen3.5-35B-A3B): 4K 15.5; 8K 2.2; 16K 4.0; 32K 5.0; 64K 3.2 - [GigaChat3-10B](https://tsarrouter.ru/models/ai-sage/GigaChat3-10B-A1.8B) (ai-sage/GigaChat3-10B-A1.8B): 4K 4.8; 8K 6.6; 16K 14.0; 32K 2.4; 64K 0.8 ### Bullshit Detection Benchmark Тест на распознавание бессмысленных вопросов (petergpt/bullshit-benchmark, набор v1). 55 вопросов, распределённых по 10 техникам. Три судьи (Claude Sonnet 4.6, GPT-5.2, Gemini 3.1 Pro) оценивают ответы: 2 = распознал, 1 = частично, 0 = не распознал. Итоговый балл = распознал% + частично%/2. Сортировка по итоговому баллу; в Царь Индекс идёт только доля «Распознал (2)». - [Qwen3.6-35B-A3B (medium)](https://tsarrouter.ru/models/Qwen/Qwen3.6-35B-A3B) (Qwen/Qwen3.6-35B-A3B): Распознал (2) 46.1; Частично (1) 20.0; Не распознал (0) 33.9 - [Qwen3.5-35B-A3B](https://tsarrouter.ru/models/Qwen/Qwen3.5-35B-A3B) (Qwen/Qwen3.5-35B-A3B): Распознал (2) 37.0; Частично (1) 25.5; Не распознал (0) 37.6 - [Qwen3-Coder-Next-32B](https://tsarrouter.ru/models/Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct) (Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct): Распознал (2) 27.3; Частично (1) 25.5; Не распознал (0) 47.3 - [Qwen3-235B](https://tsarrouter.ru/models/Qwen/Qwen3-235B-A22B-Instruct-2507) (Qwen/Qwen3-235B-A22B-Instruct-2507): Распознал (2) 22.4; Частично (1) 23.6; Не распознал (0) 53.9 - [Qwen3.8-27B (medium, INT4)](https://tsarrouter.ru/models/Qwen/Qwen3.8-27B) (Qwen/Qwen3.8-27B): Распознал (2) 27.9; Частично (1) 9.3; Не распознал (0) 62.8 - [AliceAI-LLM Flash](https://tsarrouter.ru/models/yandex/aliceai-llm-flash) (yandex/aliceai-llm-flash): Распознал (2) 24.8; Частично (1) 7.3; Не распознал (0) 67.9 - [GLM-4.7](https://tsarrouter.ru/models/zai-org/GLM-4.7) (zai-org/GLM-4.7): Распознал (2) 20.4; Частично (1) 12.2; Не распознал (0) 67.3 - [AliceAI-LLM (128k)](https://tsarrouter.ru/models/yandex/aliceai-llm) (yandex/aliceai-llm): Распознал (2) 18.8; Частично (1) 12.1; Не распознал (0) 69.1 - [DeepSeek V4 Flash (medium)](https://tsarrouter.ru/models/deepseek/deepseek-v4-flash) (deepseek/deepseek-v4-flash): Распознал (2) 22.4; Частично (1) 4.2; Не распознал (0) 73.3 - [DeepSeek V4 Pro (medium)](https://tsarrouter.ru/models/deepseek-ai/DeepSeek-V4-Pro) (deepseek-ai/DeepSeek-V4-Pro): Распознал (2) 15.8; Частично (1) 10.9; Не распознал (0) 73.3 - [GigaChat3-10B](https://tsarrouter.ru/models/ai-sage/GigaChat3-10B-A1.8B) (ai-sage/GigaChat3-10B-A1.8B): Распознал (2) 11.1; Частично (1) 9.3; Не распознал (0) 79.6 - [Gemma-4-26b-a4b-it](https://tsarrouter.ru/models/google/gemma-4-26b-a4b-it) (google/gemma-4-26b-a4b-it): Распознал (2) 11.5; Частично (1) 5.5; Не распознал (0) 83.0 - [GigaChat-2-Pro (high)](https://tsarrouter.ru/models/sber/gigachat-2-pro) (sber/gigachat-2-pro): Распознал (2) 7.3; Частично (1) 9.7; Не распознал (0) 83.0 - [gpt-oss-120b (medium)](https://tsarrouter.ru/models/openai/gpt-oss-120b) (openai/gpt-oss-120b): Распознал (2) 7.9; Частично (1) 6.7; Не распознал (0) 85.5 - [GigaChat-2-Pro](https://tsarrouter.ru/models/sber/gigachat-2-pro) (sber/gigachat-2-pro): Распознал (2) 5.5; Частично (1) 10.9; Не распознал (0) 83.6 - [GigaChat-2-Lite (high)](https://tsarrouter.ru/models/sber/gigachat-2-lite) (sber/gigachat-2-lite): Распознал (2) 4.2; Частично (1) 7.9; Не распознал (0) 87.9 - [gpt-oss-20b (medium)](https://tsarrouter.ru/models/openai/gpt-oss-20b) (openai/gpt-oss-20b): Распознал (2) 3.9; Частично (1) 7.8; Не распознал (0) 88.2 - [GigaChat-2-Max (Sber, high)](https://tsarrouter.ru/models/sber/gigachat-2-max) (sber/gigachat-2-max): Распознал (2) 4.2; Частично (1) 5.5; Не распознал (0) 90.3 - [GigaChat-2-Max (Sber)](https://tsarrouter.ru/models/sber/gigachat-2-max) (sber/gigachat-2-max): Распознал (2) 2.4; Частично (1) 4.8; Не распознал (0) 92.7 - [GigaChat-2-Lite](https://tsarrouter.ru/models/sber/gigachat-2-lite) (sber/gigachat-2-lite): Распознал (2) 1.8; Частично (1) 3.6; Не распознал (0) 94.5 ### claw-eval (Agent Tasks) Оценка агентских способностей модели: 300 задач (планирование, инструменты, многошаговое выполнение). Claw Score - наш сводный балл, взвешенное среднее (completion×0.1 + pass@1×0.7 + robustness×0.1 + safety×0.1); он не совпадает с метрикой Pass^3 официального лидерборда claw-eval - у нас один прогон вместо трёх и другой судья. Completion - доля выполненных подзадач. Robustness - стабильность (не зациклился, не упал). Safety - безопасность (не выполнил деструктивных действий). Pass@1 - задачи, решённые полностью. - [Qwen3.8-27B (medium, INT4)](https://tsarrouter.ru/models/Qwen/Qwen3.8-27B) (Qwen/Qwen3.8-27B): Claw Score 43.4; Pass@1 28.7; Completion 38.4; Robustness 95.9; Safety 99.0 - [DeepSeek V4 Flash (medium)](https://tsarrouter.ru/models/deepseek/deepseek-v4-flash) (deepseek/deepseek-v4-flash): Claw Score 38.1; Pass@1 24.3; Completion 33.6; Robustness 80.7; Safety 96.3 - [Qwen3.6-35B-A3B (medium)](https://tsarrouter.ru/models/Qwen/Qwen3.6-35B-A3B) (Qwen/Qwen3.6-35B-A3B): Claw Score 35.8; Pass@1 20.3; Completion 29.3; Robustness 89.0; Safety 97.0 - [GLM-4.7](https://tsarrouter.ru/models/zai-org/GLM-4.7) (zai-org/GLM-4.7): Claw Score 35.6; Pass@1 18.8; Completion 29.1; Robustness 97.1; Safety 97.7 - [Qwen3.5-35B-A3B](https://tsarrouter.ru/models/Qwen/Qwen3.5-35B-A3B) (Qwen/Qwen3.5-35B-A3B): Claw Score 34.6; Pass@1 17.7; Completion 31.7; Robustness 93.3; Safety 96.8 - [gpt-oss-120b (medium)](https://tsarrouter.ru/models/openai/gpt-oss-120b) (openai/gpt-oss-120b): Claw Score 30.5; Pass@1 12.1; Completion 24.3; Robustness 97.3; Safety 98.3 - [Gemma-4-26b-a4b-it](https://tsarrouter.ru/models/google/gemma-4-26b-a4b-it) (google/gemma-4-26b-a4b-it): Claw Score 29.5; Pass@1 10.7; Completion 24.6; Robustness 97.1; Safety 99.0 - [Qwen3-Coder-Next-32B](https://tsarrouter.ru/models/Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct) (Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct): Claw Score 27.9; Pass@1 10.4; Completion 20.5; Robustness 90.2; Safety 95.6 - [AliceAI-LLM Flash](https://tsarrouter.ru/models/yandex/aliceai-llm-flash) (yandex/aliceai-llm-flash): Claw Score 26.5; Pass@1 7.3; Completion 20.0; Robustness 95.7; Safety 97.7 - [Qwen3-235B](https://tsarrouter.ru/models/Qwen/Qwen3-235B-A22B-Instruct-2507) (Qwen/Qwen3-235B-A22B-Instruct-2507): Claw Score 25.9; Pass@1 7.2; Completion 18.5; Robustness 93.2; Safety 96.9 - [GigaChat-2-Max (Sber, high)](https://tsarrouter.ru/models/sber/gigachat-2-max) (sber/gigachat-2-max): Claw Score 24.9; Pass@1 5.3; Completion 18.4; Robustness 95.2; Safety 98.3 - [AliceAI-LLM (128k)](https://tsarrouter.ru/models/yandex/aliceai-llm) (yandex/aliceai-llm): Claw Score 24.0; Pass@1 4.3; Completion 18.1; Robustness 94.9; Safety 97.0 - [GigaChat3-10B](https://tsarrouter.ru/models/ai-sage/GigaChat3-10B-A1.8B) (ai-sage/GigaChat3-10B-A1.8B): Claw Score 23.7; Pass@1 4.5; Completion 14.9; Robustness 93.5; Safety 97.0 - [GigaChat-2-Pro (high)](https://tsarrouter.ru/models/sber/gigachat-2-pro) (sber/gigachat-2-pro): Claw Score 22.8; Pass@1 2.7; Completion 14.7; Robustness 96.0; Safety 98.3 - [GigaChat-2-Lite (high)](https://tsarrouter.ru/models/sber/gigachat-2-lite) (sber/gigachat-2-lite): Claw Score 22.7; Pass@1 2.7; Completion 12.0; Robustness 96.7; Safety 99.3 - [GigaChat-2-Pro](https://tsarrouter.ru/models/sber/gigachat-2-pro) (sber/gigachat-2-pro): Claw Score 22.0; Pass@1 2.1; Completion 8.5; Robustness 98.6; Safety 98.3 - [GigaChat-2-Lite](https://tsarrouter.ru/models/sber/gigachat-2-lite) (sber/gigachat-2-lite): Claw Score 21.6; Pass@1 2.0; Completion 9.0; Robustness 96.3; Safety 96.9 - [GigaChat-2-Max (Sber)](https://tsarrouter.ru/models/sber/gigachat-2-max) (sber/gigachat-2-max): Claw Score 21.6; Pass@1 1.4; Completion 7.9; Robustness 98.1; Safety 99.7 - [gpt-oss-20b (medium)](https://tsarrouter.ru/models/openai/gpt-oss-20b) (openai/gpt-oss-20b): Claw Score 20.7; Pass@1 0.0; Completion 13.7; Robustness 96.0; Safety 97.5 ### Стоимость прогонов Расход бенчмарк-ключа за всё время, по данным биллинга. Включает прогоны неактуальных наборов, смоук-тесты и повторы, а не только опубликованные здесь сьюты. Прогоны до 28.07.2026 пересчитаны с учётом кэша промпта. 0 ₽ - прогон не тарифицировался. - DeepSeek V4 Flash (medium) (deepseek/deepseek-v4-flash): 8184 ₽, 3290 запросов - Qwen3.5-35B-A3B (Qwen/Qwen3.5-35B-A3B): 6902 ₽, 7197 запросов - Qwen3.6-35B-A3B (medium) (Qwen/Qwen3.6-35B-A3B): 5804 ₽, 2782 запроса - GigaChat-2-Max (Sber, high) (sber/gigachat-2-max): 3691 ₽, 2064 запроса - AliceAI-LLM (128k) (yandex/aliceai-llm): 3615 ₽, 1755 запросов - gpt-oss-120b (medium) (openai/gpt-oss-120b): 2426 ₽, 16479 запросов - GigaChat-2-Pro (sber/gigachat-2-pro): 2143 ₽, 5826 запросов - GigaChat-2-Pro (high) (sber/gigachat-2-pro): 1948 ₽, 2001 запрос - GigaChat-2-Max (Sber) (sber/gigachat-2-max): 1881 ₽, 1818 запросов - gpt-oss-20b (medium) (openai/gpt-oss-20b): 1288 ₽, 1886 запросов - Qwen3-235B (Qwen/Qwen3-235B-A22B-Instruct-2507): 1189 ₽, 11418 запросов - AliceAI-LLM Flash (yandex/aliceai-llm-flash): 802 ₽, 2271 запрос - GigaChat-2-Lite (sber/gigachat-2-lite): 747 ₽, 6084 запроса - GigaChat3-10B (ai-sage/GigaChat3-10B-A1.8B): 605 ₽, 15938 запросов - GigaChat-2-Lite (high) (sber/gigachat-2-lite): 413 ₽, 3046 запросов - Qwen3-Coder-Next-32B (Qwen/Qwen3-Coder-Next-32B-A3.2B-Instruct): 0 ₽, 21377 запросов - Qwen3.8-27B (medium, INT4) (Qwen/Qwen3.8-27B): 0 ₽, 2463 запроса - GLM-4.7 (zai-org/GLM-4.7): 0 ₽, 17826 запросов - Gemma-4-26b-a4b-it (google/gemma-4-26b-a4b-it): 0 ₽, 3100 запросов ## Статус сервиса Живой мониторинг: https://status.tsarrouter.ru - опрос каждой модели по расписанию, страница обновляется сама. Под мониторингом 47 моделей каталога - это не весь каталог, полный состав в разделах «Модели» выше. Сейчас отвечают 47. Аптайм ниже - за последние 24 часа, по модели целиком: если модель доступна у нескольких провайдеров, берётся лучший из них, потому что запрос уходит на живой автоматически. Срез на момент генерации файла, не история. Актуальное состояние - всегда на странице статуса. - aliceai-llm: отвечает, аптайм 24 ч 100.00% - aliceai-llm-flash: отвечает, аптайм 24 ч 100.00% - bge-m3: отвечает, аптайм 24 ч 100.00% - bge-reranker-v2-m3: отвечает, аптайм 24 ч 100.00% - deepseek-v4-flash: отвечает, аптайм 24 ч 100.00% - deepseek-v4-flash-0731: отвечает, аптайм 24 ч 100.00% - DeepSeek-V4-Pro: отвечает, аптайм 24 ч 100.00% - embeddings-gigar: отвечает, аптайм 24 ч 100.00% - gemma-4-26b-a4b-it: отвечает, аптайм 24 ч 100.00% - gemma-4-31b-it: отвечает, аптайм 24 ч 100.00% - gigachat-2-lite: отвечает, аптайм 24 ч 100.00% - gigachat-2-max: отвечает, аптайм 24 ч 100.00% - gigachat-2-pro: отвечает, аптайм 24 ч 100.00% - gigachat-embeddings: отвечает, аптайм 24 ч 100.00% - gigachat-embeddings-2: отвечает, аптайм 24 ч 100.00% - GigaChat3-10B-A1.8B: отвечает, аптайм 24 ч 100.00% - gigaembeddings-3b: отвечает, аптайм 24 ч 100.00% - GLM-4.7: отвечает, аптайм 24 ч 100.00% - GLM-5.1: отвечает, аптайм 24 ч 100.00% - GLM-5.2: отвечает, аптайм 24 ч 100.00% - gpt-oss-120b: отвечает, аптайм 24 ч 100.00% - gpt-oss-20b: отвечает, аптайм 24 ч 100.00% - Kimi-K2.6: отвечает, аптайм 24 ч 100.00% - MiniMax-M2.5: отвечает, аптайм 24 ч 100.00% - MiniMax-M3: отвечает, аптайм 24 ч 100.00% - Nemotron-3-Nano-30B-A3B: отвечает, аптайм 24 ч 100.00% - Qwen3-235B-A22B-Instruct-2507: отвечает, аптайм 24 ч 100.00% - Qwen3-Coder-Next-32B-A3.2B-Instruct: отвечает, аптайм 24 ч 100.00% - Qwen3-Embedding-0.6B: отвечает, аптайм 24 ч 100.00% - Qwen3-Reranker-0.6B: отвечает, аптайм 24 ч 100.00% - Qwen3-VL-Embedding-2B: отвечает, аптайм 24 ч 100.00% - Qwen3-VL-Embedding-8B: отвечает, аптайм 24 ч 100.00% - Qwen3-VL-Reranker-2B: отвечает, аптайм 24 ч 100.00% - Qwen3-VL-Reranker-8B: отвечает, аптайм 24 ч 100.00% - Qwen3.5-35B-A3B: отвечает, аптайм 24 ч 100.00% - Qwen3.5-397B-A17B: отвечает, аптайм 24 ч 100.00% - Qwen3.6-27B: отвечает, аптайм 24 ч 100.00% - Qwen3.6-35B-A3B: отвечает, аптайм 24 ч 100.00% - Qwen3.8-27B: отвечает, аптайм 24 ч 100.00% - text-embeddings-doc-v2: отвечает, аптайм 24 ч 100.00% - text-embeddings-query-v2: отвечает, аптайм 24 ч 100.00% - text-search-doc: отвечает, аптайм 24 ч 100.00% - text-search-query: отвечает, аптайм 24 ч 100.00% - whisper-large-v3: отвечает, аптайм 24 ч 100.00% - yandexgpt-lite-5: отвечает, аптайм 24 ч 100.00% - yandexgpt-pro-5: отвечает, аптайм 24 ч 100.00% - yandexgpt-pro-5.1: отвечает, аптайм 24 ч 100.00% ## Правовые документы - [Публичная оферта](https://tsarrouter.ru/offer) - [Политика конфиденциальности](https://tsarrouter.ru/privacy) - [Согласие на обработку персональных данных](https://tsarrouter.ru/consent) - [Политика использования cookie](https://tsarrouter.ru/cookies)