ЦАРЬ РОУТЕР

palatine/speech-to-text-diarize

Расшифровка речи (STT)

Palatine — разделение записи по дикторам: метки говорящих и границы реплик, без расшифровки текста. Текст — отдельной моделью palatine/speech-to-text.

Провайдеров
1
Цена / мин
0.30 ₽/мин
Макс. размер файла
1024 МБ
Тип
Расшифровка речи (STT)
Разработчик
palatine

Провайдеры

СтатусПровайдерЦена / мин
ОнлайнPalatine Speech0.30 ₽/мин

Цены обновлены: 13.09.2026

Примеры использования

bash
# Базовая транскрипция:
curl -X POST "https://api.tsarrouter.ru/v1/audio/transcriptions" \
  -H "Authorization: Bearer sk-tsar-ваш-ключ" \
  -F "model=palatine/speech-to-text-diarize" \
  -F "file=@audio.mp3" \
  -F "response_format=json"

# Модель размечает говорящих, но НЕ расшифровывает речь:
#   "text" в ответе всегда пустой, в "segments" - границы реплик и speaker.
#   Текст - отдельной моделью palatine/speech-to-text.
# Других параметров нет: диаризация принимает только файл.
#
# Разбор ответа:
#   ... | jq -r '.segments[] | "\(.start)-\(.end)  \(.speaker)"'
#   0-0.72  SPEAKER_0
#   1.36-4.16  SPEAKER_1