palatine/speech-to-text-diarize
Расшифровка речи (STT)Palatine — разделение записи по дикторам: метки говорящих и границы реплик, без расшифровки текста. Текст — отдельной моделью palatine/speech-to-text.
Провайдеров
1
Цена / мин
0.30 ₽/мин
Макс. размер файла
1024 МБ
Тип
Расшифровка речи (STT)
Разработчик
palatine
Провайдеры
| Статус | Провайдер | Цена / мин |
|---|---|---|
| Онлайн | Palatine Speech | 0.30 ₽/мин |
Цены обновлены: 13.09.2026
Примеры использования
bash
# Базовая транскрипция:
curl -X POST "https://api.tsarrouter.ru/v1/audio/transcriptions" \
-H "Authorization: Bearer sk-tsar-ваш-ключ" \
-F "model=palatine/speech-to-text-diarize" \
-F "file=@audio.mp3" \
-F "response_format=json"
# Модель размечает говорящих, но НЕ расшифровывает речь:
# "text" в ответе всегда пустой, в "segments" - границы реплик и speaker.
# Текст - отдельной моделью palatine/speech-to-text.
# Других параметров нет: диаризация принимает только файл.
#
# Разбор ответа:
# ... | jq -r '.segments[] | "\(.start)-\(.end) \(.speaker)"'
# 0-0.72 SPEAKER_0
# 1.36-4.16 SPEAKER_1