Синтез речи
/v1/audio/speechОзвучивает текст в формате OpenAI Audio. Тело ответа - аудиофайл, всё о запросе -
в заголовках. Голоса и форматы каждой модели - в полях voices и audio_formats
её карточки.
Прочие параметры OpenAI (например, instructions) принимаются без ошибки, но
провайдеру не передаются.
Стоимость. Цена считается по длине input без пробелов в начале и конце: у
yandex/yandex-tts - блоками по 250 символов, у vkcloud/text-to-speech - за
каждый символ. Правило модели - в поле billing_rule её карточки, подробнее - в
«Сколько стоит запрос».
Лимиты. Действуют общий лимит аккаунта и лимит типа моделей speech - см.
«Лимиты».
Авторизация
ModelsKey Ключ типа «Вызов моделей»: Authorization: Bearer sk-tsar-ваш-ключ.
Ключ «Просмотр баланса» получит 403 insufficient_scope.
Где: header
Тело запроса
application/json
Тело ответа
application/json
application/json
application/json
application/json
application/json
application/json
curl https://api.tsarrouter.ru/v1/audio/speech \ -H "Authorization: Bearer $TSARROUTER_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "yandex/yandex-tts", "input": "Привет! Это ЦАРЬ РОУТЕР.", "voice": "alena" }' \ --output speech.mp3"string"Улучшение и увеличение фото POST
Обработка готовой картинки: улучшение и раскраска фото или увеличение разрешения. Режим задаёт модель. Оплата - за запрос. Эндпоинта нет в OpenAI API, поэтому примеры - на обычных HTTP-запросах.
Распознавание речи POST
Текст из аудиофайла в формате OpenAI Audio. Распознавание в реальном времени - в руководстве «Потоковое распознавание речи».