Skip to main content

Выберите операцию

Для озвучивания вызовите POST /v1/audio/speech с model и input (до 32000 символов). Транскрипция для внешних моделей сейчас недоступна. Её JSON-формат POST /v1/audio/transcriptions предусматривает model и file_id своего проверенного WAV или MP3. Проверьте операцию в каталоге, права ключа и оценку стоимости. Значение PUBLIC_API_ID ниже замените публичным ID выбранной модели; это заполнитель, а не готовая модель.

Тело запроса

Передайте Authorization: Bearer <ключ>, Content-Type: application/json и сохранённый Idempotency-Key. Для каждой новой генерации нужен отдельный ID.

Получение результата

Оба endpoint возвращают асинхронное задание. После succeeded получите файл из output.file_id. Озвучивание даёт аудио, транскрипция даёт UTF-8 TXT; его можно прочитать через GET /v1/files/FILE_ID/content. Проверяйте GET /v1/jobs/ID, пока задание не завершится. При статусе unknown не запускайте новую транскрипцию или озвучивание автоматически. Состояния задания объясняют, когда можно получать файл и что делать при неопределённом исходе.

Ограничения

JSON-контракт не принимает multipart, voice, language, скорость речи или поток аудио. Транскрипция сейчас недоступна для внешних моделей. Для озвучивания выбирайте доступную операцию с опубликованным фиксированным тарифом за запрос.