"model":"openai/whisper-large-v3-turbo"
Вход
Аудио
Выход
Текст
Тариф
За минуту аудио
Whisper Large V3 Turbo — оптимизированная версия модели распознавания речи Whisper Large V3 от OpenAI, рассчитанная на скорость и экономичность. Она поддерживает транскрибацию на более чем 99 языках с долей ошибок в словах (WER) 12% и принимает распространённые аудиоформаты, включая mp3, mp4, wav, webm, flac и ogg. Достигает скорости до 216x относительно реального времени, поэтому хорошо подходит для чувствительных к задержке задач транскрибации и задач с высокой пропускной способностью.
Цена
Минута аудио0.025 ₽
Час аудио1,51 ₽
Итоговая стоимость каждого запроса — в ответе (usage.cost_rub) и в статистике.
Быстрый старт
curl https://api.aiadapter.ru/api/v1/audio/transcriptions \
-H "Authorization: Bearer sk-aa-v1-..." \
-H "Content-Type: application/json" \
-d '{"model":"openai/whisper-large-v3-turbo","file":"<base64-аудио>"}'
Модели распознавания речи доступны только по API — в чате их нет. Параметры запроса — в документации.