"model":"openai/whisper-1"
Вход
Аудио
Выход
Текст
Тариф
За минуту аудио

Whisper — открытая (open-source) модель автоматического распознавания речи от OpenAI, доступная через API как whisper-1. Она поддерживает транскрибацию и перевод на более чем 50 языках для аудиофайлов размером до 25 МБ. Принимает форматы, включая mp3, mp4, wav и webm. Тарифицируется по минутам длительности аудио с округлением до ближайшей секунды.

Цена
Минута аудио0.758 ₽
Час аудио45,49 ₽

Итоговая стоимость каждого запроса — в ответе (usage.cost_rub) и в статистике.

Быстрый старт

curl https://api.aiadapter.ru/api/v1/audio/transcriptions \
  -H "Authorization: Bearer sk-aa-v1-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"openai/whisper-1","file":"<base64-аудио>"}'

Модели распознавания речи доступны только по API — в чате их нет. Параметры запроса — в документации.