F

Fish Audio: Transcribe 1 Pro

Документация API
"model":"fish-audio/transcribe-1-pro"
Вход
Аудио
Выход
Текст
Тариф
За минуту аудио

Transcribe 1 Pro — модель speech-to-text от Fish Audio, настроенная для интервью, совещаний и подкастов. Она помечает говорящих встроенными в текст маркерами speaker, сохраняет пометки эмоций и голосовых событий, например [laughter], автоматически определяет язык и может возвращать сегменты с временными метками на уровне слов.

Цена
Минута аудио0.758 ₽
Час аудио45,49 ₽

Итоговая стоимость каждого запроса — в ответе (usage.cost_rub) и в статистике.

Быстрый старт

curl https://api.aiadapter.ru/api/v1/audio/transcriptions \
  -H "Authorization: Bearer sk-aa-v1-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"fish-audio/transcribe-1-pro","file":"<base64-аудио>"}'

Модели распознавания речи доступны только по API — в чате их нет. Параметры запроса — в документации.