Перевести аудио в текст онлайн

Загрузите запись встречи, интервью или голосовое сообщение — сервис распознает речь и положит готовый текст в документ. Дальше его можно почистить от слов-паразитов и собрать в структуру той же нейросетью, не переключаясь между вкладками.

Расшифровка доступна после регистрации. При ней начисляется 20 AI токенов — примерно 40 минут записи. Карта не нужна.

Как это работает

Ничего не нужно устанавливать: всё происходит в браузере, на телефоне тоже.

  1. Загрузите файл

    MP3, WAV, M4A или OGG — до двух часов и до 100 МБ. Формат, который распознаватель не понимает напрямую, перекодируется автоматически.

  2. Дождитесь расшифровки

    Запись обрабатывается на сервере, прогресс виден в окне загрузки. Речь распознаётся вместе с пунктуацией и заглавными буквами — читаемый текст, а не сплошная строчная лента.

  3. Доведите текст до результата

    Текст попадает в заметку целиком или дописывается к тому, что уже есть. Дальше — правки нейросетью, диктовка недостающего голосом и экспорт в PDF, DOCX, Markdown или TXT.

Что поддерживается

Форматы
MP3, WAV, OGG — напрямую. M4A, MP4 и AAC перекодируются автоматически при загрузке
Длительность и размер
До 2 часов и до 100 МБ на файл
Язык
Русский
Пунктуация
Расставляется автоматически, вместе с заглавными буквами и числами в цифровой записи
Куда попадает текст
В вашу заметку — целиком или в дополнение к уже написанному, на выбор
Что можно сделать дальше
Структурировать, сократить, сменить стиль, обсудить текст с ИИ, дописать голосом, проверить фактуру исследованием с источниками
Экспорт
PDF, DOCX, Markdown, TXT
Распознавание
Yandex SpeechKit

Чем это отличается от обычного транскрибатора

Сервисы расшифровки отдают файл с текстом — и на этом заканчиваются. А работа с записью только начинается: расшифровка часовой встречи почти нечитаема, пока из неё не убрать повторы и не собрать структуру.

Расшифровка — это первый шаг, а не результат

Сразу после распознавания можно попросить убрать слова-паразиты и оговорки, разложить разговор по темам, вытащить решения и задачи, сократить до краткого пересказа. Это те же правки, что и для любого другого текста в документе.

Текст остаётся живым документом

Расшифровка не уезжает в отдельный файл. Её можно дополнить голосом, задать по ней вопросы ИИ, проверить упомянутые факты исследованием с источниками — и только потом выгрузить готовый материал.

Сколько стоит

Расшифровка расходует AI токены — общую валюту сервиса. Минута записи стоит половину токена, итог округляется вверх до целого: 1–2 минуты — 1 токен, 3–4 минуты — 2 токена, час записи — 30 токенов, два часа — 60.

Токены списываются только после того, как текст готов. Если распознать запись не удалось, баланс не тронут.

Приветственных 20 токенов хватает примерно на 40 минут. Дальше можно взять месячный тариф с пакетом токенов или разовый пакет — он не сгорает.

Что сервис не делает

  • Не разделяет реплики по говорящим и не проставляет таймкоды — текст приходит сплошным потоком. Диалог можно разложить по ролям уже в документе, руками или запросом к ИИ.
  • Распознаёт только русскую речь.
  • Не принимает файлы длиннее двух часов и тяжелее 100 МБ — длинную запись нужно разрезать на части.
  • Загрузка файлов доступна только зарегистрированным. Если хочется попробовать распознавание без аккаунта — диктовка голосом работает и для гостей.

Частые вопросы

Какие форматы аудио можно загрузить?

MP3, WAV и OGG принимаются напрямую. M4A, MP4 и AAC перекодируются автоматически, отдельно готовить файл не нужно.

Какой длины может быть запись?

До двух часов и до 100 МБ на один файл. Более длинную запись нужно разрезать на части и загрузить по очереди.

Сколько стоит расшифровка?

Минута записи стоит половину AI токена, итог округляется вверх до целого: 1–2 минуты — 1 токен, час записи — 30 токенов, два часа — 60. Токены списываются только после того, как расшифровка готова.

Можно ли расшифровать запись бесплатно?

Да, в пределах приветственного баланса. При регистрации начисляется 20 AI токенов — этого хватает примерно на 40 минут записи. Карта для этого не нужна.

Разделяет ли сервис реплики по говорящим?

Нет. Текст приходит сплошным потоком, без пометок «спикер 1» и «спикер 2» и без таймкодов. Но диалог можно разложить по ролям вручную или попросить об этом ИИ уже в документе.

На каком языке распознаётся речь?

На русском. Записи на других языках сервис пока не расшифровывает.

Что происходит с загруженным файлом?

Файл нужен только для распознавания и удаляется из хранилища сразу после того, как расшифровка закончена. У вас остаётся текст в документе.

Что почитать по теме

Загрузите первую запись

Приветственных токенов хватит примерно на 40 минут расшифровки. Карта не нужна.

Открыть приложение