К содержанию
Найти
Найти инструмент…

Категории

Сайт

MP3, M4A, OGG в текст

Любой аудиофайл — MP3, M4A, WAV, OGG, AAC — в текст с пунктуацией и репликами по спикерам. Без установки программ.

  • ИИ · 3 мин бесплатно
  • Обработка на серверах в России

Видео не покидает устройство: звук извлекается в браузере, на расшифровку уходит только он.

или запишите голос

Говорите — запись остаётся в браузере, пока вы не нажмёте «Стоп». Первые 3 минуты расшифруем бесплатно.

Язык записи: русский ·

Сколько человек говорит

Выберите файл.

Какие аудиоформаты подходят

  • MP3 — подкасты, записи звонков, скачанные аудио;
  • M4A — диктофон iPhone и многих Android;
  • OGG и OPUS — голосовые из Telegram и WhatsApp;
  • WAV и AAC — записи с рекордеров и из монтажных программ.

Без установки программ

Всё работает в браузере на компьютере и телефоне: не нужно ставить программы и конвертировать файлы. Браузер сам приводит звук к нужному формату перед отправкой.

Если формата нет в списке

Записи в других форматах — например, AMR или WMA — сначала переведите в MP3 любым аудиоконвертером, а затем выберите получившийся файл. Видео (MP4, MOV, WEBM) конвертировать не нужно: звук из него браузер извлечёт сам.

  • 46 мин → 3 мин 43 среальная расшифровка часового интервью на сайте
  • до 4 часовдлина одной записи — аудио или видео
  • 15 языковрусский, английский и другие — или автоопределение
  • серверы в РФзвук удаляется сразу, текст — через 24 часа

Как это работает

  1. Выберите файлГолосовое, диктофон, созвон из Zoom или Телемоста, запись экрана или выступления. Регистрация не нужна.
  2. Браузер достаёт звукИз видео на гигабайт получается несколько мегабайт звука — загрузка занимает секунды даже с телефона.
  3. Получите текстЧерез минуту-две — готовый текст по спикерам. Скопируйте одной кнопкой или скачайте TXT.

Для чего подходит

Длинные голосовые

Прочитать, когда нельзя слушать: на встрече, в транспорте, ночью.

Созвоны и интервью

Текст с репликами каждого участника — удобно найти, кто что обещал.

Записи экрана и выступлений

Демо продукта, вебинар, доклад — текст для статьи, поста или инструкции.

Лекции и уроки

Текст с временем каждого фрагмента — перечитать перед экзаменом и отправить однокурсникам.

Сколько стоит

Первые 3 минуты каждой записи — бесплатно, без регистрации: оцените качество до оплаты. Каждая следующая минута — 2 ₽, минимальный платёж — 20 ₽. Без подписки — платите только за нужный файл. Оплата картой или через Яндекс Пэй, чек самозанятого придёт на почту.

ЗаписьДлительностьСтоимость
Голосовое сообщениедо 3 минбесплатно
Короткий созвон10 мин20 ₽
Интервью, встреча30 мин54 ₽
Лекция, вебинар1 час114 ₽
Конференция2 часа234 ₽

Стоимость = (минуты записи − 3) × 2 ₽, но не меньше 20 ₽. НДС не облагается. Условия, сроки и возврат — в публичной оферте. Исполнитель — Бурмистров Дмитрий Игоревич (самозанятый), ИНН 503225203665.

Частые вопросы

Есть ли ограничение по размеру файла?

Длительность — до 4 часов. Размер для аудио не критичен: перед отправкой звук сжимается в браузере.

Нужно ли переводить M4A или OGG в MP3?

Нет: M4A, OGG, OPUS, WAV и AAC загружаются как есть. Лишнее перекодирование только немного ухудшает звук.

MP3 в низком качестве распознается?

Обычно да: для речи хватает и сжатого звука. Сильнее качества файла на результат влияют шум, музыка и расстояние до микрофона.

Как выбрать аудиофайл на телефоне?

Нажмите на поле загрузки и выберите «Файлы» (на iPhone) или «Аудио» / «Загрузки» (на Android). Если файла не видно, сохраните его туда через «Поделиться».

Сколько это стоит?

Первые 3 минуты любой записи — бесплатно, без регистрации. Каждая следующая минута — 2 ₽, минимальный платёж — 20 ₽. Часовая запись стоит 114 ₽. Без подписки: платите только за нужный файл.

Какие файлы можно загрузить?

Голосовые из Telegram, MAX и WhatsApp (OGG, OPUS), записи диктофона (M4A, MP3, WAV, AAC), видео и записи экрана (MP4, MOV, WEBM) — до 4 часов. Из видео берётся только звук.

Куда попадают мои файлы?

Видео не покидает ваше устройство: звук извлекается прямо в браузере. На расшифровку отправляется только звук — на серверы в России. Звук удаляется сразу после расшифровки, текст — через 24 часа. Записи не используются для обучения моделей.

Насколько точно распознаётся речь?

На чистой записи — почти без ошибок. Хуже — шум, музыка, одновременная речь, редкие имена и термины. Поэтому рядом с готовым текстом есть исходная расшифровка: по ней удобно сверить имена и цифры.