Перейти к основному содержимому
Онлайн-транскрибация аудио и видео

WAV в текст — расшифровка несжатого звука

Студийные и диктофонные WAV-записи распознаются с максимальной точностью: PCM без потерь отдаёт модели самый чистый исходник речи.

Попробуйте прямо сейчас 30 минут бесплатно, карта не нужна*
Запись Микрофон

Передача по HTTPS · файлы удаляются после обработки

Для большого файла время загрузки и обработки зависит от его длительности, размера и текущей нагрузки
Модель определит язык автоматически. Для коротких файлов (<30 сек) лучше выбрать язык вручную.
Поддерживаются YouTube, VK Видео, RuTube, Vimeo и прямые публичные ссылки на медиафайлы
Поддерживаемые платформы:
YouTube VK Видео RuTube Vimeo
Также можно проверить прямую публичную ссылку на медиафайл
Модель определит язык автоматически. Для коротких файлов (<30 сек) лучше выбрать язык вручную.

Результат

AI-отчёт по записи
Загружаю форматы…
Отчёт оборвался на середине — запись слишком длинная для одного ответа модели. Нажмите формат ещё раз или возьмите «Кратко».
Остаток: мин

WAV выбирают там, где звук решает: студийная запись подкаста, дорожка с полевого рекордера Zoom H-серии, экспорт из Reaper или Adobe Audition, материалы с профессионального диктофона. Качество зависит от записи. Каждое слово, каждая пауза и интонация доходят до распознавания в том виде, в каком их зафиксировал микрофон.

  • Качество зависит от записи
  • Автоопределение языка
  • TXT, DOCX, SRT, VTT
  • Таймкоды реплик

Обратная сторона качества — вес. Минута стерео 44.1 кГц/16 бит занимает около 10 МБ, час — примерно 600 МБ; студийные 48 кГц/24 бит ещё тяжелее. EdWord принимает файлы до 2 ГБ, так что двух-трёхчасовая сессия обычно проходит одним куском. Для более длинных исходников достаточно пережать WAV во FLAC или MP3 320 kbps — для задачи распознавания речи такая конвертация практически безболезненна, а вес падает в 5-10 раз.

Загрузка стандартная: перетащили файл на edword.ru или отправили небольшой файл в Telegram-бот @mywhisperedbot. Язык определяется автоматически; в веб-интерфейсе также можно вручную выбрать русский, английский, немецкий, французский или испанский. Срок зависит от длительности и нагрузки.

Проверьте стартовый баланс после входа: на знакомство с WAV-расшифровкой может открыться до 30 минут. Дальше пакеты: 390 ₽ за час, 990 ₽ за три, 2 990 ₽ за десять. Купленные минуты не сгорают. WAV избегает дополнительного сжатия звука, но качество расшифровки всё равно зависит от микрофона, шума и разборчивости речи.

Как перевести в текст

1

Загрузите файл

Перетащите файл на сайт или отправьте в Telegram-бот @mywhisperedbot

2

Нейросеть распознаёт речь

Модель распознавания обработает запись, расставит знаки препинания и разделит текст на абзацы

3

Скачайте текст

Скопируйте результат или скачайте в формате TXT. Текст сохранится в личном кабинете

Характеристики формата

КодекPCM (LPCM) без сжатия, также IEEE float
Битрейт705-4608 kbps в зависимости от частоты (44.1-192 кГц) и разрядности (16-32 бит)
Макс. размер файла2 ГБ
Расширения.wav
Типичное применениеСтудийные сессии, полевые рекордеры, профессиональные диктофоны, экспорт из аудиоредакторов

WAV, FLAC и MP3: что загружать, если есть выбор

Правило простое: загружайте формат, в котором запись родилась. WAV с рекордера — отправляйте WAV, пока файл влезает в 2 ГБ. Нужно ужаться — FLAC сохранит сигнал бит-в-бит при вдвое меньшем весе, это лучший компромисс для длинных сессий. MP3 от 128 kbps для распознавания речи тоже полностью рабочий вариант: слышимая разница с оригиналом для модели несущественна. Единственный проигрышный ход — многократное перекодирование: каждый проход через сжатие с потерями добавляет артефакты, и после третьей-четвёртой конвертации точность начинает проседать заметно.

Откуда берутся WAV-файлы и что с ними делать дальше

Полевые рекордеры Zoom, Tascam и Sony пишут WAV по умолчанию — это интервью, репортажи, лекции. Аудиоредакторы экспортируют в WAV мастер-версии подкастов и озвучек. Профессиональные диктофоны в юридической и медицинской практике тоже отдают несжатый звук. Во всех случаях сценарий после расшифровки похож: текст с таймкодами вычитывается, спорные места сверяются с оригиналом по времени, итог уходит в DOCX для документа или в SRT, если запись сопровождает видео. История в кабинете EdWord хранит результаты, так что к сессии месячной давности можно вернуться без повторной обработки.

Конвертер WAV в TXT, Word и субтитры: что получается на выходе

Запрос «WAV в TXT» на практике означает три разных результата, и все три закрываются одной загрузкой. Нужен простой текстовый файл — выгружайте TXT: он открывается на любом устройстве и удобен для вставки в заметки и мессенджеры. Готовите документ — берите DOCX: файл открывается в Word и «Р7-Офис», сохраняет абзацы, а финальную редактуру удобно вести прямо там. Если WAV — это дорожка будущего ролика или подкаст-выпуска с видеоверсией, экспортируйте SRT или VTT: реплики уже привязаны ко времени, останется проверить тайминги в редакторе субтитров. Перед любой выгрузкой текст правится в кабинете — фамилии, термины и цифры стоит пробежать глазами. Установка программ в этой цепочке отсутствует: от загрузки WAV до скачивания готового файла всё происходит в браузере.

Выберите пакет

Без подписки, минуты не сгорают — покупаете разовые пакеты и тратите в своём темпе. Списываем только за реально обработанное аудио.

1 час
390 ₽
6.50 ₽/мин
3 часа
990 ₽
5.50 ₽/мин
−15%
Популярный
10 часов
2 990 ₽
4.98 ₽/мин
−23%
50 часов
12 900 ₽
4.30 ₽/мин
−34%

Удобнее в Telegram? Пакеты минут продаются и в боте: открыть @mywhisperedbot

Частые вопросы

Расшифруется ли WAV, сделанный конвертацией из MP3 или записи звонка?

Да, такой файл обрабатывается как обычный, только чуда от него ждать рано: несжатый контейнер сохраняет ровно то качество, которое было в исходнике, и WAV, собранный из телефонной записи или слабого MP3, звучит так же, как они. Загружайте оригинал в родном формате — результат будет тем же при меньшем весе, а точность определят микрофон, шум и разборчивость речи.

Даёт ли WAV более точную расшифровку, чем MP3?

На практике разница невелика: для распознавания речи хватает и MP3 от 128 kbps. Преимущество WAV проявляется на сложном материале — тихий голос, дальний микрофон, наложения: несжатый сигнал сохраняет нюансы, которые агрессивное сжатие срезает. Если исходник уже записан в WAV, загружайте его как есть; специально переводить MP3 в WAV бессмысленно: утраченное при сжатии качество такая конвертация назад вернуть неспособна.

Мой WAV весит больше 2 ГБ — как его расшифровать?

Пережмите файл во FLAC (сжатие без потерь, минус 40-60% веса) или в MP3 320 kbps — для речи такое сжатие на точности почти не отражается. Годится любой бесплатный инструмент: Audacity, fre:ac, ffmpeg. Второй вариант — разрезать запись на части по 2-3 часа и загрузить их по очереди; таймкоды в каждой части пойдут от нуля, это стоит учесть при склейке текста.

Поддерживаются ли студийные WAV 24 бит / 96 кГц?

Да, EdWord принимает WAV с любой стандартной разрядностью и частотой дискретизации — от диктофонных 16 бит/44.1 кГц до студийных 24-32 бит/96-192 кГц. Перед распознаванием сигнал приводится к рабочей частоте модели, так что сверхвысокие параметры на точность текста уже влияния не окажут — зато и вреда от них никакого, качайте оригинал.

Стерео-WAV с двумя дорожками — что произойдёт с каналами?

Каналы смешиваются в моно перед распознаванием, текст получается общий. Если у вас интервью с разведением голосов по каналам (гость слева, ведущий справа), а нужны отдельные стенограммы — выгрузите каждый канал в свой файл в аудиоредакторе и расшифруйте их по отдельности. Автоматического разделения по говорящим в EdWord нет, реплики размечаются вручную при вычитке.

Сколько стоит расшифровка WAV и есть ли бесплатный лимит?

Тарификация идёт по длительности записи: вес WAV-файла на цену никак влияния не оказывает. Для аккаунта может быть доступен стартовый лимит до 30 минут без карты. Дальше пакеты от 390 ₽ за час; крупные объёмы выгоднее — 10 часов стоят 2 990 ₽, 50 часов — 12 900 ₽. Минуты хранятся на балансе бессрочно.

Сколько стоит расшифровка в EdWord?

Расшифровка оплачивается разовыми пакетами: 1 час за 390 ₽ (6.50 ₽/мин), 3 часа за 990 ₽ (5.50 ₽/мин), 10 часов за 2 990 ₽ (4.98 ₽/мин). Для команд и компаний — пакеты до 100 часов от 9 900 ₽. Подписки нет: купленные минуты не сгорают и списываются только за реально обработанное аудио.

Какая точность распознавания?

Качество зависит от исходной записи: фонового шума, расстояния до микрофона, разборчивости речи и одновременных реплик. Проверьте результат на своём файле и вычитайте имена, числа и профессиональные термины. Язык определяется автоматически; также можно выбрать русский, английский, немецкий, французский или испанский.

Безопасно ли загружать файлы в EdWord?

Файлы передаются по HTTPS. Для распознавания медиа передаётся внешнему STT-провайдеру, описанному в Политике конфиденциальности. Временная копия на сервере EdWord автоматически удаляется после завершения обработки, а текст хранится в личном кабинете, пока вы не удалите его.

Есть ли ограничения по длительности или размеру?

Максимальный размер файла — 2 ГБ, максимальная длительность одной записи — 3 часа. Этого хватает на большинство совещаний, интервью, лекций и подкастов. Более длинную запись разбейте на части перед загрузкой.

Можно попробовать бесплатно?

Если аккаунту доступен стартовый лимит, после регистрации появится до 30 минут — этого хватает, чтобы проверить качество на своей записи. Карта не нужна. Быстрее всего начать в Telegram-боте: открыть @mywhisperedbot.

Загрузите запись прямо здесь

Текст придёт с таймкодами и выгрузится в DOCX, SRT или TXT. Новым пользователям — 30 бесплатных минут, карта не нужна.*

Поддержка

Если что-то не работает или есть вопрос — пишите напрямую.