БЕСПЛАТНЫЙ ИНСТРУМЕНТ · НА ВАШЕМ УСТРОЙСТВЕ
Расшифровать аудио и видео в текст бесплатно
Преобразуйте речь из аудио или видео в текст: голосовую заметку, интервью, лекцию или эпизод подкаста. Whisper выполняет расшифровку на вашем устройстве; проверьте текст, скопируйте или скачайте в TXT (с абзацами или временными метками) либо SRT.
- Бесплатно, нужен бесплатный аккаунт
- TXT и SRT
- Ваше аудио не покидает устройство
- Добавить аудио или видео
- Расшифровать
- Проверить и скачать
КАК ИСПОЛЬЗОВАТЬ
Три шага.
Добавить аудио или видео
MP3, WAV, M4A, OGG, MP4, WebM или MOV с речью до 10 минут. Выберите язык: испанский, английский или автоопределение.
Расшифровать
Нажмите «Преобразовать речь в текст». При первом запуске загрузится модель; затем на современном компьютере обработка занимает примерно столько же времени, сколько длится аудио.
Проверить и скачать
Исправьте текст, скопируйте или скачайте TXT с абзацами или отметками времени, а также SRT по предложениям.
СЛЕДУЮЩИЙ ШАГ
Продолжайте с этими инструментами
Расшифровать в текст: частые вопросы
Насколько точна расшифровка?
При чёткой речи и небольшом шуме большинство слов обычно распознаётся правильно. Возможны ошибки в именах, при фоновой музыке, сильном акценте или перекрывающихся голосах; говорящие не различаются. Проверьте текст перед использованием.
Работает ли это с голосовыми сообщениями WhatsApp?
Да, если браузер воспроизводит файл (голосовые сообщения обычно имеют формат OGG или OPUS, которые читают Chrome, Edge и Firefox). Сохраните его на устройство и добавьте сюда.
Что делать, если аудио длиннее 10 минут?
Разделите файл на части до 10 минут и расшифруйте их по очереди. Аудио длительностью до 15 минут можно обрезать здесь нашим инструментом для MP3; видео или более длинное аудио обрежьте в галерее телефона или своём редакторе — инструмент «Обрезать видео» тоже ограничен 10 минутами. Этот лимит помогает работать и на телефонах.
Что распознаёт речь?
Whisper (модель распознавания речи OpenAI, веса по лицензии MIT) работает через transformers.js (лицензия Apache 2.0) в браузере; эту же модель использует инструмент «Автосубтитры». При первом запуске загружается модель (около 77 MB в режиме «Обычный» и около 250 MB в режиме «Высокий»), и браузер сохраняет её.
Отправляется ли моё аудио на сервер?
Нет. Аудио читается и расшифровывается в браузере без отправки в Cocuyo или третьим лицам. Только речевая модель один раз скачивается с наших серверов.
Это действительно бесплатно?
Да. Попробовать его можно до регистрации; чтобы продолжить им пользоваться, мы попросим бесплатный аккаунт, без подписки. Он не расходует ни кредиты, ни ваши 30 приветственных использований: ограничений по числу использований нет.
Каковы ограничения?
Один аудио- или видеофайл до 300 МБ и 10 минут, который воспроизводится в браузере. Расшифровка идёт на устройстве: на телефоне может занимать намного больше времени, чем на компьютере.
Узнайте, как…
ДРУГИЕ БЕСПЛАТНЫЕ ИНСТРУМЕНТЫ
Другие инструменты аудио
Все бесплатные инструменты
КОГДА ХОТИТЕ СОЗДАВАТЬ
Создавайте голоса и озвучку с ИИ.
Студия Cocuyo объединяет более 30 моделей ИИ для изображений, видео и голоса. Стоимость в кредитах видна перед созданием, а срок действия кредитов не ограничен.