Транскрибация на вашем ПК: интервью, совещания, звонки и лекции превращаются в текст с таймкодами и разделением по спикерам. Никаких подписок и лимитов минут.
MP3, WAV, M4A и другое аудио — или сразу видео: MP4, MKV, MOV. Можно поставить несколько файлов в очередь.
Пять моделей точности — от быстрой до максимальной, язык записи, число участников. Есть режим «Мультиязычная»: язык определяется по каждой фразе, а метка спикера пишется на языке записи. Или оставьте «Авто» — программа определит сама.
Word-документы с таймкодами и без, субтитры SRT/VTT. Встроенный плеер — для быстрой сверки текста с записью.
Полный цикл работы с записью — от предварительного прослушивания до готового отредактированного документа. Эти возможности отличают программу от большинства аналогов.
Правьте текст прямо в программе: выделите блок реплик — и он тут же проигрывается. Сверять расшифровку с записью можно не выходя из редактора.
Вставьте ссылку на видео с популярного видеохостинга — программа сама скачает ролик и выдаст расшифровку. Файл вручную сохранять не нужно.
Все обработанные записи хранятся в программе: откройте любую позже, редактируйте текст параллельно с аудио без повторной транскрибации.
Прослушайте запись до обработки, чтобы выбрать нужный файл и настройки. После — клик по любому абзацу переносит к этому моменту звука.
Поставьте в очередь десяток записей — программа расшифрует их одну за другой без вашего участия.
Пунктуация и заглавные буквы восстанавливаются автоматически — отдельной нейросетью, офлайн. Плюс удаление слов-паразитов и словарь замен: термины, имена и названия компаний пишутся правильно во всей расшифровке сразу.
Почему транскрибация аудио в текст на своём ПК выгоднее и безопаснее
Попробуйте 14 дней бесплатно, без карты. Затем — разовая лицензия без подписок, лимитов и ежемесячных списаний. Обновления включены.
Никуда — транскрибация аудио в текст выполняется локально на вашем компьютере, файлы не отправляются на серверы. Это принципиальное отличие от облачных сервисов.
Аудио: MP3, WAV, M4A, FLAC, OGG, WMA, AAC. Видео: MP4, AVI, MKV, MOV, WEBM и другие — звуковая дорожка извлекается автоматически.
Один раз при первом запуске — для загрузки языковой модели (от 145 МБ до 3 ГБ по вашему выбору). Дальше программа полностью офлайн: разделение по спикерам и восстановление пунктуации уже встроены в дистрибутив.
Нейросеть определяет, где говорит каждый участник, и помечает реплики: «Спикер 1», «Спикер 2». В автоматическом режиме программа распознаёт до 5 голосов; если участников больше, укажите их точное число — оно же делает разделение точнее.
Зависит от выбранной модели точности и мощности процессора. На современном многоядерном ПК модель «Хорошая (small)» расшифровывает быстрее записи: 10 минут — примерно за 3 минуты, час — примерно за 20 минут. Самая точная модель large-v3 работает медленнее записи, зато даёт максимальную точность слов. Видеокарта не нужна — вся обработка идёт на процессоре.
Программа попросит ввести лицензионный ключ. Все файлы и готовые расшифровки останутся на месте. Лицензия — разовая покупка, без подписки.
14 дней полной версии бесплатно, без банковской карты. Скачайте, перетащите файл — и получите текст.
Скачать для Windows Установка без прав администратора · ~390 МБ