Загрузите трек или голос (MP3/WAV) — получите текст: слова песни, речь, диалог. Русский и десятки языков. Всё считается прямо в браузере, файл не загружается на сервер.
🎁 Текст распознали — доведите его до релиза Lyrics Doctor разберёт текст по рифме и структуре и перепишет в стиле артиста. Открыть →💡 Первый запуск скачивает модель (~77 МБ, один раз, потом из кэша). Точнее на чистом вокале: сначала выделите дорожку через «Разделить стемы».
Загрузите файл в формате MP3 или WAV, выберите язык (или оставьте «Авто») и нажмите «Распознать текст». Нейросеть Whisper переведёт вокал или речь в текст прямо на вашем устройстве — аудио не уходит на сервер и нигде не хранится. Поддерживаются русский, английский, украинский и десятки других языков.
Удобно снять слова с референса или кавера, проверить, что именно спел сгенерированный трек, подготовить субтитры или собрать датасет лирики. Полученный текст можно сразу доработать: поправить рифму и структуру в Lyrics Doctor или подобрать созвучия в Рифмовнике.
Whisper точнее на чистом вокале без плотного инструментала — сначала выделите вокальную дорожку («Разделить стемы»), а потом распознавайте. На музыке с громким битом возможны ошибки. Короткие фрагменты обрабатываются быстрее целого трека.
Да, полностью бесплатно и без ограничений. Распознавание идёт в вашем браузере.
Нет. Аудио декодируется и распознаётся прямо на устройстве, на сервер не отправляется и не хранится.
Русский, английский, украинский, немецкий, испанский и ещё десятки — модель мультиязычная. Можно оставить «Авто».
На плотном миксе с громкой музыкой распознавание сложнее. Для точности используйте чистый вокал (выделите дорожку через «Разделить стемы»).