Расшифровка
Аудио загружается для распознавания в облаке (на этом шаге аудио загружается), с разметкой дикторов и таймкодами; длинные записи распознаются фрагментами по 10 минут, результаты появляются постепенно. Затем можно удалять слова в расшифровке, чтобы вырезать соответствующее аудио, и экспортировать в TXT, SRT, VTT, Markdown, JSON, CSV или LRC.
Монтаж с ИИ-ассистентом
Откройте ИИ-ассистента в редакторе и скажите: «сократи все паузы до 0,5 секунды», «удали все э-э и м-м» или «уменьши громкость второго клипа вдвое». Он читает и изменяет вашу дорожку времени (дорожки, клипы, громкость, фейды, скорость, эквалайзер, маркеры) и расшифровку; правки, меняющие аудио, сначала показываются в предпросмотре и применяются только после вашего подтверждения, а любой шаг можно отменить. Он не выполняет шумоподавление, удаление реверберации или нормализацию громкости и не генерирует новые голоса.
Что не является ИИ
Шумоподавление (спектральный гейт), улучшение голоса (шумоподавление + удаление реверберации + компрессия + лимитер), удаление фона сети, нормализация громкости (ITU-R BS.1770), поиск тишины, определение BPM, удаление вокала (подавление центрального канала) и все эффекты — это классические алгоритмы, которые работают в вашем браузере без загрузки.
Какие модели
TutuAudio не создаёт собственных моделей; TutuAgent подключает ведущие модели распознавания речи и языковые модели и постоянно их обновляет.
- ИИ не испортит моё аудио?
- Правки, меняющие аудио, сначала показываются в предпросмотре и применяются только после вашего подтверждения, а любой шаг можно отменить.
- Нужно входить в аккаунт или платить?
- Нет. Обе ИИ-функции включают ежедневный бесплатный лимит, который учитывает TutuAgent.
- Используется ли моё аудио для обучения моделей?
- TutuAudio не обучает модели. При расшифровке аудио отправляется в сервис распознавания, к которому подключается TutuAgent.