图图音频

Что умеет ИИ в TutuAudio

ИИ — это только две вещи; всё остальное — алгоритмы, работающие в вашем браузере.

Расшифровка

Аудио загружается для распознавания в облаке (на этом шаге аудио загружается), с разметкой дикторов и таймкодами; длинные записи распознаются фрагментами по 10 минут, результаты появляются постепенно. Затем можно удалять слова в расшифровке, чтобы вырезать соответствующее аудио, и экспортировать в TXT, SRT, VTT, Markdown, JSON, CSV или LRC.

Монтаж с ИИ-ассистентом

Откройте ИИ-ассистента в редакторе и скажите: «сократи все паузы до 0,5 секунды», «удали все э-э и м-м» или «уменьши громкость второго клипа вдвое». Он читает и изменяет вашу дорожку времени (дорожки, клипы, громкость, фейды, скорость, эквалайзер, маркеры) и расшифровку; правки, меняющие аудио, сначала показываются в предпросмотре и применяются только после вашего подтверждения, а любой шаг можно отменить. Он не выполняет шумоподавление, удаление реверберации или нормализацию громкости и не генерирует новые голоса.

Что не является ИИ

Шумоподавление (спектральный гейт), улучшение голоса (шумоподавление + удаление реверберации + компрессия + лимитер), удаление фона сети, нормализация громкости (ITU-R BS.1770), поиск тишины, определение BPM, удаление вокала (подавление центрального канала) и все эффекты — это классические алгоритмы, которые работают в вашем браузере без загрузки.

Какие модели

TutuAudio не создаёт собственных моделей; TutuAgent подключает ведущие модели распознавания речи и языковые модели и постоянно их обновляет.

ИИ не испортит моё аудио?
Правки, меняющие аудио, сначала показываются в предпросмотре и применяются только после вашего подтверждения, а любой шаг можно отменить.
Нужно входить в аккаунт или платить?
Нет. Обе ИИ-функции включают ежедневный бесплатный лимит, который учитывает TutuAgent.
Используется ли моё аудио для обучения моделей?
TutuAudio не обучает модели. При расшифровке аудио отправляется в сервис распознавания, к которому подключается TutuAgent.