Transcrição
O áudio é enviado para reconhecimento na nuvem (esta etapa envia o áudio), com identificação de locutores e marcações de tempo; áudios longos são reconhecidos em trechos de 10 minutos, com resultados aparecendo aos poucos. Depois, você pode apagar palavras na transcrição para cortar o áudio correspondente e exportar em TXT, SRT, VTT, Markdown, JSON, CSV ou LRC.
Edição com o assistente de IA
Abra o assistente de IA no editor e diga “encurte todas as pausas para 0,5 segundo”, “apague todos os hã e é” ou “reduza pela metade o volume do segundo clipe”. Ele lê e escreve sua linha do tempo (faixas, clipes, volume, fades, velocidade, equalização, marcadores) e sua transcrição; edições que alteram o áudio aparecem primeiro em pré-visualização e só são aplicadas depois que você confirma, e cada passo pode ser desfeito. Ele não aplica redução de ruído, remoção de reverberação nem normalização de loudness, e não gera novas vozes.
O que não é IA
Redução de ruído (gate espectral), realce de voz (redução de ruído + remoção de reverberação + compressão + limitador), remoção de zumbido, normalização de loudness (ITU-R BS.1770), detecção de silêncio, detecção de BPM, remoção de voz (cancelamento do canal central) e todos os efeitos são algoritmos tradicionais que rodam no seu navegador, sem envio.
Quais modelos
O TutuAudio não desenvolve modelos; o TutuAgent conecta modelos de reconhecimento de fala e de linguagem de primeira linha e os atualiza continuamente.
- A IA pode estragar meu áudio?
- Edições que alteram o áudio aparecem primeiro em pré-visualização e só são aplicadas depois que você confirma, e cada passo pode ser desfeito.
- Preciso fazer login ou pagar?
- Não. Os dois recursos de IA têm uma cota gratuita diária medida pelo TutuAgent.
- Meu áudio é usado para treinar modelos?
- O TutuAudio não treina modelos. Na transcrição, o áudio é enviado ao serviço de reconhecimento ao qual o TutuAgent se conecta.