Transcripción
El audio se sube para reconocerlo en la nube (este paso sí sube el audio), con etiquetas de hablante y marcas de tiempo; el audio largo se reconoce en tramos de 10 minutos y los resultados van apareciendo. Después puedes borrar palabras en la transcripción para cortar el audio correspondiente y exportar en TXT, SRT, VTT, Markdown, JSON, CSV o LRC.
Edición con el asistente de IA
Abre el asistente de IA en el editor y di “acorta todas las pausas a 0,5 segundos”, “borra todos los eh y mm” o “baja a la mitad el volumen del segundo clip”. Lee y escribe tu línea de tiempo (pistas, clips, volumen, fundidos, velocidad, ecualización, marcadores) y tu transcripción; las ediciones que cambian el audio se muestran primero en vista previa y solo se aplican cuando confirmas, y cada paso se puede deshacer. No aplica reducción de ruido, eliminación de reverberación ni normalización de sonoridad, y no genera voces nuevas.
Qué no es IA
La reducción de ruido (puerta espectral), el potenciador de voz (reducción de ruido + eliminación de reverberación + compresión + limitador), la eliminación de zumbido, la normalización de sonoridad (ITU-R BS.1770), la detección de silencios, la detección de BPM, la eliminación de voz (cancelación del canal central) y todos los efectos son algoritmos tradicionales que se ejecutan en tu navegador sin subir nada.
Qué modelos usa
TutuAudio no desarrolla modelos; TutuAgent conecta modelos de reconocimiento de voz y de lenguaje de primer nivel y los va actualizando.
- ¿La IA puede estropear mi audio?
- Las ediciones que cambian el audio se muestran primero en vista previa y solo se aplican cuando confirmas, y cada paso se puede deshacer.
- ¿Tengo que iniciar sesión o pagar?
- No. Ambas funciones de IA incluyen una cuota gratuita diaria que mide TutuAgent.
- ¿Se usa mi audio para entrenar modelos?
- TutuAudio no entrena modelos. Para la transcripción, el audio se envía al servicio de reconocimiento al que se conecta TutuAgent.