图图音频

Audio a texto con hablantes y marcas de tiempo

TutuAudio sube tu grabación a la nube para reconocer el habla (este paso requiere subirla), distingue a los hablantes y añade marcas de tiempo. El audio largo se procesa en bloques de 10 minutos y el texto va apareciendo. Exporta TXT, SRT, VTT, Markdown, JSON, CSV o LRC. Sin iniciar sesión, con una cuota gratuita diaria que gestiona TutuAgent. No crea subtítulos de vídeo: para eso usa TutuCut.

Grabar

MP3, WAV, M4A, AAC, FLAC, OGG, WebM y el audio de vídeos MP4

La transcripción sube el audio a la nube; la edición y los efectos siguen en tu navegador

Sube una grabación y el texto sale por partes, indicando quién habla y en qué segundo.

Cómo funciona

  1. 1

    Arrastra la grabación a la página o pulsa «Elegir archivo»

  2. 2

    El audio se sube para reconocerlo y el texto aparece bloque a bloque

  3. 3

    Revísalo y exporta en TXT, SRT u otro formato

Preguntas frecuentes

¿Es gratis? ¿Tengo que registrarme?
No hace falta cuenta. Hay una cuota gratuita diaria que gestiona TutuAgent; si se agota, vuelve al día siguiente.
¿Se sube mi grabación?
Sí. Para reconocer el habla hay que subir el audio a la nube. Editar, borrar texto y exportar después se hace en tu navegador sin volver a subir nada.
¿Puede con una reunión de una hora?
Sí. El audio largo se reconoce en bloques de 10 minutos, uno tras otro, y ves el texto inicial mientras se procesa el resto.
¿Es preciso?
Con voz clara funciona bien. Los acentos muy marcados, varias personas hablando a la vez o mucho ruido de fondo bajan la precisión; conviene repasarlo escuchando.
¿Sirve para subtitular un vídeo?
Esta página solo trabaja con audio, pero puedes exportar SRT o VTT. Para subtitular un vídeo directamente, usa TutuCut.

Sigue trabajando con este audio

Herramientas similares

¿No está aquí? Para texto a voz y voces con IA usa TutuSound; para editar vídeo o extraer el audio de un vídeo usa TutuCut. Todas las herramientas de audio