图图音频

오디오를 텍스트로 · 화자와 타임스탬프 포함

TutuAudio는 녹음을 클라우드에 업로드해 음성을 인식합니다(이 단계는 업로드가 필요합니다). 화자를 구분하고 타임스탬프를 붙이며, 긴 오디오는 10분 단위로 나눠 처리해 완성된 부분부터 보여 줍니다. TXT, SRT, VTT, Markdown, JSON, CSV, LRC로 내보낼 수 있습니다. 로그인 없이 쓰며, TutuAgent가 관리하는 일일 무료 사용량이 있습니다. 영상 자막은 만들지 않습니다(TutuCut 이용).

녹음하기

MP3, WAV, M4A, AAC, FLAC, OGG, WebM 및 MP4 동영상의 소리 지원

텍스트 변환 단계에서는 오디오를 클라우드에 업로드합니다. 편집과 효과는 여전히 브라우저에서 처리됩니다

녹음을 넣으면 누가 몇 초에 말했는지까지 표시된 텍스트가 차례로 나옵니다.

사용 방법

  1. 1

    녹음을 페이지에 끌어다 놓거나 "파일 선택"을 누르세요

  2. 2

    오디오가 업로드되어 인식되고 텍스트가 구간별로 나옵니다

  3. 3

    확인한 뒤 TXT, SRT 등으로 내보내세요

자주 묻는 질문

무료인가요? 가입해야 하나요?
가입은 필요 없습니다. TutuAgent가 관리하는 일일 무료 사용량이 있으며, 다 쓰면 다음 날 다시 쓸 수 있습니다.
녹음이 업로드되나요?
네. 인식하려면 오디오를 클라우드에 업로드해야 합니다. 이후 편집, 텍스트 삭제, 내보내기는 브라우저에서 이뤄지며 다시 업로드하지 않습니다.
1시간짜리 회의도 되나요?
됩니다. 긴 오디오는 10분 단위로 차례로 인식되며, 나머지를 처리하는 동안 앞부분을 먼저 볼 수 있습니다.
정확한가요?
또렷한 목소리라면 잘 됩니다. 억양이 강한 사투리, 여러 사람이 동시에 말하는 경우, 시끄러운 배경에서는 정확도가 떨어지니 들으면서 확인하세요.
영상에 자막을 넣을 수 있나요?
이 페이지는 오디오 전용이지만 SRT, VTT 파일은 내보낼 수 있습니다. 영상에 바로 자막을 넣으려면 TutuCut을 이용하세요.

이 오디오로 이어서 하기

비슷한 도구

찾는 게 없나요? 텍스트 음성 변환과 AI 목소리는 TutuSound, 영상 편집과 영상에서 오디오 추출은 TutuCut에서 하세요. 전체 오디오 도구