图图音频

Chuyển âm thanh thành văn bản, có người nói và mốc thời gian

TutuAudio tải bản ghi âm lên đám mây để nhận dạng giọng nói (bước này cần tải lên), tách người nói và gắn mốc thời gian. Âm thanh dài được xử lý theo từng đoạn 10 phút, văn bản hiện dần. Xuất TXT, SRT, VTT, Markdown, JSON, CSV hoặc LRC. Không cần đăng nhập, có hạn mức miễn phí mỗi ngày do TutuAgent tính. Không làm phụ đề video — hãy dùng TutuCut.

Ghi âm

Hỗ trợ MP3, WAV, M4A, AAC, FLAC, OGG, WebM và âm thanh trong video MP4

Bước chuyển thành văn bản cần tải âm thanh lên đám mây; cắt ghép và hiệu ứng vẫn chạy trong trình duyệt của bạn

Thả bản ghi âm vào, văn bản hiện ra từng đoạn, ghi rõ ai nói và ở giây thứ mấy.

Cách sử dụng

  1. 1

    Kéo bản ghi âm vào trang hoặc bấm "Chọn tệp"

  2. 2

    Âm thanh được tải lên để nhận dạng, văn bản hiện theo từng đoạn

  3. 3

    Kiểm tra lại rồi xuất TXT, SRT hoặc định dạng khác

Câu hỏi thường gặp

Có miễn phí không? Có cần tài khoản không?
Không cần tài khoản. Có hạn mức miễn phí mỗi ngày do TutuAgent tính; dùng hết thì hôm sau dùng tiếp.
Bản ghi âm của tôi có bị tải lên không?
Có. Nhận dạng giọng nói cần tải âm thanh lên đám mây. Việc chỉnh sửa, xóa chữ và xuất file sau đó diễn ra trong trình duyệt, không tải lên lại.
Cuộc họp một tiếng có được không?
Được. Âm thanh dài được nhận dạng lần lượt từng đoạn 10 phút; phần đầu đọc được trong lúc phần còn lại đang xử lý.
Có chính xác không?
Tốt với giọng nói rõ ràng. Giọng địa phương quá nặng, nhiều người nói chen nhau hoặc nền quá ồn sẽ làm giảm độ chính xác; nên nghe lại để kiểm tra.
Có làm phụ đề cho video được không?
Trang này chỉ xử lý âm thanh, nhưng bạn có thể xuất SRT hoặc VTT. Để làm phụ đề trực tiếp trên video, hãy dùng TutuCut.

Tiếp tục với đoạn âm thanh này

Công cụ tương tự

Không có ở đây? Chuyển văn bản thành giọng nói và giọng AI hãy dùng TutuSound; chỉnh sửa video hoặc tách âm thanh từ video hãy dùng TutuCut. Tất cả công cụ âm thanh