Transkripsi
Audio diunggah untuk dikenali di cloud (langkah ini mengunggah audio), dengan label pembicara dan stempel waktu; audio panjang dikenali per 10 menit secara berurutan dan hasilnya muncul bertahap. Setelah itu, Anda bisa menghapus kata di transkrip untuk memotong audio yang sesuai, dan mengekspor ke TXT, SRT, VTT, Markdown, JSON, CSV, atau LRC.
Mengedit dengan asisten AI
Buka asisten AI di editor dan katakan “persingkat semua jeda menjadi 0,5 detik”, “hapus semua eh dan em”, atau “kecilkan volume klip kedua menjadi setengahnya”. Asisten membaca dan menulis timeline Anda (trek, klip, volume, fade, kecepatan, EQ, penanda) dan transkrip; perubahan yang mengubah audio ditampilkan dulu sebagai pratinjau dan baru diterapkan setelah Anda mengonfirmasi, dan setiap langkah bisa dibatalkan. Asisten tidak menjalankan pengurangan noise, penghapusan gema, atau normalisasi loudness, dan tidak menghasilkan suara baru.
Yang bukan AI
Pengurangan noise (spectral gate), penyempurna suara (pengurangan noise + penghapusan gema + kompresi + limiter), penghapusan dengung, normalisasi loudness (ITU-R BS.1770), deteksi hening, deteksi BPM, penghapusan vokal (pembatalan kanal tengah), dan semua efek adalah algoritme tradisional yang berjalan di browser Anda tanpa unggahan.
Model apa yang dipakai
TutuAudio tidak membangun model sendiri; TutuAgent menghubungkan model pengenalan suara dan model bahasa kelas atas dan terus memperbaruinya.
- Apakah AI bisa merusak audio saya?
- Perubahan yang mengubah audio ditampilkan dulu sebagai pratinjau dan baru diterapkan setelah Anda mengonfirmasi, dan setiap langkah bisa dibatalkan.
- Apakah perlu login atau membayar?
- Tidak. Kedua fitur AI punya kuota gratis harian yang dihitung oleh TutuAgent.
- Apakah audio saya dipakai untuk melatih model?
- TutuAudio tidak melatih model. Untuk transkripsi, audio dikirim ke layanan pengenalan yang terhubung dengan TutuAgent.