图图音频

AI ใน TutuAudio ทำอะไรได้บ้าง

ที่เป็น AI จริง ๆ มีแค่สองอย่าง ที่เหลือเป็นอัลกอริทึมที่ทำงานในเบราว์เซอร์ของคุณ

ถอดเสียงเป็นข้อความ

เสียงจะถูกอัปโหลดไปจดจำบนคลาวด์ (ขั้นตอนนี้มีการอัปโหลด) พร้อมแยกผู้พูดและประทับเวลา เสียงที่ยาวจะถูกจดจำทีละ 10 นาทีตามลำดับ และแสดงผลทยอยออกมา เมื่อเสร็จแล้วคุณลบคำในบทถอดเสียงเพื่อตัดเสียงส่วนที่ตรงกันได้ และส่งออกเป็น TXT, SRT, VTT, Markdown, JSON, CSV หรือ LRC

ตัดต่อด้วยผู้ช่วย AI

เปิดผู้ช่วย AI ในเอดิเตอร์แล้วพูดว่า “ย่อช่วงเงียบทั้งหมดให้เหลือ 0.5 วินาที” “ลบคำว่า เอ่อ กับ อืม ทั้งหมด” หรือ “ลดเสียงคลิปที่สองลงครึ่งหนึ่ง” ผู้ช่วยจะอ่านและเขียนไทม์ไลน์ (แทร็ก คลิป ระดับเสียง เฟด ความเร็ว EQ มาร์กเกอร์) และบทถอดเสียงของคุณ การแก้ไขที่เปลี่ยนเสียงจะแสดงตัวอย่างก่อน และจะทำจริงหลังคุณยืนยันเท่านั้น ทุกขั้นตอนเลิกทำได้ ผู้ช่วยไม่ทำการลดเสียงรบกวน การลดเสียงก้อง หรือการปรับความดังให้เท่ากัน และไม่สร้างเสียงพูดใหม่

อะไรที่ไม่ใช่ AI

การลดเสียงรบกวน (spectral gate) การปรับเสียงพูดให้ชัด (ลดเสียงรบกวน + ลดเสียงก้อง + คอมเพรสเซอร์ + ลิมิตเตอร์) การลบเสียงฮัม การปรับความดังให้เท่ากัน (ITU-R BS.1770) การตรวจจับช่วงเงียบ การตรวจจับ BPM การลบเสียงร้อง (หักล้างช่องสัญญาณกลาง) และเอฟเฟกต์ทั้งหมด เป็นอัลกอริทึมแบบดั้งเดิมที่ทำงานในเบราว์เซอร์ของคุณโดยไม่อัปโหลด

ใช้โมเดลอะไร

TutuAudio ไม่ได้พัฒนาโมเดลเอง TutuAgent เป็นผู้เชื่อมต่อโมเดลรู้จำเสียงพูดและโมเดลภาษาชั้นนำ และอัปเดตอย่างต่อเนื่อง

AI จะลบเสียงของฉันมั่วหรือเปล่า?
การแก้ไขที่เปลี่ยนเสียงจะแสดงตัวอย่างก่อน และจะทำจริงหลังคุณยืนยันเท่านั้น ทุกขั้นตอนเลิกทำได้
ต้องเข้าสู่ระบบหรือจ่ายเงินไหม?
ไม่ต้อง ฟีเจอร์ AI ทั้งสองมีโควตาฟรีรายวัน ซึ่ง TutuAgent เป็นผู้นับ
เสียงของฉันจะถูกนำไปฝึกโมเดลไหม?
TutuAudio ไม่ฝึกโมเดล เมื่อถอดเสียง เสียงจะถูกส่งไปยังบริการรู้จำเสียงที่ TutuAgent เชื่อมต่ออยู่