轉文字
音訊上傳到雲端辨識(這一步需要上傳),自動區分說話者、標出時間戳記;長音訊依 10 分鐘一段依序辨識,邊轉邊出。轉完可以直接在文稿裡刪字來剪掉對應的音訊,可以匯出 TXT、SRT、VTT、Markdown、JSON、CSV、LRC。
AI 助理剪輯
在編輯器裡打開 AI 助理,直接說「把所有停頓縮短到 0.5 秒」「刪掉所有嗯和啊」「第二段音量減半」。它讀寫你的時間軸(音軌、片段、音量、淡入淡出、變速、等化、標記)和文稿;會改動音訊的操作先給你預覽,確認後才執行,每一步都能復原。它不執行降噪、去殘響、響度統一這類效果,也不生成新的聲音。
哪些不是 AI
降噪(頻譜門限)、人聲增強(降噪 + 去殘響 + 壓縮 + 限幅)、去電流聲、響度統一(ITU-R BS.1770)、靜音偵測、BPM 偵測、人聲消除(中置聲道消除)和全部效果,都是在你瀏覽器裡執行的傳統演算法,音訊不上傳。
用的是什麼模型
圖圖音頻不自行研發模型,由圖圖智能體串接第一梯隊的語音辨識和大型語言模型,並持續更新。
- AI 會不會亂刪我的音訊?
- 會改動音訊的操作先給你看預覽,確認後才執行,每一步都能復原。
- 要登入嗎?要付費嗎?
- 都不用。兩項 AI 每天有免費額度,由圖圖智能體統一計量。
- 我的音訊會被拿去訓練模型嗎?
- 圖圖音頻不訓練模型。轉文字時音訊會傳送給圖圖智能體串接的辨識服務完成辨識。