图图音频

圖圖音頻的 AI 能做到什麼

真正稱為 AI 的只有兩項,其餘都是在你瀏覽器裡執行的演算法。

轉文字

音訊上傳到雲端辨識(這一步需要上傳),自動區分說話者、標出時間戳記;長音訊依 10 分鐘一段依序辨識,邊轉邊出。轉完可以直接在文稿裡刪字來剪掉對應的音訊,可以匯出 TXT、SRT、VTT、Markdown、JSON、CSV、LRC。

AI 助理剪輯

在編輯器裡打開 AI 助理,直接說「把所有停頓縮短到 0.5 秒」「刪掉所有嗯和啊」「第二段音量減半」。它讀寫你的時間軸(音軌、片段、音量、淡入淡出、變速、等化、標記)和文稿;會改動音訊的操作先給你預覽,確認後才執行,每一步都能復原。它不執行降噪、去殘響、響度統一這類效果,也不生成新的聲音。

哪些不是 AI

降噪(頻譜門限)、人聲增強(降噪 + 去殘響 + 壓縮 + 限幅)、去電流聲、響度統一(ITU-R BS.1770)、靜音偵測、BPM 偵測、人聲消除(中置聲道消除)和全部效果,都是在你瀏覽器裡執行的傳統演算法,音訊不上傳。

用的是什麼模型

圖圖音頻不自行研發模型,由圖圖智能體串接第一梯隊的語音辨識和大型語言模型,並持續更新。

AI 會不會亂刪我的音訊?
會改動音訊的操作先給你看預覽,確認後才執行,每一步都能復原。
要登入嗎?要付費嗎?
都不用。兩項 AI 每天有免費額度,由圖圖智能體統一計量。
我的音訊會被拿去訓練模型嗎?
圖圖音頻不訓練模型。轉文字時音訊會傳送給圖圖智能體串接的辨識服務完成辨識。