图图音频

图图音频的 AI 能做到什么

真正称为 AI 的只有两项,其余都是在你浏览器里运行的算法。

转文字

音频上传到云端识别(这一步需要上传),自动区分说话人、标出时间戳;长音频按 10 分钟一段依次识别,边转边出。转完可以直接在文稿里删字来剪掉对应的音频,可以导出 TXT、SRT、VTT、Markdown、JSON、CSV、LRC。

AI 助手剪辑

在编辑器里打开 AI 助手,直接说「把所有停顿缩短到 0.5 秒」「删掉所有嗯和啊」「第二段音量减半」。它读写你的时间轴(轨道、片段、音量、淡入淡出、变速、均衡、标记)和文稿;会改动音频的操作先给你预览,确认后才执行,每一步都能撤销。它不执行降噪、去混响、响度统一这类效果,也不生成新的声音。

哪些不是 AI

降噪(频谱门限)、人声增强(降噪 + 去混响 + 压缩 + 限幅)、去电流声、响度统一(ITU-R BS.1770)、静音检测、BPM 检测、人声消除(中置声道消除)和全部效果,都是在你浏览器里运行的传统算法,音频不上传。

用的是什么模型

图图音频不自研模型,由图图智能体接入第一梯队的语音识别和大语言模型,并持续更换。

AI 会不会乱删我的音频?
会改动音频的操作先给你看预览,确认后才执行,每一步都能撤销。
要登录吗?要钱吗?
都不用。两项 AI 每天有免费额度,由图图智能体统一计量。
我的音频会被拿去训练模型吗?
图图音频不训练模型。转文字时音频会发送给图图智能体接入的识别服务完成识别。