转文字
音频上传到云端识别(这一步需要上传),自动区分说话人、标出时间戳;长音频按 10 分钟一段依次识别,边转边出。转完可以直接在文稿里删字来剪掉对应的音频,可以导出 TXT、SRT、VTT、Markdown、JSON、CSV、LRC。
AI 助手剪辑
在编辑器里打开 AI 助手,直接说「把所有停顿缩短到 0.5 秒」「删掉所有嗯和啊」「第二段音量减半」。它读写你的时间轴(轨道、片段、音量、淡入淡出、变速、均衡、标记)和文稿;会改动音频的操作先给你预览,确认后才执行,每一步都能撤销。它不执行降噪、去混响、响度统一这类效果,也不生成新的声音。
哪些不是 AI
降噪(频谱门限)、人声增强(降噪 + 去混响 + 压缩 + 限幅)、去电流声、响度统一(ITU-R BS.1770)、静音检测、BPM 检测、人声消除(中置声道消除)和全部效果,都是在你浏览器里运行的传统算法,音频不上传。
用的是什么模型
图图音频不自研模型,由图图智能体接入第一梯队的语音识别和大语言模型,并持续更换。
- AI 会不会乱删我的音频?
- 会改动音频的操作先给你看预览,确认后才执行,每一步都能撤销。
- 要登录吗?要钱吗?
- 都不用。两项 AI 每天有免费额度,由图图智能体统一计量。
- 我的音频会被拿去训练模型吗?
- 图图音频不训练模型。转文字时音频会发送给图图智能体接入的识别服务完成识别。