跳到主要内容

应用场景

播客与访谈:理顺人声,按文稿切片

多机位画面和各路录音先在同一条多轨时间线上对齐,人声分离配合频谱降噪把底噪压下去,响度统一之后再按文稿挑高光片段,音频与字幕一起交付。

播客与访谈场景里的 ChatCut Online 界面

工作流

四步做完

每一步都落在真实的多轨时间线上,随时可以停下来自己接着改。

  1. 01

    多轨导入对齐

    把多机位画面和各路录音一起导入,MP3、WAV、M4A 都能直接用,在同一条真实的多轨时间线上对齐。

  2. 02

    清理人声

    人声分离配合频谱降噪压掉空调声这类持续底噪,再把各轨响度统一,铺在人声下面的背景声自动闪避。

  3. 03

    按文稿挑高光

    通读逐字文稿,删掉卡壳、跑题和重复的段落,再把值得单发的部分切成独立片段。

  4. 04

    导出音频与字幕

    整期导出独立音频,切片导出 MP4,字幕另存 SRT / TXT,一次交给音频平台和视频平台。

示例指令

试着这么跟它说

把这两轨人声的响度统一,底噪压掉
删掉所有卡壳和重复的开头,句子保持完整
找出聊「选题怎么定」的那一段,单独切成一条片段

交付

你会拿到什么

整期音频
独立音频导出,各轨响度已经统一
视频切片
MP4(最高 4K),字幕可烧录进画面
文字稿与字幕
SRT / TXT 字幕,兼作节目文稿与平台上传素材

常见问题

多路录音怎么对齐?

把各路音频和画面一起导入同一条多轨时间线,摆好轨道后逐条对齐。时间线是真实可编辑的,手动微调和对话指令可以混着来。

底噪很大的采访能救回来吗?

可以先做人声分离,把人声和环境声拆开,再用频谱降噪压掉持续底噪,最后统一响度。录得过糊的素材仍然有极限,建议先处理一段试听再决定。

能自动标出每个人各说了哪几段吗?

这一项目前不做。转写给到的是一份连续的逐字稿,需要区分角色时可以自己在文稿里标注,或者把各人的录音分轨处理。

只有音频、没有画面也能用吗?

能。导入 MP3、WAV、M4A 就可以转写和剪辑,最后导出独立音频与 SRT / TXT 字幕;之后想发视频平台,再回到同一条工程补画面。