ElevenLabs Audio Isolation:从嘈杂录音中提取清晰人声
ElevenLabs Audio Isolation 一步去除人声中的背景噪音。它能修什么、修不了什么,以及如何准备文件让结果听起来自然。
阅读约 1 分钟

在马路边录的采访。开着风扇录的语音备忘。被风吞掉一半台词的视频。ElevenLabs Audio Isolation 正是为这些准备的:上传录音,它保留人声,去掉周围的声音。没有提示词,也没有设置。这让它成为模型页面上最容易使用、也最容易用错的模型,所以本文主要讲该喂给它什么。
它擅长什么
- 稳定的噪音: 空调、风扇、嗡嗡声、车流声、廉价麦克风的嘶嘶声。
- 嘈杂的场所: 咖啡馆的交谈、身后的办公室、活动现场的人群,只要你的声音最大。
- 风噪和手持摩擦声,常见于手机和相机录音。
- 在配音、加字幕或剪辑之前挽救对白,因为之后的每一步在干净人声上都更顺利。
如何使用
- 打开模型,上传一个音频文件。工作室支持常见格式:MP3、WAV、OGG、M4A 和 FLAC。
- 查看 Generate 按钮上的价格,然后运行。
- 下载处理后的文件,使用前用耳机听一遍,而不是笔记本扬声器。
实用技巧
- 先剪再清理。 剪掉开头结尾的静音和用不上的部分。文件越短越快越省钱,你只为要发布的部分付费。
- 上传你手上最好的版本。 WAV 或高质量原始文件比被聊天软件压缩过的 MP3 保留更多人声。模型只能保留原本就有的东西。
- 混回一点空间感。 完全干的人声听起来像是贴上去的。在剪辑软件里,在处理后的音轨下面铺一层很轻的原声或柔和的音乐,人声就自然了。
- 用最糟的一分钟测试。 处理长录音之前,先截出最吵的一段单独跑。最糟的部分能用,其余也能用。
谁该用别的工具
它是人声的守护者,不是调音台。如果你想保留音乐、只去掉歌手,或把一首歌拆成分轨,请在模型页面找分离类模型。如果无声片段需要新的声音,视频转声音或文字转音效的模型才是合适的工具。至于生成的片段,如今很多视频模型会在同一次生成中写出自己的声音;视频模型选择指南介绍了哪些可以,照片转视频指南说明了它用在哪里。
坦白的局限
被噪音毁掉的东西它无法找回。如果卡车恰好在某个词说出的瞬间驶过,这个词会变薄或缺掉一半,因为它从来没被清楚地录下来。失真也一样:因为麦克风太近而爆音的声音,处理后依然爆音。而且它把一切非人声都当作噪音,播客背景里的吉他会和嗡嗡声一起消失。尽量靠近、干净地录音,把隔离留给无法避免的部分。
常见问题
ElevenLabs Audio Isolation 需要提示词或设置吗?
不需要。它只有一个输入,就是音频文件。上传、查看 Generate 按钮上的价格,然后运行。
可以上传视频文件吗?
不可以,模型只接收音频。把视频的音轨导出为 WAV 或 MP3,清理后在剪辑软件里放回画面下面。
它会去掉背景音乐吗?
会,连同其他所有非人声的声音。如果你想保留音乐,这不是合适的工具。
#音频#模型


