音频

ElevenLabs Audio Isolation:从嘈杂录音中提取清晰人声

ElevenLabs Audio Isolation 一步去除人声中的背景噪音。它能修什么、修不了什么,以及如何准备文件让结果听起来自然。

阅读约 1 分钟
暗色地面上一只带紫色边圈的扬声器,四周环绕着发光的紫色光环,边缘有淡淡的灰色雾气

在马路边录的采访。开着风扇录的语音备忘。被风吞掉一半台词的视频。ElevenLabs Audio Isolation 正是为这些准备的:上传录音,它保留人声,去掉周围的声音。没有提示词,也没有设置。这让它成为模型页面上最容易使用、也最容易用错的模型,所以本文主要讲该喂给它什么。

它擅长什么

  • 稳定的噪音: 空调、风扇、嗡嗡声、车流声、廉价麦克风的嘶嘶声。
  • 嘈杂的场所: 咖啡馆的交谈、身后的办公室、活动现场的人群,只要你的声音最大。
  • 风噪和手持摩擦声,常见于手机和相机录音。
  • 在配音、加字幕或剪辑之前挽救对白,因为之后的每一步在干净人声上都更顺利。

如何使用

  1. 打开模型,上传一个音频文件。工作室支持常见格式:MP3、WAV、OGG、M4A 和 FLAC。
  2. 查看 Generate 按钮上的价格,然后运行。
  3. 下载处理后的文件,使用前用耳机听一遍,而不是笔记本扬声器。

实用技巧

  • 先剪再清理。 剪掉开头结尾的静音和用不上的部分。文件越短越快越省钱,你只为要发布的部分付费。
  • 上传你手上最好的版本。 WAV 或高质量原始文件比被聊天软件压缩过的 MP3 保留更多人声。模型只能保留原本就有的东西。
  • 混回一点空间感。 完全干的人声听起来像是贴上去的。在剪辑软件里,在处理后的音轨下面铺一层很轻的原声或柔和的音乐,人声就自然了。
  • 用最糟的一分钟测试。 处理长录音之前,先截出最吵的一段单独跑。最糟的部分能用,其余也能用。

谁该用别的工具

它是人声的守护者,不是调音台。如果你想保留音乐、只去掉歌手,或把一首歌拆成分轨,请在模型页面找分离类模型。如果无声片段需要新的声音,视频转声音或文字转音效的模型才是合适的工具。至于生成的片段,如今很多视频模型会在同一次生成中写出自己的声音;视频模型选择指南介绍了哪些可以,照片转视频指南说明了它用在哪里。

坦白的局限

被噪音毁掉的东西它无法找回。如果卡车恰好在某个词说出的瞬间驶过,这个词会变薄或缺掉一半,因为它从来没被清楚地录下来。失真也一样:因为麦克风太近而爆音的声音,处理后依然爆音。而且它把一切非人声都当作噪音,播客背景里的吉他会和嗡嗡声一起消失。尽量靠近、干净地录音,把隔离留给无法避免的部分。

常见问题

ElevenLabs Audio Isolation 需要提示词或设置吗?

不需要。它只有一个输入,就是音频文件。上传、查看 Generate 按钮上的价格,然后运行。

可以上传视频文件吗?

不可以,模型只接收音频。把视频的音轨导出为 WAV 或 MP3,清理后在剪辑软件里放回画面下面。

它会去掉背景音乐吗?

会,连同其他所有非人声的声音。如果你想保留音乐,这不是合适的工具。

#音频#模型

继续阅读

全部文章 →