提取任何歌曲中的纯净人声与伴奏 — — macOS、Windows、Linux端100%离线运行,无需上传、无需账号、无水印。
铭文分音-声音分离是一款免费的AI人声分离工具,能在你的本地电脑上从任意歌曲中分离出纯净人声。拖入曲目或视频,先进的RoFormer神经网络模型会在几秒内将干净的人声片段(可直接使用的清唱音频)从乐曲中分离出来,全程无需上传、无需账号、无额度限制、无水印。单次分离即可获得人声与伴奏两个片段,因此它也能充当人声去除工具使用。它还支持音频格式转换、静音删除,可将多个处理步骤整合为一次性操作。在苹果硅芯片设备上配备自动Metal(MPS)GPU加速,支持macOS、Windows、Linux三大主流系统。
无论你是为混音准备清唱素材、为采样提取独立人声、需要干净伴奏用于卡拉OK,还是播客编辑使用,这些工具都能为你提供工作室级别的分离效果,且无需订阅服务——你的音频文件永远不会离开你的设备。
核心功能
- 人声精准分离 — 可从任意歌曲中分离出纯净人声,支持两种模式:「快速模式」(单次BS-Roformer算法,快速且效果出色)、「高质模式」(3个模型组合运算后进行混音、去混响、降噪/去残留,实现最高保真度的清唱效果)。
- 伴奏同步生成 — 每次分离人声时,都会同步获得对应的伴奏片段,因此这些工具也可用于快速生成卡拉OK伴奏或去除人声后的音频。
- 多格式转换 — 支持转码为mp3、wav、flac、m4a、aac、ogg、opus、aiff等格式,同时保留元数据与封面信息。
- 智能静音去除 — 自适应静音检测搭配无点击交叉淡入淡出处理,非常适合播客、讲座及现场录音的后期处理。
- 一站式批量处理 — 支持「提取人声→删除静音→格式转换」全流程一键完成,只需拖放即可。
- 视频文件支持 — 可拖入音乐视频或电影片段,工具会自动提取音频并分离人声或伴奏,还可将处理后的音频与原视频重新封装为同步版本。
- 右键快捷操作 — 可直接在文件管理器中通过右键快捷操作分离人声(macOS的Finder快捷操作)。
- 完整命令行支持 — 所有GUI操作均可通过终端脚本实现(例如运行
mingwen-fensheng vocals song.mp3 --quality max调用高质模式),支持--json参数用于自动化流程。 - 本地隐私优先 — 所有处理过程均在本地运行,你的音频与文件永远不会离开你的设备。无需注册账号、无需API密钥。仅匿名崩溃报告与使用统计(无个人数据、无文件内容或路径)会被收集以优化工具性能。
操作界面
单一窗口,完整工作流。将音频或视频拖入队列,在每个轨道上设置信号处理链(提取人声→降噪→AI增强→删除静音→转换格式),处理完成后的音频片段会直接出现在结果列表中,可直接播放或打开文件管理器定位。所有操作均在本地完成。
工具对比
大多数"免费"人声分离工具都是会将你的音频上传到第三方服务器的网站,我们的工具则完全不同。
| 铭文分音-声音分离 | 闪念剪人声分离 | 回时分声 | 在线工具(如vocalremover.org) | Ultimate Vocal Remover (UVR5) | Moises | iZotope RX | |
|---|---|---|---|---|---|---|---|
| 本地处理/文件隐私 | 上传文件 | 云端 | |||||
| 免费使用 | 有限免费 tier | 付费 | 付费 | ||||
| 原生桌面应用(Mac/Win/Linux) | 仅浏览器 | Python/Tk GUI | |||||
| 无水印/额度限制 | |||||||
| 苹果硅GPU加速(Metal) | 不支持 | 需手动设置 | |||||
| 一键安装 | 不支持 | 需配置开发环境 | |||||
| 无需账号登录 | 通常需要 | 需要 |
如果你正在寻找UVR5的免费替代工具、Moises的隐私替代方案,或是一款无需上传的离线清唱提取工具,这三款工具都是绝佳选择。它们采用与UVR5相同的RoFormer模型系列,以原生桌面应用形式提供,无需Python配置即可使用。
安装指南
根据你的操作系统从最新版本下载对应安装包:首次运行时会下载约2GB的AI模型引擎(一次性操作),之后工具即可完全离线使用。
macOS(苹果硅芯片)
- 下载
铭文分音-声音分离-<版本>-arm64.dmg,打开后将「铭文分音-声音分离」拖入「应用程序」文件夹。 - 首次启动提示:当前安装包未进行代码签名,macOS会弹出无法打开提示,此时需右键(⌃-点击)应用→选择「打开」→「仍要打开」。
Windows(x64)
- 下载
铭文分音-声音分离-<版本>.exe安装包并运行。 - 安全警告提示:SmartScreen可能会提示该应用来自未知发布者,点击「更多信息→仍要运行」即可继续安装。
Linux(x64)
- 下载
铭文分音-声音分离-<版本>.AppImage,赋予执行权限(chmod +x 铭文分音-声音分离-*.AppImage)后运行即可。
安装包配套提供了SHA256校验文件,可通过sha256sum(Linux/Windows)或shasum -a 256(macOS)验证文件完整性。
系统要求:macOS苹果硅芯片(M1-M4)、Windows10/11(x64)或Linux(x64)。安装包已集成ffmpeg,无需额外安装其他依赖。苹果硅芯片设备支持Metal GPU加速;Windows与Linux平台则使用多核CPU进行处理(速度稍慢,但完全离线)。
工具完全免费,为预制应用程序,无需额外编译即可使用(闭源,公共仓库仅存储发布包、截图与说明文档)。
快速上手
桌面端操作:拖入音频或视频文件到窗口→勾选「人声分离/静音删除/格式转换」选项→点击「处理」。分离后的人声与伴奏会直接出现在结果列表中。
命令行操作:命令行已集成在应用内路径(如…/Resources/bin/mingwen-fensheng),可添加到系统PATH中使用:
# 分离人声,支持快速模式(几秒完成)或高质模式(最佳效果)
mingwen-fensheng vocals song.mp3 --quality fast
mingwen-fensheng vocals song.mp3 --quality max
# 格式转换,保留元数据与封面
mingwen-fensheng convert song.wav --to mp3 --bitrate 320k
# 删除静音
mingwen-fensheng silence talk.m4a --threshold -40dB --min 0.5
# 一站式处理:分离人声→删除静音→转码为mp3,输出到桌面
mingwen-fensheng run song.mp3 --vocals=max --silence --convert mp3 --out ~/Desktop/out
所有命令均可添加--json参数,输出机器可读的进度信息。
技术原理
这些工具均基于RoFormer系列分离模型构建,这是当前商业音频分离工具采用的顶尖架构。
- 快速模式:单次高SDR的BS-Roformer算法,适合高质量音源且在Metal加速下可近实时运行。
- 高质模式:三个专门的RoFormer模型组合运行,对人声估算结果进行混合加权平均(通过
ensemble.py实现),之后经过去混响、降噪/去残留处理,实现最纯净的清唱效果。
所有推理过程均通过audio-separator引擎运行:在苹果硅平台使用Metal(MPS)加速(必要时通过PYTORCHENABLEMPS_FALLBACK回退到CPU);Windows与Linux平台则使用CPU运行。底层基于Electron外壳搭配Deno引擎,GUI与命令行共享同一处理引擎,实现统一体验。
隐私与系统要求
- 隐私保护:所有分离、转换、清理操作均在本地完成,全程无需上传数据到云端,无需账号。仅匿名崩溃报告与基础使用统计(通过Google Analytics)会被收集,用于修复bug和优化工具——绝不收集你的文件内容、路径或任何个人数据。其他网络访问仅用于首次启动时下载AI模型,粘贴链接时的在线内容拉取,以及可选的应用更新检查功能。
- 系统支持:macOS(苹果硅芯片)、Windows10/11(x64)、Linux(x64)。苹果硅平台支持Metal GPU加速;Windows与Linux平台使用CPU处理。
- 存储需求:完整模型包约2GB(快速模式仅需约200MB)。
- 运行数据:Python运行时、临时文件、默认输出路径存储在用户应用数据目录(如macOS下的
~/Library/Application Support/铭文分音-声音分离/)。
常见问题
是否可以分离人声或去除人声?
两者都可以。每次运行都会将歌曲分离为人声片段(清唱)和伴奏——你可以根据需求保留任意一个。
我的音频会被上传吗?
不会。所有处理完全在你的电脑本地进行。首次启动仅下载一次AI模型,之后即可完全离线使用。
是否支持GPU加速?
在苹果硅平台自动启用Metal(MPS)GPU加速。Windows与Linux平台使用CPU处理(可在设置→引擎中强制使用CPU模式)。
真的免费吗?
是的。所有功能均免费使用,无广告、无水印、无订阅、无功能付费限制,无需账号。工具为闭源,仅提供免费使用服务。
支持哪些平台?
macOS(苹果硅芯片)、Windows10/11(x64)、Linux(x64)。不提供Intel Mac的安装包。
为何会出现"未识别开发者"或SmartScreen警告?
当前安装包未进行代码签名公证。macOS右键→「打开」即可。Windows点击「更多信息→仍要运行」即可。代码签名版本已在开发路线中。
与Ultimate Vocal Remover(UVR5)有何不同?
采用相同的底层RoFormer模型,但我们的工具是原生、精美的桌面应用,支持拖放操作、视频处理、多格式转换、静音删除与文件管理器集成——无需Python或Tkinter配置。
开发路线
- 代码签名与公证(消除Gatekeeper/SmartScreen警告)
- Windows与Linux平台支持NVIDIA(CUDA)GPU加速
- 应用内自动更新功能
- 渲染前实时预览功能
- 更多分离目标(鼓、贝斯、钢琴等音轨)
反馈
工具完全免费使用,闭源。公共仓库存储了下载包、截图与本说明文档——欢迎在Issues中提交bug报告与功能请求。
许可与致谢
这些工具为免费使用软件(闭源) 2026 开发者团队。
他们的开发基于以下技术与成果:
- RoFormer分离模型及其作者的贡献
audio-separator推理引擎- Deno、Electron与ffmpeg技术
如果这些工具帮你节省了订阅费用,请给他们点赞,并分享给其他音频创作者。