提取任何歌曲中的纯净人声与伴奏 — — macOS、Windows、Linux端100%离线运行,无需上传、无需账号、无水印。

铭文分音-声音分离是一款免费的AI人声分离工具,能在你的本地电脑上从任意歌曲中分离出纯净人声。拖入曲目或视频,先进的RoFormer神经网络模型会在几秒内将干净的人声片段(可直接使用的清唱音频)从乐曲中分离出来,全程无需上传、无需账号、无额度限制、无水印。单次分离即可获得人声与伴奏两个片段,因此它也能充当人声去除工具使用。它还支持音频格式转换、静音删除,可将多个处理步骤整合为一次性操作。在苹果硅芯片设备上配备自动Metal(MPS)GPU加速,支持macOS、Windows、Linux三大主流系统。

无论你是为混音准备清唱素材、为采样提取独立人声、需要干净伴奏用于卡拉OK,还是播客编辑使用,这些工具都能为你提供工作室级别的分离效果,且无需订阅服务——你的音频文件永远不会离开你的设备。

核心功能

  • 人声精准分离 — 可从任意歌曲中分离出纯净人声,支持两种模式:「快速模式」(单次BS-Roformer算法,快速且效果出色)、「高质模式」(3个模型组合运算后进行混音、去混响、降噪/去残留,实现最高保真度的清唱效果)。
  • 伴奏同步生成 — 每次分离人声时,都会同步获得对应的伴奏片段,因此这些工具也可用于快速生成卡拉OK伴奏或去除人声后的音频。
  • 多格式转换 — 支持转码为mp3、wav、flac、m4a、aac、ogg、opus、aiff等格式,同时保留元数据与封面信息。
  • 智能静音去除 — 自适应静音检测搭配无点击交叉淡入淡出处理,非常适合播客、讲座及现场录音的后期处理。
  • 一站式批量处理 — 支持「提取人声→删除静音→格式转换」全流程一键完成,只需拖放即可。
  • 视频文件支持 — 可拖入音乐视频或电影片段,工具会自动提取音频并分离人声或伴奏,还可将处理后的音频与原视频重新封装为同步版本。
  • 右键快捷操作 — 可直接在文件管理器中通过右键快捷操作分离人声(macOS的Finder快捷操作)。
  • 完整命令行支持 — 所有GUI操作均可通过终端脚本实现(例如运行 mingwen-fensheng vocals song.mp3 --quality max 调用高质模式),支持 --json 参数用于自动化流程。
  • 本地隐私优先 — 所有处理过程均在本地运行,你的音频与文件永远不会离开你的设备。无需注册账号、无需API密钥。仅匿名崩溃报告与使用统计(无个人数据、无文件内容或路径)会被收集以优化工具性能。

操作界面

单一窗口,完整工作流。将音频或视频拖入队列,在每个轨道上设置信号处理链(提取人声→降噪→AI增强→删除静音→转换格式),处理完成后的音频片段会直接出现在结果列表中,可直接播放或打开文件管理器定位。所有操作均在本地完成。

工具对比

大多数"免费"人声分离工具都是会将你的音频上传到第三方服务器的网站,我们的工具则完全不同。

铭文分音-声音分离闪念剪人声分离回时分声在线工具(如vocalremover.org)Ultimate Vocal Remover (UVR5)MoisesiZotope RX
本地处理/文件隐私上传文件云端
免费使用有限免费 tier付费付费
原生桌面应用(Mac/Win/Linux)仅浏览器Python/Tk GUI
无水印/额度限制
苹果硅GPU加速(Metal)不支持需手动设置
一键安装不支持需配置开发环境
无需账号登录通常需要需要

如果你正在寻找UVR5的免费替代工具、Moises的隐私替代方案,或是一款无需上传的离线清唱提取工具,这三款工具都是绝佳选择。它们采用与UVR5相同的RoFormer模型系列,以原生桌面应用形式提供,无需Python配置即可使用。

安装指南

根据你的操作系统从最新版本下载对应安装包:首次运行时会下载约2GB的AI模型引擎(一次性操作),之后工具即可完全离线使用。

macOS(苹果硅芯片)

  1. 下载 铭文分音-声音分离-<版本>-arm64.dmg,打开后将「铭文分音-声音分离」拖入「应用程序」文件夹。
  2. 首次启动提示:当前安装包未进行代码签名,macOS会弹出无法打开提示,此时需右键(⌃-点击)应用→选择「打开」→「仍要打开」。

Windows(x64)

  1. 下载 铭文分音-声音分离-<版本>.exe 安装包并运行。
  2. 安全警告提示:SmartScreen可能会提示该应用来自未知发布者,点击「更多信息→仍要运行」即可继续安装。

Linux(x64)

  1. 下载 铭文分音-声音分离-<版本>.AppImage,赋予执行权限(chmod +x 铭文分音-声音分离-*.AppImage)后运行即可。

安装包配套提供了SHA256校验文件,可通过sha256sum(Linux/Windows)或shasum -a 256(macOS)验证文件完整性。

系统要求:macOS苹果硅芯片(M1-M4)、Windows10/11(x64)或Linux(x64)。安装包已集成ffmpeg,无需额外安装其他依赖。苹果硅芯片设备支持Metal GPU加速;Windows与Linux平台则使用多核CPU进行处理(速度稍慢,但完全离线)。

工具完全免费,为预制应用程序,无需额外编译即可使用(闭源,公共仓库仅存储发布包、截图与说明文档)。

快速上手

桌面端操作:拖入音频或视频文件到窗口→勾选「人声分离/静音删除/格式转换」选项→点击「处理」。分离后的人声与伴奏会直接出现在结果列表中。

命令行操作:命令行已集成在应用内路径(如…/Resources/bin/mingwen-fensheng),可添加到系统PATH中使用:

# 分离人声,支持快速模式(几秒完成)或高质模式(最佳效果)
mingwen-fensheng vocals song.mp3 --quality fast
mingwen-fensheng vocals song.mp3 --quality max
# 格式转换,保留元数据与封面
mingwen-fensheng convert song.wav --to mp3 --bitrate 320k
# 删除静音
mingwen-fensheng silence talk.m4a --threshold -40dB --min 0.5
# 一站式处理:分离人声→删除静音→转码为mp3,输出到桌面
mingwen-fensheng run song.mp3 --vocals=max --silence --convert mp3 --out ~/Desktop/out

所有命令均可添加--json参数,输出机器可读的进度信息。

技术原理

这些工具均基于RoFormer系列分离模型构建,这是当前商业音频分离工具采用的顶尖架构。

  • 快速模式:单次高SDR的BS-Roformer算法,适合高质量音源且在Metal加速下可近实时运行。
  • 高质模式:三个专门的RoFormer模型组合运行,对人声估算结果进行混合加权平均(通过ensemble.py实现),之后经过去混响、降噪/去残留处理,实现最纯净的清唱效果。

所有推理过程均通过audio-separator引擎运行:在苹果硅平台使用Metal(MPS)加速(必要时通过PYTORCHENABLEMPS_FALLBACK回退到CPU);Windows与Linux平台则使用CPU运行。底层基于Electron外壳搭配Deno引擎,GUI与命令行共享同一处理引擎,实现统一体验。

隐私与系统要求

  • 隐私保护:所有分离、转换、清理操作均在本地完成,全程无需上传数据到云端,无需账号。仅匿名崩溃报告与基础使用统计(通过Google Analytics)会被收集,用于修复bug和优化工具——绝不收集你的文件内容、路径或任何个人数据。其他网络访问仅用于首次启动时下载AI模型,粘贴链接时的在线内容拉取,以及可选的应用更新检查功能。
  • 系统支持:macOS(苹果硅芯片)、Windows10/11(x64)、Linux(x64)。苹果硅平台支持Metal GPU加速;Windows与Linux平台使用CPU处理。
  • 存储需求:完整模型包约2GB(快速模式仅需约200MB)。
  • 运行数据:Python运行时、临时文件、默认输出路径存储在用户应用数据目录(如macOS下的~/Library/Application Support/铭文分音-声音分离/)。

常见问题

是否可以分离人声或去除人声?

两者都可以。每次运行都会将歌曲分离为人声片段(清唱)和伴奏——你可以根据需求保留任意一个。

我的音频会被上传吗?

不会。所有处理完全在你的电脑本地进行。首次启动仅下载一次AI模型,之后即可完全离线使用。

是否支持GPU加速?

在苹果硅平台自动启用Metal(MPS)GPU加速。Windows与Linux平台使用CPU处理(可在设置→引擎中强制使用CPU模式)。

真的免费吗?

是的。所有功能均免费使用,无广告、无水印、无订阅、无功能付费限制,无需账号。工具为闭源,仅提供免费使用服务。

支持哪些平台?

macOS(苹果硅芯片)、Windows10/11(x64)、Linux(x64)。不提供Intel Mac的安装包。

为何会出现"未识别开发者"或SmartScreen警告?

当前安装包未进行代码签名公证。macOS右键→「打开」即可。Windows点击「更多信息→仍要运行」即可。代码签名版本已在开发路线中。

与Ultimate Vocal Remover(UVR5)有何不同?

采用相同的底层RoFormer模型,但我们的工具是原生、精美的桌面应用,支持拖放操作、视频处理、多格式转换、静音删除与文件管理器集成——无需Python或Tkinter配置。

开发路线

  • 代码签名与公证(消除Gatekeeper/SmartScreen警告)
  • Windows与Linux平台支持NVIDIA(CUDA)GPU加速
  • 应用内自动更新功能
  • 渲染前实时预览功能
  • 更多分离目标(鼓、贝斯、钢琴等音轨)

反馈

工具完全免费使用,闭源。公共仓库存储了下载包、截图与本说明文档——欢迎在Issues中提交bug报告与功能请求。

许可与致谢

这些工具为免费使用软件(闭源) 2026 开发者团队。

他们的开发基于以下技术与成果:

  • RoFormer分离模型及其作者的贡献
  • audio-separator 推理引擎
  • Deno、Electron与ffmpeg技术

如果这些工具帮你节省了订阅费用,请给他们点赞,并分享给其他音频创作者。