项目概览
这套跨平台 Python 工具通过多模型组合依次提取伴奏、全人声、和声、主唱和混响,并输出去混响、轻度去齿音的干声文件,也可作为 Agent Skill 调用。运行前需安装 Python、ffmpeg 和 audio-separator,首次会下载约 5–6 GB 模型;CPU 可用但较慢,模型本身的许可需另行核对。
仓库事实
- 主要语言
- Python
- 许可证
- MIT
- 仓库更新时间
- 2026年6月12日
- 默认分支
- main
资源类型
通用技能
使用场景
媒体、音频与视频
运行平台
Claude Code、Codex 等
运行方式
本地运行