音频解析,歌曲解析
点击空白处退出提示
语言技术
Python、HTML5、CSS、React、TypeScript系统类型
Web行业分类
音视频多媒体、人工智能开源地址
https://github.com/KiwiChao-max/music-ai.git授权协议
MIT许可
音频解析,歌曲解析
这是一个 **AI 音乐处理 Web 应用**,用户上传音频后,系统自动完成端到端处理:
1. **6 轨音源分离** - 用 Demucs `htdemucs_6s` 模型分离 vocals / drums / bass / piano / guitar / other
2. **乐器识别与 MIDI 转录** - 对 other 轨二次分类(piano / guitar / strings / synth / other\_melodic),用 Basic Pitch 转成 polyphonic MIDI
3. **鼓组 19 件精细拆分** - kick / snare / hi-hat / 5 个 toms / 5 种 cymbals / 小打 / fill 加花
4. **GM / XG 音色映射** - 生成 GM 和 XG 两个标准变体,带完整 Bank Select + Program Change + CC 控制器
5. **自定义采样库** - 用户上传鼓采样,文件名映射或频谱自动识别 -> GM 音符,浏览器 Web Audio 播放
6. **SoundFont / CSV 音色表导入** - 支持 SF2 文件和电子琴 CSV 音色表,自动映射 GM -> 自定义预设
7. **音乐分析** - BPM、调式、和弦、段落检测 + LLM AI 点评
- **同步**:用户上传、查询等请求直接由 FastAPI 处理
- **异步**:音频处理耗时,通过 Celery 后台执行,WebSocket 推送进度
- **定时**:Celery Beat 每天清理过期 refresh token 和旧任务文件
- **部署**:Docker Compose 一键启动全部 7 个容器(PostgreSQL + Redis + API + worker-heavy + worker-light + Celery Beat + 前端 nginx),非 root 用户运行
- **数据库**:从 SQLite 开发阶段迁移到 PostgreSQL 16,通过 Alembic 管理 14 个迁移版本






评论