基于 Tensorflow 提取音频中的不同声音(附源码)

一、项目背景

随着语音设备的能力越来越强,音频数据越来越大。但实际上,音频中的有效部分却很少。在处理音频中,我们可能会有这样的需求:得到人声,去掉噪声,亦或是提取对应的声音。此项目可以帮助我们解决这个问题。

二、运行环境

  • 操作系统:Windows 10

  • 工具软件:Anaconda

  • 硬件要求:无特殊要求

  • Python版本和核心库:Python 3.8.5

四、代码截图

请添加图片描述
请添加图片描述

五、运行&效果

  1. 下载项目资源包

  2. 在终端环境中进入spleeter文件夹;

  3. 按照以下步骤搭建运行环境(建议创建相应的虚拟环境)

    conda install -c conda-forge ffmpeg libsndfile
    pip install spleeter
    
    # 运行第二条指令时,时间可能较长,出现超时错误可重复进行几次
    
  4. 执行程序

    spleeter separate -p spleeter:2stems -o output 音频.mp3
    

    注:

    音频.mp3为待处理音频,可以根据自己的需要更改,音频文件需放置在spleeter文件夹下。

    运行结果如下所示:
    请添加图片描述

源码下载:

https://www.muxshare.com/s/cgWP0tEzpn

Logo

魔乐社区(Modelers.cn) 是一个中立、公益的人工智能社区,提供人工智能工具、模型、数据的托管、展示与应用协同服务,为人工智能开发及爱好者搭建开放的学习交流平台。社区通过理事会方式运作,由全产业链共同建设、共同运营、共同享有,推动国产AI生态繁荣发展。

更多推荐