这是一个功能强大的音频处理软件,专为提升音频质量和文本转换而设计。软件采用最新的AI技术,为用户提供全面的音频处理解决方案。
- 音量增强:智能调节音频音量,使声音更加清晰响亮
- 语音转文字:利用AI技术将语音内容转换为准确的文字
- 音频降噪:有效去除背景噪音,提升录音质量
- 人声提取:智能分离背景音乐和人声,突出说话内容
- 音频修复:修复模糊不清的音频,提高音频质量
本软件提供两种使用方式:
适合一般用户,提供直观友好的操作界面。
python main.py注意:图形界面依赖PyQt5,在某些环境下可能无法正常运行。如果遇到界面启动问题,请使用命令行版本。
适合高级用户或在图形界面无法运行的环境使用。
python cmd_audio_processor.py 输入文件路径 --operation 操作类型 [其他参数]详细的命令行使用说明请参考 CMD_README.md。
本项目需要Python 3.8或更高版本,建议使用虚拟环境安装。
# 创建虚拟环境
python -m venv venv
# 激活虚拟环境
# Windows
venv\Scripts\activate
# macOS/Linux
# source venv/bin/activate
# 安装基本依赖
python -m pip install -r requirements.txt或者使用提供的安装脚本:
# Windows
.\install_basic_deps.bat
# 直接运行
.\start.bat某些高级功能需要额外的依赖库:
# 语音转文字功能
pip install openai-whisper
# 音频降噪功能
pip install noisereduce
# 增强人声提取功能
pip install torch torchaudio- 使用方法:点击"音量增强",选择增益值(推荐范围:1.0-3.0)
- 参数说明:增益值越高,音量提升越明显
- 输出结果:增强后的音频文件
- 使用方法:点击"转为文本",选择语言
- 参数说明:支持中文、英语等多种语言
- 输出结果:文本文件和带时间戳的字幕文件
- 使用方法:点击"降噪处理",选择降噪强度
- 参数说明:降噪强度可设置为低、中、高
- 输出结果:去除噪音后的清晰音频
- 使用方法:点击"提取人声"
- 参数说明:可调整分离程度
- 输出结果:分离后的人声音频文件
- 使用方法:点击"修复音频"
- 参数说明:可选择修复强度
- 输出结果:修复后的高质量音频文件
- 图形界面无法启动:尝试使用命令行版本的程序
- 功能不可用提示:安装相应的额外依赖库
- 处理错误:检查音频文件格式是否受支持(支持WAV、MP3、FLAC等格式)
如有问题,请参考项目文档或提交问题反馈。