Skip to content

Repository files navigation

智能音频处理助手

这是一个功能强大的音频处理软件,专为提升音频质量和文本转换而设计。软件采用最新的AI技术,为用户提供全面的音频处理解决方案。

功能特点

  1. 音量增强:智能调节音频音量,使声音更加清晰响亮
  2. 语音转文字:利用AI技术将语音内容转换为准确的文字
  3. 音频降噪:有效去除背景噪音,提升录音质量
  4. 人声提取:智能分离背景音乐和人声,突出说话内容
  5. 音频修复:修复模糊不清的音频,提高音频质量

使用方式

本软件提供两种使用方式:

1. 图形界面版本

适合一般用户,提供直观友好的操作界面。

python main.py

注意:图形界面依赖PyQt5,在某些环境下可能无法正常运行。如果遇到界面启动问题,请使用命令行版本。

2. 命令行版本

适合高级用户或在图形界面无法运行的环境使用。

python cmd_audio_processor.py 输入文件路径 --operation 操作类型 [其他参数]

详细的命令行使用说明请参考 CMD_README.md

安装指南

1. 安装依赖

本项目需要Python 3.8或更高版本,建议使用虚拟环境安装。

# 创建虚拟环境
python -m venv venv

# 激活虚拟环境
# Windows
venv\Scripts\activate
# macOS/Linux
# source venv/bin/activate

# 安装基本依赖
python -m pip install -r requirements.txt

或者使用提供的安装脚本:

# Windows
.\install_basic_deps.bat

# 直接运行
.\start.bat

2. 安装额外依赖

某些高级功能需要额外的依赖库:

# 语音转文字功能
pip install openai-whisper

# 音频降噪功能
pip install noisereduce

# 增强人声提取功能
pip install torch torchaudio

功能详细说明

音量增强

  • 使用方法:点击"音量增强",选择增益值(推荐范围:1.0-3.0)
  • 参数说明:增益值越高,音量提升越明显
  • 输出结果:增强后的音频文件

语音转文字

  • 使用方法:点击"转为文本",选择语言
  • 参数说明:支持中文、英语等多种语言
  • 输出结果:文本文件和带时间戳的字幕文件

音频降噪

  • 使用方法:点击"降噪处理",选择降噪强度
  • 参数说明:降噪强度可设置为低、中、高
  • 输出结果:去除噪音后的清晰音频

人声提取

  • 使用方法:点击"提取人声"
  • 参数说明:可调整分离程度
  • 输出结果:分离后的人声音频文件

音频修复

  • 使用方法:点击"修复音频"
  • 参数说明:可选择修复强度
  • 输出结果:修复后的高质量音频文件

故障排除

  • 图形界面无法启动:尝试使用命令行版本的程序
  • 功能不可用提示:安装相应的额外依赖库
  • 处理错误:检查音频文件格式是否受支持(支持WAV、MP3、FLAC等格式)

技术支持

如有问题,请参考项目文档或提交问题反馈。

About

这是一个功能强大的音频处理软件,专为提升音频质量和文本转换而设计。软件采用最新的AI技术,为用户提供全面的音频处理解决方案。 功能特点 音量增强:智能调节音频音量,使声音更加清晰响亮 语音转文字:利用AI技术将语音内容转换为准确的文字 音频降噪:有效去除背景噪音,提升录音质量 人声提取:智能分离背景音乐和人声,突出说话内容 音频修复:修复模糊不清的音频,提高音频质量

Resources

Stars

17 stars

Watchers

1 watching

Forks

Releases

Packages

Used by

Contributors

Languages