Voice-Pro下载和安装小白教程
一、项目定位
GitHub开源AI网页应用,主打语音识别、多语言翻译、AI配音一体化处理,全程浏览器可视化操作,无需编写代码 。
二、核心一站式功能
整合多类音视频处理能力,无需切换多款工具:
1. 视频下载(比如支持YouTube外语视频)
2. 音视频处理:音频分离、语音文字识别、字幕生成、字幕翻译
3. AI配音:文字转语音、声音克隆生成全新配音音轨
4. 音频导出:支持WAV、FLAC、MP3三种格式
三、附加独立功能
1. 实时语音识别+实时翻译
2. 单独字幕文件翻译
四、本地部署信息
系统要求
- 操作系统:Windows 10/11(64位)、Linux、Mac(Apple Silicon)
- 显卡:支持CUDA 12.4的NVIDIA显卡(推荐),显存4GB以上(8GB以上更佳)
- 内存:4GB以上
- 存储:20GB以上可用空间
- 网络:必需(首次运行需下载依赖与模型权重)
项目仓库地址
https://github.com/abus-aikorea/voice-pro
Windows本地运行指令
plaintext
git clone https://github.com/abus-aikorea/voice-pro.git
cd voice-pro
start.bat
(首次运行自动下载依赖与模型,可能需要1小时以上)
Mac电脑本地运行指令
1. 打开终端(Terminal)应用
2. 执行以下命令:
plaintext
git clone https://github.com/abus-aikorea/voice-pro.git
cd voice-pro
chmod +x configure.sh start.sh # 赋予脚本执行权限
./configure.sh # 可选,首次运行配置系统环境(安装ffmpeg等)
3. 首次运行会自动下载Python环境、依赖库和模型权重,需1小时以上且保持网络稳定
4. 启动成功后,在浏览器访问 http://localhost:7870 即可使用
夜雨聆风