ARTICLE · 1104731
Github新项目,把收费的配音软件给开源了
孔不惑AIko · 开源项目手记 2026-09-30
一周涨 8000 Star · 开源配音平替
VoiceStudio:开源、完全本地的 ElevenLabs 替代品。配音这件事,可以在自己电脑上干完。
项目介绍 · 实测两问待验证
编者按 · 先说明白
这篇基于官方文档和公开数据,我没真机跑过分。每个功能都有出处,我拿不准的地方,直接告诉你拿不准。
AI 配音这块,一直有个隐形门槛:想要自定义、真人配音效果的,就需要花钱。
但是最近 GitHub 周榜冲上来一个项目,把这道门槛撬了一条缝。
它叫 VoiceStudio,开发者的定位写得非常直白:开源、完全本地的 ElevenLabs 替代品。


先给数据:
4.7万 Star
光这一周就涨了 7972 · 周趋势榜第 4
这个量级,在开源语音工具里算头部了
PART 01
它到底能干什么?
SIX JOBS · ONE APP
1克隆声音:给它一段你的录音,它学你的音色
2声音设计:用文字描述一个不存在的声音
3视频配音:按时间轴给视频换语音
4听写
5转录
6批量做有声书
官方口径是支持 646 种语言。

我的判断
这六个功能单拎出来,都能替代市面上的收费软件。它干的不是发明新东西,是把这收费项目开源了。
PART 02
它最值钱的一个设定:声音不出你的电脑
LOCAL FIRST
做配音有个说不出口的别扭:客户的声音素材、你自己的音色样本,得传到人家服务器上才能处理。
VoiceStudio 的架构是完全本地跑,远程服务只是可选项,还要你单独同意才开。
我的判断
既然是本地运行,肯定是用自己电脑的 GPU,如果电脑配置高,做一条配音的效果和速度会很快,低配置也能做,但是精度和速度会打折扣。
PART 03
上手难度:官方把门槛压到一条命令
QUICK START
这部分直接抄官方 README,没修饰。macOS 和 Linux,一条命令:
curl -fsSL https://voicestudio.sh/install | sh
TERMINAL · 长按可复制
Windows 用户去项目的 Releases 页面下安装包,双击装,跟装普通软件没区别。官方还提供 Docker 方式。


它是个正经的桌面应用,不是纯命令行工具。第一次用某个功能会提示你下载对应的语音模型,按需下就行,不用一口气全拉下来。自带 demo 音色,装完就能点开试。
我的判断
它跟很多开源语音项目最大的区别就是「有安装器」。不用配 Python 环境,不用敲一串依赖命令,对非程序员是真的友好。
PART 04
动手之前,三件事你得知道
BEFORE YOU START
第一,硬件配置。本地跑语音模型,显卡和内存就是核心,配置不够的话生成速度会教你做人。具体多快多慢,得实测才知道。
第二,646 种语言。真正能用到的语言也就那几个常用的,对做海外的商家非常友好。
第三,它是 AGPL-3.0 协议。你自己拿它做内容、配音、录有声书,没问题;但想拿它搭个在线服务去卖,这个协议有传染性条款,动手前找懂行的人把条款过一遍。副业搞到一半被协议咬一口,不体面。
PART 05
这两个问题,文档回答不了
TO BE TESTED
这两个问题,只能真机说话:
1中文克隆效果到底行不行:录一段自己的声音做克隆,生成同一段文字,人耳对比。
2生成速度:你的机器配置下,一段 30 秒的音频要跑多久。
这两问我还在验,有结果了发下篇。
PART 06
到底该不该装:一张速查表
CHEAT SHEET
我的结论
新手想要找一个免费好用的配音软件,是首选。如果要求较高,先看自己的电脑配置,配置不高建议绕道。
仓库地址: github.com/debpalash/VoiceStudio
留个问题给你:你觉得配音这行,会先被本地开源工具干掉的是低端量产单,还是高端情感戏?评论区聊聊,我很好奇你们怎么看。
CLOSING
「付费买的是省事,开源省的是钱——中间差的,是你自己的时间和显卡。」

我是不惑,陪你一起搭建人生资产
2026-09-30