用你自己的电脑就能轻松做语音克隆,哪里还用得上付费的 ElevenLabs。VoiceStudio 是一个海外开发者做的开源项目,干的事就是把 ElevenLabs 那一套语音能力搬回你自己的电脑上跑,目前在 GitHub 上已经快 3 万颗星了。

它不用注册账号,也不用 API key:装好软件、让它把模型拉下来,录 3 秒你本人的声音当样本,敲一段文字就能出同音色的成品。Mac、Windows、Linux 和 Docker 都能跑,N 卡、苹果芯、纯 CPU 也都认。

做内容的可以把 PDF 这类书稿导进去,分好角色和章节,就能出带时间轴的有声书;也能把一条外语视频直接配成中文——它会先把人声扒出来,翻译完还会把不同说话人分开,并对上原来的音色。

另外它还起了个 OpenAI 兼容接口和 MCP,本地起一个服务就能让别的应用来调。做配音、有声书、语音助手的兄弟可以先收藏起来,拿自己 10 秒录音试一次克隆,比看我在这尬聊直观多了。