三亩地 三亩地SAN MU DI · CODE DIARY
ARTICLE DETAIL

日记详情

真实记录编程学习的某一天,欢迎挑你感兴趣的翻一翻。

OddTTS 更新:语音模型下载优化,同时支持 HuggingFace 与 ModelScope 源

OddTTS 更新:语音模型下载优化,同时支持 HuggingFace 与 ModelScope 源

前两天有一位 TOM 网友反馈说,他在DeepIn上安装了 OddTTS 后卡在了模型下载,下载一直失败,并且直接网页打开 https://hf-mirror.com 也会跳转到一直垃圾网站,不确定是不是他的DEEPIN 的dns出问题、被劫持了。

考虑到 OddTTS 实际也就是国内偶尔有人会用一下,于是我就动手把模型下载部分的逻辑整个重写了一下,同时加入 HuggingFace 和 ModelScope 的下载,先用 HuggingFace 去下载,如果下载失败再 fallback 到 ModelScope 下载。

修改后的版本已经递交到 pypi,版本号是: v1.2.18

有需要的同学可以下载、或者更新下载一下。

pipinstall-Uoddtts

以下是具体的更新说明。

今天带给大家一个好消息:我们开源的多引擎 TTS 语音合成服务 OddTTS迎来了一次重量级更新,围绕「安装更简单、模型更好下、用起来更省心」这三大目标做了一次全面重构。

一、OddTTS 是什么?

熟悉我们的朋友应该知道,OddTTS 是一个多引擎 TTS 统一封装服务,一套接口搞定多种主流语音合成引擎,同时也兼容 OpenAI 的 TTS API。它最初诞生于我们做「小落同学」项目时的真实需求——希望能随时在不同的 TTS 引擎之间自由切换,而这个能力对所有有 TTS 需求的同学都有价值,于是我们把它独立出来并开源了。

仓库地址:https://github.com/oddmeta/oddtts

目前已支持的引擎包括:

  • EdgeTTS(零显存、零模型,最轻量)
  • Kokoro-82M-v1.1-zh(纯 CPU 可跑,离线可用,我们的默认引擎)
  • ChatTTS(自然对话风格)
  • Bert-VITS2(少样本音色复刻)
  • GPT-SoVITS v2(少样本语音合成/复刻)

二、本次更新亮点

1. 重构为标准的 oddtts 包结构,一键启动

过去使用 OddTTS 需要拉源码、配环境,步骤比较繁琐。这次我们把项目重构为标准 Python 包结构,之后只需两步:

pipinstalloddtts oddtts

一条命令即可启动服务,默认绑定http://localhost:9001,浏览器打开即是可视化 Web 界面,也可以通过 RESTful API 接入你自己的系统。同时本次还整理了setup.cfgsetup.pybuild.bat,发布与构建流程更规范。

2. 模型下载双通道:HuggingFace + ModelScope,国内默认走 ModelScope

很多国内同学反馈:“模型下不动,挂不上梯子”。这次我们彻底解决了这个问题:模型下载同时支持 HuggingFace 与 ModelScope 两个源,并且默认优先从ModelScope(魔搭)下载——国内访问速度有保障,下载失败时还会自动切换备用源,再也不用手动设置HF_ENDPOINT镜像了。

3. 启动时预加载模型,告别首次请求"卡死"

之前模型是懒加载的,也就是第一次调用 TTS 接口时才临时下载、加载模型,常常出现首次请求长时间无响应、甚至接口超时的情况。本次调整为启动时预下载 + 预加载模型,服务初始化期间就把模型准备好,之后每次调用都是"即叫即应"。如果你希望更快的启动速度,也可以在配置文件里把preload_model关掉,改回按需加载。

4. Web 前端界面整体升级

本次同步重构了 Web 界面,交互更友好、布局更清爽,语音列表、参数调节、试听下载等功能的操作体验都有明显提升。

三、快速上手

# 1. 安装pipinstalloddtts# 2. 启动(首次启动会自动下载模型,稍等片刻)oddtts# 3. 浏览器访问# http://localhost:9001

不想改任何配置直接跑也行:默认引擎 Kokoro 纯 CPU 即可流畅运行、完全离线可用;有 GPU 的话在配置文件里把enable_gpu打开,效率更高。

四、关于硬件需求(参考)

模型最低显存纯 CPU
EdgeTTS0GB可以
Kokoro0GB可以
ChatTTS2.5GB量化可以考虑
Bert-VITS25GB量化可以考虑
GPT-SoVITS v28GB不建议
MeloTTS量化可以考虑

结语

OddTTS 一直维持着开源免费、MIT 协议、商用个人随便用的原则,这次更新希望解决大家最痛的两件事:装起来麻烦、模型下不动。如果你在用它做语音合成,欢迎 Star、提交 Issue 或贡献代码,也欢迎关注「奥德元」公众号,我们一起学习 AI,一起追赶时代。

仓库地址:https://github.com/oddmeta/oddtts
在线文档:oddmeta.net/docs/oddtts (含完整 API 接口文档)

← 返回列表