🔧 AI 知识库

最小模型仅 25MB,老设备无 GPU 也能流畅跑!

原文链接

最小模型仅 25MB,老设备无 GPU 也能流畅跑!

原文链接:https://mp.weixin.qq.com/s/QORauYBxSj4xtV6i9SE3oA

作者:开源君(开源先锋)|发布时间:2026-06-30

摘要

KittenTTS 是一款极致轻量的开源文本转语音(TTS)模型,最小版本仅 25MB(约 1500 万参数),无需 GPU、纯 CPU 即可运行,适合嵌入式设备、树莓派、老电脑等资源受限场景。GitHub 已获 14k+ star,Apache-2.0 开源协议。

核心特性

  • 超轻量:最小模型 < 25MB,仅约 1500 万参数,比主流 TTS 模型小 10 倍以上
  • 无需 GPU:纯 CPU 推理,树莓派、手机、老电脑均能运行
  • 8 种预设语音:Bella、Jasper、Luna、Bruno、Rosie、Hugo、Kiki、Leo
  • 实时生成:推理速度快,适合对话系统或实时 TTS 场景
  • 本地部署:Apache-2.0 许可,数据不上云,隐私友好
  • 跨平台:支持 Web、桌面、嵌入式设备

快速上手

安装:

pip install https://github.com/KittenML/KittenTTS/releases/download/0.8.1/kittentts-0.8.1-py3-none-any.whl

使用:

from kittentts import KittenTTS
import soundfile as sf

m = KittenTTS("KittenML/kitten-tts-mini-0.8")
audio = m.generate("This high quality TTS model works without a GPU", voice="Jasper")
sf.write('output.wav', audio, 24000)

适用场景

语音提示、有声读物、辅助工具播报、离线语音合成、隐私敏感环境下的 TTS 需求

项目地址