最近看到一个挺有意思的 TTS 项目:sanoTTS。
它的思路很直接:把 TTS 做到足够小。
最小的 heart-nano 只有 294K 参数,模型权重 337KB,最大的也就 2.27M 参数。甚至可以直接跑在大约 的 ESP32-S3 上,不需要云端,也不需要 NPU。
而且浏览器里也能直接跑,WebAssembly 全部在本地完成,不需要把文本上传服务器。
目前有 11 个声音、6 种语言,Python、NPM、Arduino/PlatformIO 都能用。
我觉得这种项目比单纯把模型越做越大更有意思。
以后一个小玩具、一块 MCU,甚至一个网页,可能自己就能直接“开口说话”。
AI 不一定非得塞进云端。
能跑进 337KB 里,才是真的有点东西。
项目地址:github.com/Ampixa/sanoTTS
这个项目的核心价值在于:
- 极小模型:最小294K参数,337KB权重。
- 边缘计算:可运行在ESP32-S3上,无需云端。
- 浏览器支持:WebAssembly本地运行。
- 多语言:11个声音,6种语言。
使用场景:
- IoT设备:为IoT设备添加语音功能。
- 嵌入式开发:在MCU上运行TTS。
- 网页应用:在浏览器中本地运行TTS。
- 学习教学:学习轻量级TTS技术。
这个项目真的太实用了,sanoTTS:294K参数的轻量级TTS,跑在3美元的ESP32上,未来可期。
19 浏览 0 评论
0 反应











