最近看到一个挺有意思的 TTS 项目:sanoTTS。 它的思路很直接:把 TT…

会飞的荧 @feitu

最近看到一个挺有意思的 TTS 项目:sanoTTS。

它的思路很直接:把 TTS 做到足够小。

最小的 heart-nano 只有 294K 参数,模型权重 337KB,最大的也就 2.27M 参数。甚至可以直接跑在大约 的 ESP32-S3 上,不需要云端,也不需要 NPU。

而且浏览器里也能直接跑,WebAssembly 全部在本地完成,不需要把文本上传服务器。

目前有 11 个声音、6 种语言,Python、NPM、Arduino/PlatformIO 都能用。

我觉得这种项目比单纯把模型越做越大更有意思。

以后一个小玩具、一块 MCU,甚至一个网页,可能自己就能直接“开口说话”。

AI 不一定非得塞进云端。

能跑进 337KB 里,才是真的有点东西。

项目地址:github.com/Ampixa/sanoTTS

这个项目的核心价值在于:

  1. 极小模型:最小294K参数,337KB权重。
  1. 边缘计算:可运行在ESP32-S3上,无需云端。
  1. 浏览器支持:WebAssembly本地运行。
  1. 多语言:11个声音,6种语言。

使用场景:

  • IoT设备:为IoT设备添加语音功能。
  • 嵌入式开发:在MCU上运行TTS。
  • 网页应用:在浏览器中本地运行TTS。
  • 学习教学:学习轻量级TTS技术。

这个项目真的太实用了,sanoTTS:294K参数的轻量级TTS,跑在3美元的ESP32上,未来可期。

话题来源 @TiagerB61244 13.6K阅读 ❤️129 x.com/…↗ 已改写,非原文转载
19 浏览 0 评论 0 反应
登录 后参与评论
还没有评论,来抢沙发。
查看完整榜单
查看完整榜单
查看完整榜单