热门AI工具推荐

AI编程订阅服务,支持多款国产主流编程模型自由切换。
Seedance 2.0AI视频生成
具备卓越的物理真实性和角色一致性,可生成电影级视频内容。
方舟 Agent PlanAI智能体订阅
火山引擎推出的全场景AI智能体订阅服务,通过一个订阅整合5大主流模型和10+AI工具
StepClaw阶跃AI桌面伙伴龙虾Agent智能体
StepClaw是阶跃星辰推出的本地和云端的AI龙虾助手,通过一键部署让普通用户也能拥有7×24小时在线、可自主执行任务的AI数字工作伙伴。
基于OpenClaw架构打造的AI助手平台,核心优势包括云端一键部署、沙箱隔离安全运行、全面接入企业微信/钉钉/飞书三大主流IM工具
SpeedAIAI内容检测降重
AI内容检测与降重工具,能有效帮助用户通过论文AI率检测
墨刀AIAI原型设计平台
墨刀AI是一款能通过一句话描述或图片,快速生成可交互原型、PRD文档及各类图表的一站式智能产品设计协作平台。
秒哒AI工具
不懂代码也能开发应用?百度秒哒:无需编程,快速搭建小程序与网站
有戏AIAI漫剧生成工具
全流程AI短剧创作工具,实现从剧本到成片的自动化生产,让“一人即剧组”成为现实。
沁言学术智能科研平台
一站式文献管理与科研写作工具,支持边写作边搜索文献,高效阅读,文献管理,

ESP32-S3芯片跑28.9M LLM提速百倍

时间:2026年7月26日 地点:GitHub 开源社区 人物:开发者 slvDev 事件详情:GitHub 用户 slvDev 近日开源项目 esp32-ai,在价值约 8 美元的 ESP32-S3 微控制器上跑通了一个 28.9M(2890 万)参数的语言模型,模型以 4-bit 量化后大小仅 14.9MB,端到端生成速度约 9.5 token/s。这是迄今在如此低成本 MCU 上部署的最大规模 LLM,参数规模约为此前 ESP32 系列上 260K 模型(260K TinyStories)的 111 倍。模型绝大部分权重(25M)以查找表形式驻留在 16MB flash 中,每次推理仅从 flash 读取约 450 字节送入 512KB SRAM 的"思考核心",整体思路直接借鉴 Google Gemma 3n/Gemma 4 的 Per-Layer Embeddings 设计。 背景:传统 MCU 部署 LLM 一直受限于 SRAM 容量——ESP32-S3 仅 512KB SRAM,过去要加载整个模型权重几乎不可能,因此社区一直停留在 26 万参数级别。Google 在 Gemma 3n 与 Gemma 4 中引入的 Per-Layer Embeddings 把大量 embedding 权重下放到 flash、只把激活所需的若干行调入 RAM,从而在手机和入门 GPU 上跑通大模型。slvDev 把同一思路移植到 MCU 的存储布局上,证明了 Per-Layer Embeddings 在嵌入式场景同样有效。 影响: - 边缘 LLM 部署门槛骤降——8 美元开发板即可跑出近 1000 万参数的局部语言模型,AI Agent / 离线语音助手 / 智能玩具等场景的硬件 BOM 成本大幅压缩 - 模型架构创新向"非 GPU 友好"方向延伸——Per-Layer Embeddings 思路让"大模型"和"低成本硬件"不再对立 - 数据隐私 / 离线 AI 体验升级——模型完全运行在本地、零网络请求,为医疗、工业、车载等高隐私场景提供原生方案 - 开源嵌入式 AI 生态加速——为后续 50M-100M 级别 LLM 跑在 MCU 上铺平道路,未来 1-2 年可能出现"百元价位 LLM 终端"产品 总结:esp32-ai 用 28.9M 参数 + 14.9MB 4-bit 模型 + 9.5 token/s 的实测数据,把"LLM 必须依赖数据中心"这一默认假设击碎。其核心是把 Gemma 4 的 Per-Layer Embeddings 重新映射到 MCU 的 flash/SRAM 存储层级,仅在每个 token 处理时按需调用小段 embedding。配合 ESP32-S3 8 美元起步的成本,意味着离线 AI 助手、私密本地推理、低门槛创客硬件都将迎来一波新的应用爆发,AI 普惠从"云端订阅"走向"单机自洽"的拐点正在临近。 参考来源: - https://github.com/slvDev/esp32-ai - https://news.ycombinator.com/item?id=49050512 - https://x.com/slvDev