热门AI工具推荐

焚书AI多模型聚合平台
AI多模型聚合平台( Claude 系列、GPT 系列)支持聊天、搜索、图片、视频、音乐等多种功能;聚合了 Claude 系列(如 Sonnet 5、Opus 5 等)、Gemini 系列、GPT 系列、DeepSeek(搜索模式默认调用 DeepSeek V4 Pro)以及通义千问、Kimi 等数十款国内外主流模型。
AI编程订阅服务,支持多款国产主流编程模型自由切换。
Seedance 2.0AI视频生成
具备卓越的物理真实性和角色一致性,可生成电影级视频内容。
方舟 Agent PlanAI智能体订阅
火山引擎推出的全场景AI智能体订阅服务,通过一个订阅整合5大主流模型和10+AI工具
SpeedAIAI内容检测降重
AI内容检测与降重工具,能有效帮助用户通过论文AI率检测
秒哒AI工具
不懂代码也能开发应用?百度秒哒:无需编程,快速搭建小程序与网站
有戏AIAI漫剧生成工具
全流程AI短剧创作工具,实现从剧本到成片的自动化生产,让“一人即剧组”成为现实。
沁言学术智能科研平台
一站式文献管理与科研写作工具,支持边写作边搜索文献,高效阅读,文献管理,

智谱首个RSI早期形态 GLM-5.3部署10万卡

时间:2026年9月17日 地点:北京(智谱总部) 人物:唐杰(智谱创始人、首席科学家),GLM 团队 事件详情:智谱发布首个 RSI(Recursive Self-Improvement,递归自我改进)早期形态成果。GLM-5.3 驱动的 Infra Agent 在超过 10 万颗国产 AI 加速器组成的集群上,仅用两周时间完成了 GLM-5.3-Flash 推理系统从首次运行到承载全部生产流量的端到端部署。在此过程中,系统端到端吞吐能力较初始基线提升 3.2 倍,硬件效率与单 Token 推理成本追平主流英伟达 GPU 平台。该 Infra Agent 不仅参与代码编写,还能根据"稠密反馈"自主定位 KDA 长上下文路径上的 TF32 舍入误差问题(修复已合并到 Flash Linear Attention 项目 PR #1180)、解决 KV Transfer 与 DeepEP 调度未充分重叠的传输开销问题(开销从 30% 以上降到 1% 以下),并通过学习 SGLang、Flash Linear Attention 与 DeepGEMM 项目中的 Kernel 优化经验,将一个 Decode Kernel 性能提升 1.71 倍。 背景:GLM-5.3-Flash 是一款 320B 总参/18B 激活 MoE 模型,原生多模态,支持 100 万 Token 长上下文。该模型此前以匿名名 "Ox-Alpha" 在 OpenRouter 和 OpenCode 平台测试,6 天内处理超 62 万亿 Token,刷新该平台史上最高调用量记录,单周将智谱(Z.ai)的 OpenRouter Token 份额推到约 19%,首次超越 DeepSeek。智谱 2026 年中期财报显示,单位 Token 推理成本较年初下降 80%,API 定价为输入 0.15 美元/百万 Token、输出 0.50 美元/百万 Token,仅为 Claude Opus 4.8 同档服务的 1/40。该模型以 MIT 协议开源,已在 Hugging Face 同步发布完整权重。 影响:这是继 DeepMind 披露"AI 靠做梦自我进化"之后,全球第二个明确披露的 RSI 早期形态实践案例,也是首次在国产 AI 芯片集群上规模化验证的自优化闭环。智谱通过"模型优化系统,系统服务模型"的最小循环,证明前沿大模型可以在没有英伟达 GPU 介入的情况下,于 10 万卡级国产集群上完成真实生产流量的自调优。资本市场对此反应积极,智谱港股(02513.HK)当日收盘上涨超 12% 至 1160 港元;同时这一进展对 Anthropic、OpenAI 的 API 订阅模式形成新一轮定价压力。 总结:智谱首个 RSI 早期形态成果标志中国大模型从"辅助人类研发"迈向"参与构建自己继任者"的关键一步。两周端到端吞吐 3.2 倍提升的实证表明,AI 系统已能在缺少成熟工程经验参考的国产硬件上,自主诊断并修复复杂的算子精度、并发调度与 Kernel 切分问题。下一步,智谱已在为下一代 GLM-6.0 定位 Full Self-Training(全自训练)路线,覆盖预训练、中期训练、后训练全流程,目标是把"何时停止训练、何时纠正自己"的判断权也交给模型。 参考来源: 1. 爱范儿:https://www.ifanr.com/1680560 2. 腾讯新闻(智谱首个 RSI 成果发布):https://news.qq.com/rain/a/20260917A0CAIE00 3. 网易科技(唐杰、GLM 团队长文披露 RSI 最新进展):https://www.163.com/dy/article/L71SHGR30511D3QS.html 4. Web Pulse(Zhipu AI's Infra Agent Speeds Up Sovereign Hardware Clusters):https://wpnews.pro/news/zhipu-ais-infra-agent-speeds-up-sovereign-hardware-clusters-using-recursive 5. AI Socratic(Z.ai's GLM-5.3-Flash on Chinese chips):https://aisocratic.org/news/zai-ships-glm-53-flash-merged 6. 艾媒网(10 万张国产卡撑起智谱新模型):https://www.iimedia.cn/c1099/115966.html 7. 今日头条(智谱 10 万国产卡 推理成本降 80%):https://www.toutiao.com/article/7680808387528933888 8. NewsHunt(Zhipu's GLM-5.3-Flash Undercuts Claude and GPT on Price):https://newshunt.io/news/111364244484976/startup-fortune-zhipu-s-glm-5-3-flash-undercuts-claude-and-gpt-on-price-not-on-hardware-1ed135646ee5d73b