热门AI工具推荐

AI编程订阅服务,支持多款国产主流编程模型自由切换。
Seedance 2.0AI视频生成
具备卓越的物理真实性和角色一致性,可生成电影级视频内容。
方舟 Agent PlanAI智能体订阅
火山引擎推出的全场景AI智能体订阅服务,通过一个订阅整合5大主流模型和10+AI工具
StepClaw阶跃AI桌面伙伴龙虾Agent智能体
StepClaw是阶跃星辰推出的本地和云端的AI龙虾助手,通过一键部署让普通用户也能拥有7×24小时在线、可自主执行任务的AI数字工作伙伴。
基于OpenClaw架构打造的AI助手平台,核心优势包括云端一键部署、沙箱隔离安全运行、全面接入企业微信/钉钉/飞书三大主流IM工具
SpeedAIAI内容检测降重
AI内容检测与降重工具,能有效帮助用户通过论文AI率检测
墨刀AIAI原型设计平台
墨刀AI是一款能通过一句话描述或图片,快速生成可交互原型、PRD文档及各类图表的一站式智能产品设计协作平台。
秒哒AI工具
不懂代码也能开发应用?百度秒哒:无需编程,快速搭建小程序与网站
有戏AIAI漫剧生成工具
全流程AI短剧创作工具,实现从剧本到成片的自动化生产,让“一人即剧组”成为现实。
沁言学术智能科研平台
一站式文献管理与科研写作工具,支持边写作边搜索文献,高效阅读,文献管理,

智谱开源GLM-5.3-Flash 全国产卡价仅1/40

时间:2026年8月26日晚间 地点:中国北京(智谱AI) 人物:智谱AI团队、Z.ai平台开发者、智东西、36氪报道记者 事件详情:智谱AI于8月26日晚正式发布并开源原生多模态大模型GLM-5.3-Flash(总参数320B、激活18B),支持图片、视频、文件与文本多模态输入及1M超长上下文。此前一周,该模型以Ox Alpha匿名身份在OpenCode与OpenRouter平台接受全球开发者实测,首日即登顶OpenRouter调用量榜单并刷新单日tokens用量历史纪录,被称为牛模王。智谱随后确认,所有匿名测试流量均由超10万张国产芯片集群承载,是国产芯片首次大规模集体出海承接全球前沿模型推理负载。定价方面,GLM-5.3-Flash输入0.8元/百万tokens、输出2.8元/百万tokens、缓存命中0.23元/百万tokens,整体价格仅为GLM-5.3的1/10、Claude Opus 4.8的约1/40;限时折扣期价格进一步降至GLM-5.3的1/20。 背景:Ox Alpha测试期间曾有谷歌研究员发文暗示可能是Gemini新模型引发业内讨论。此次智谱官方认领并披露国产芯片承载细节,回应了外界对大规模免费测试背后算力来源的疑问。架构层面,GLM-5.3-Flash采用稀疏注意力与线性注意力混合架构,并通过IndexPool将索引器缓存从4向量压缩至1向量,使注意力计算量较GLM-5.3降低3.01倍、KV缓存降低4.44倍。系统层面,智谱基于SGLang构建专用推理引擎,加入节点内张量并行、ReplaySSM、W8A8量化、INT8/FP8/BF16混合缓存量化与Layer Split等技术,并采用Encode-Prefill-Decode(EPD)分离架构,将端到端服务性能较同硬件初始基线提升3倍。训练语料达30T Token多模态,并引入流形约束超连接mHC。 影响:性能上,GLM-5.3-Flash在Artificial Analysis Intelligence Index综合智能指数上取得57分,与Claude Opus 4.8持平;在智谱自研Z.ai Code Bench体感评估中Coding体验也与Opus 4.8相近。智东西实测显示,该模型能识别高密度图片、从半页残缺公考试卷中推理作答、用35分钟复刻Hermes Agent官网风格、用57分钟把48分钟吴恩达演讲剪成金句合集、复刻《深海迷航》3D游戏片段与《王者荣耀》MOBA对战、给DeepSeek Harness开发二次元皮肤插件。这次发布意味着首款全部跑在国产芯片集群上的前沿开源模型以不到Opus 4.8 1/40的价格进入与闭源旗舰相同的智能区间,将大幅降低国内AI应用开发者调用前沿模型的边际成本,同时为国产芯片承载万亿级参数大模型推理提供大规模真实流量验证。 总结:智谱用GLM-5.3-Flash回答了牛来模型的最后一个悬念:国产开源模型已能在价格、效果与算力三个维度同时逼近海外闭源旗舰。1/40价格不是国产芯片硬件推理成本的优势,而是国产芯片集群承载前沿模型服务后通过推理系统优化与稀疏线性注意力架构重塑后的工程结果。可以预见,随着全国产卡万卡集群支撑越来越多前沿开源模型走向全球,中国大模型生态将在性能—成本—自主可控三角中完成新一轮平衡。 参考来源: - 智东西(GLM-5.3-Flash实测):https://zhidx.com/p/588399.html - 36氪(牛来模型算力谜底):https://www.36kr.com/p/3956946155355267 - MarkTechPost(GLM-5.3-Flash技术规格英文报道):https://www.marktechpost.com/2026/08/26/z-ai-releases-glm-5-3-flash-a-320b-a18b-natively-multimodal-moe-with-a-1m-token-context/ - 极客早知道(Ox Alpha身份揭晓):http://www.geekpark.net/news/369414