时间:2026年9月7日
地点:德国柏林 IFA 2026 消费电子展 AMD 开幕主题演讲
人物:AMD 高级副总裁、计算与图形总经理 Jack Huynh
事件详情:AMD 在 IFA 2026 开幕演讲中正式推出「Personal AI(个人 AI)」战略,并一次性发布三款重磅新品:代号 Gorgon Halo 的 Ryzen AI Max 400 平台、下一代 HP ZBook 笔记本(代号 Sundance),以及 96 核全液冷 Threadripper Halo Station 桌边工作站。
新平台将统一内存从 128GB 提升至 192GB,本地可承载 3000 亿参数模型;HP ZBook 现场演示一条 prompt 本地实时生成完整 3D 世界并流畅运行微软飞行模拟;Threadripper Halo Station 搭载 4 张 AMD Instinct MI350P 加速卡,2TB 系统内存,576GB HBM3E 总容量,AMD 称其可本地运行超过 1 万亿参数模型,并称之为「全球最强工作站」。
关键看点是中国大模型集体登台:DeepSeek、Qwen3.8-Flash-Next、智谱 GLM-5.3-Flash(3200 亿参数)、gpt-oss、Laguna S 2.1 都被 AMD 现场点名,AMD 用这些开放权重模型证明从普通 AI PC 到桌边工作站都能装得下、跑得动。
AMD 现场基准对比显示,本地开源模型 Laguna S 2.1 在软件工程基准上以 70.3 分超过云端 Claude Sonnet 5;智谱 GLM-5.3-Flash 在 Gorgon Halo 上的表现也优于云端 Claude Fable 5。
背景:AMD 选择把 AI 计算从云端拉回本地。Jack Huynh 给出的核心数据是:全球月度 AI token 处理量过去一年从 700 万亿(0.7 quadrillion)蹿升到 1700 万亿(1.7 quadrillion),2030 年预计达到每月 120 quadrillion(120 亿亿)。
更现实的压力来自企业 AI 预算:AMD 称 93% 的企业正在超支 AI 预算,按活跃用户每天 1500 万输出 token 计算,云端一天成本约 300 欧元,一年为一个人的 AI 用量买单需要近 10 万欧元。
AMD 提出 Personal AI 三大关键词:本地计算、隐私与控制、个人上下文。电脑先处理自己能完成的工作,涉及敏感数据和个人上下文的任务尽量留在本地,需要更大规模时再调用云端与数据中心。
联想在 IFA 2026 同步发布 ThinkCentre X Ultra,搭载 Gorgon Halo,可桌面摆放,最多四台组成集群;AMD 还与微软和 SUSE 合作补齐 Windows 开发与企业部署能力。
影响:对中国大模型生态而言,这是一次国际顶级芯片厂商在年度旗舰舞台上对中国开源模型的集体背书;从 PC 厂商视角看,DeepSeek/千问/智谱轮番登场意味着本地 AI PC 终于等到了真正可跑、可商用、可卖给消费者的「弹药」——过去 PC 厂商比游戏帧率,现在比「我的电脑能装下多大的模型」。
AMD 路线图明确:当前 Gorgon Point(Ryzen AI 400)本地可跑 240 亿参数,Strix Halo 跑 2000 亿参数,新一代 Gorgon Halo 已推到 3000 亿参数,本地 AI 军备竞赛进入万亿参数时代。
总结:AMD 用三款新品 + Personal AI 战略把 AI 计算从云端拽回本地桌边,中国大模型集体登台成为衡量 PC 端侧 AI 能力的关键标尺,端侧 AI 战场从「能不能跑」升级为「能跑多大」。
参考来源:
- https://www.ifanr.com/1678938(爱范儿:DeepSeek、千问、智谱轮番登场,PC 厂商终于等到了它们的弹药)
- https://agihunt.info/en/p/1a07b74b2c7065fd2d87b99ef01(AGI Hunt:AMD bets on Personal AI at IFA 2026: 192GB…)
- )
- https://eu.36kr.com/en/p/3973972580495881(36氪欧洲:DeepSeek Qwen and Zhipu AI have appeared in succession)
- https://so.html5.qq.com/page/real/search_news?docid=70000021_3346a9e966056752(腾讯转载:DeepSeek、千问、智谱轮番登场)







