Cognition SWE-2
## 产品简介 SWE-2 是 AI 编程初创公司 Cognition 于 2026 年 9 月 10 日发布的第三代
产品简介
SWE-2 是 AI 编程初创公司 Cognition 于 2026 年 9 月 10 日发布的第三代自研代码大模型,基于月之暗面(Moonshot AI)2.8 万亿参数 Kimi K3 底座进行后训练。SWE-2 在 Devin FrontierCode 1.1 Main 基准上取得 50.0% 得分,距离 Anthropic Claude Fable 5.1 的 50.9% 仅差不到 1 分,同时推理成本仅为 Fable 5.1 的 36%,不到 OpenAI GPT-6 Astra 的四分之一,是业内首个将强化学习(RL)扩展到「多万亿参数规模」的代码模型。
核心功能
- FrontierCode 1.1 Main 顶级表现:50.0% 得分,基本追平 Fable 5.1 和 GPT-6 Astra,但成本仅为其四分之一
- 单轮 RL 多档位算法:一次训练同时优化多个推理强度档位,把整个成本-性能 Pareto 前沿向前推进
- 多档位灵活选择:提供低/中/高三档,中档版本相对 SWE-1.7 减少 58% 回合数、降低 81% 成本,同时任务完成度更高
- Cerebras 高速推理:SWE-1.5 以来通过 Cerebras 实现 1000 tokens/秒的高速推理
- Devin 全平台上线:SWE-2 同步上线 Devin Desktop、Devin CLI、Devin Web 和 Fusion 平台
特色优势
SWE-2 的核心突破在于将强化学习成功扩展到 2.8 万亿参数规模。Cognition 团队设计了全新的线性成本惩罚算法,在一次 RL 训练中同时优化多个推理档位,让用户可以根据任务复杂度灵活选择档位——简单任务用低档省成本,复杂任务用高档保质量。
中档版本相较 SWE-1.7 的进步尤为明显:减少 58% 回合数、降低 81% 平均成本,但任务完成度反而更高,有效解决了 SWE-1.7「过度探索、过度思考」的用户抱怨。
应用场景
- 代码自动补全与生成:IDE 集成,提升开发效率
- Bug 自动修复:自动定位并修复代码缺陷
- 代码审查:自动化代码质量检查和安全漏洞发现
- 软件工程任务:SWE-2 在 SWE-bench 等真实软件工程任务上表现优异
适用人群
- 软件开发工程师(需要 AI 编程辅助的个人开发者)
- 企业开发团队(需要降本增效的企业级代码 Agent 部署)
- AI 编程工具厂商(Cursor、Codeium 等可集成 SWE-2 作为后端模型)
- 研究人员(代码模型性能研究者)
出品方
Cognition,总部位于美国旧金山。2026 年 9 月披露估值翻倍至 480 亿美元,9 月 9 日宣布完成 E 轮 20 亿美元融资。由 Devin 产品线负责人 Silas Alberti 领导开发,底座模型来自月之暗面 Kimi K3。
更新动态
- 2026 年 9 月 10 日:SWE-2 正式发布
- 同步上线 Devin Desktop、CLI、Web 和 Fusion 平台
- 2026 年 9 月 9 日:完成 E 轮 20 亿美元融资
- 估值翻倍至 480 亿美元
官网链接
团队信息
AI产品库
官方
由 AI 猎手自动发现
评论与建议
登录 后参与评论或提建议