Cognition 发布编程模型 SWE-2,官方称这是其迄今最先进的编程模型:基于 2.8 万亿参数的 Kimi K3 后训练,在主要评测上以最多低 70% 的成本达到与近期前沿模型相当的水平。
成绩单上,SWE-2 在 FrontierCode 1.1 Main 得分 50.0%,与最强模型差距在一分以内而成本低 64%。训练侧的技术亮点是首次将强化学习扩展到多万亿参数规模,且新增算法可在单次 RL 运行中同时训练 medium、high、max 全部推理力度档位——这也是其首个支持力度档位的模型。
可用性上,SWE-2 已在 Devin Desktop 与 CLI 上线,并正在 Devin Web 与 Fusion 上逐步推出;Pro、Max 和 Teams 订阅用户未来一个月内可免费使用。
值得关注的是 Cognition 的产品节奏:这家以 Devin 智能体著称的公司正在把“自研模型 + 智能体工作流”垂直整合——从智能体调度层下沉到模型层,配合此前用 Devin 分解 RSA-260 的技术展示,形成“模型为 Agent 服务”的完整故事线。