清华大学深圳国际研究生院发布开源模型 VeriLoop E2,以 Qwen 3.8-27B 为基础模型完成后训练,面向代码、数学与物理等具有外部可验证约束的复杂推理任务,同时提供标准权重版本与 GGUF 量化版本。
要解决的问题是“算得更多不等于做得更对”:一次代码修改可能修复主测试却破坏回归测试,一步数学推导可能减小局部误差却使另一项约束失效,一个物理近似可能改善拟合却违反守恒关系。当模型能够调用更多计算、进行更长推理后,新增计算能否被证明真正构成进展成为更基础的问题。
模型研究的核心是递归推理与测试时计算持续产生候选状态之后,如何由独立外部证据决定候选状态是否获得持久化提交资格——即当模型产生新的候选状态时,什么样的证据足以授权该状态替换当前已保留的状态。
公开口径显示,该工作使黎曼猜想临界线零点比例下界达到 67.35%。团队由清华大学深圳国际研究生院刘厚德教授与周超男董事长联合指导,王立博博士后担任实验室团队 AI 研究员,李海启、向安麟两位人工智能方向硕士研究生作为 AI 研究助理参与研发。