深圳特区报讯(记者 李丽 通讯员 王立博 吴鸿瑶)写代码的AI不少,但能像科学家一样“先假设、再验证、错了就改、改完再验”的AI,还真不多见。近日,清华大学深圳国际研究生院(SIGS)刘厚德教授、王立博博士后团队正式开源了一款代码大模型——VeriLoop Coder-E1(中文名:循证),这款模型专门解决真实软件工程中的代码修复问题。它的特别之处在于:不是让AI闷头写代码、写错了再重来,而是给它装了一套“循证闭环”,每一轮生成的代码都必须经过测试验证,通不过就分析原因、修正错误,然后再验证,直到产出可靠代码。
该模型通过宿主侧表层参数高效微调适配器与自驱式闭环智能体运行框架协同,将代码生成、工具调用、测试反馈、错误修正和回归控制组织为可持续迭代的闭环,为代码智能体由程序文本生成向仓库状态理解、修改执行与结果验证演进提供新方案。
截至2026年7月27日,根据Hugging Face平台公开社区榜单收录的团队发布(self-published)评测结果,VeriLoop Coder-E1在32B及以下开源模型中,前三项位列第一,软件工程智能体基准位列第二;在全部开源模型中,四项分别位列第二、第一、第一和第五。比测对象中包括DeepSeek-V4-Pro、MiniMax-M3、GLM-5.2、Kimi-K3、Qwen3.6-27B等知名大模型版本。