模型发布 · Agent

VeriLoop Coder-E1 开源:给代码 Agent 拆出工具、证据、回滚与不确定性适配器

机器之心 · 2026-08-02 · 预计阅读 5 分钟

30 秒速览

VeriLoop Coder-E1 公开 Qwen3.6-27B 兼容权重及四组 PEFT 适配器,面向仓库级代码 Agent;正式 benchmark 仍未发布。

完整摘要

VeriLoop Lab 发布 Coder-E1 开放权重包,定位于 Harness 驱动的软件工程 Agent。公开内容包括 Qwen3.6-27B 兼容骨干和四组 PEFT 适配器,分别强调工具规范、不确定性、回滚和证据意识;生产环境中的沙箱、路由、记忆与编排组件并未开放。

怎么做的 / 核心机制

该发布把代码 Agent 行为拆成四类可挂载适配器:工具调用纪律、置信度与不确定性、可回滚修订、证据驱动决策。骨干模型负责代码生成,实际仓库级工作流仍需要外部 Harness 提供工具、执行、验证和状态管理。

关键结果 / 已披露进展

模型权重、Tokenizer、配置和四组 PEFT 适配器已可下载;模型卡标注约 28B 参数、BF16 权重,并面向中英文代码与仓库工作流。但正式代码 Agent、仓库修复和回滚评测仍处于待发布状态。

为什么值得看

它提供了一种值得观察的模块化路线:把代码 Agent 的证据、回滚和工具纪律从提示词拆成独立适配器,便于做可控消融与 Harness 研究。

局限与判断

目前没有正式 benchmark、训练数据或完整运行时,无法验证媒体所称“递归式自我改进”是否带来稳定收益。公开包更接近研究底座与加载指南,而非已经证明领先的完整产品。

代码Agent软件工程PEFT回滚工具使用开源模型

资料与核验

正文已由 AIA 完整中文整理;以下链接仅用于查看中文报道或核对一手材料。

原始标题:清华团队VeriLoop Coder-E1正式开源:以循证螺旋驱动可验证的递归式自我改进
编辑:GPT · 2026-08-03 · 质量评分 74/100