Cambium AI:带八道人工关卡的本地科研代理框架
Cambium 是一个本地运行的 AI 科研代理框架,通过 11 个委员会、46 个专责代理和 8 道人工签批关卡,确保…
概述
随着大模型在科研写作、文献综述、代码实验中的使用越来越普遍,「AI 引用不存在的论文」「AI 自己生成自己审的结论」等风险也开始侵蚀学术记录的可信度。Cambium 选择不靠政策口号回应这些担忧,而是用一套工程层面的「管道」来约束 AI:在 CI 检查、人工签批关卡和不可绕过的规则处强制介入。
Cambium 是一个可以跑在用户本地的「科研代理研究所」。用户提交一个任务后,编排器(Orchestrator)按需召集预定义的委员会和命名代理,从基金申请一直走到结果核验,全程有八道人工关卡。未获得人类签批的内容不得提交、不得发布、不得公开。
技术形态与安装
Cambium 本质上是 Claude Code 与 Cowork 的一个插件,背后挂了一个 MCP 服务器,工作在用户自己的账号里,没有任何第三方云在中间转手,项目以 MIT 协议开源。安装流程很短:
- 添加市场并安装插件:
/plugin marketplace add IFC-UIDAHO/Cambium_AI,随后/plugin install cambium-institute - 无配置试运行:
/cambium run example - 提交真实任务,例如
/cambium draft an NSF proposal on soil-carbon monitoring in dryland systems
如果只想追求速度,可以用 /cambium-mode 把任务降级为「单人模式」,跳过所有委员会和关卡。
八个关卡与全生命周期管理
Cambium 把一个科研项目的完整生命周期切成了八个人工决策点:
- G0 立项:判断是否值得投入
- G1 申报前:是否沿此方向或标书推进
- G2 设计:选定哪种研究路径
- G3 提交:定稿并申报,仅由负责人签字,AI 不得自我认证
- G3a 预算:经费与合规审批
- G4 结果:每个数字可复现后才接受
- G5 报告:是否发布进展报告
- G6 公开:是否对外公开
每到一个关卡,运行都会暂停,呈现一页摘要并等待。简单的「看起来没问题」无法通过;系统还会在连签时强制留出间隔,避免决策被「流水线盖章」通过。
代理架构:十一个委员会、46 个专责代理
编排器之下是 11 个委员会:编排、申报前、合作、师资、侦察、实验、验证、执行、报告、支持和治理,共由 46 名各司其职的代理组成。编排器把目标拆解后,仅召集任务所需的委员会,能并行的部分并行运行,最后合并为一条排序后的决策。验证委员会独立于撰写者,谁写了内容,谁就不能同时是批准它的人。
「声明的类型系统」
Cambium 不把诚实当作语气,而是当作一套类型系统。代理输出的每条事实陈述必须携带一个等级,CI(governance/validate.py)会在声明超出其证据等级时让构建失败:
- Proved:定理或形式化证明,例如「在假设 A1 到 A3 下估计量无偏」
- Code-verified:脚本运行并复现了数字,例如「FCR = 0.33(12/36),已记录复现哈希」
- Asserted:声称但尚未验证,例如「该方法应可推广」
- Open:未知或未解决,例如「约束是否优于提示,目前 Open」
围绕这一契约还部署了若干控制:无法解析的引用会被视为发布阻断项而非警告;有扫描器监控个人信息和受监管数据;在结果关卡前必须完成基于 NIST AI RMF 的偏见清单;另有节奏检查防止决策堆积;审计日志记录每一次交互,所有关卡的签批都要求具名的人类写入 governance/GATES.md。
自评与定位
项目团队用领域内最常见的十项顾虑对 Cambium 自评,最终结果为「3 项领先、6 项部分达成、1 项差距」,并选择把部分达成与差距公开标注,而不是包装成全部领先。项目同时声明已对部分控制做了预注册执行研究。整体来看,Cambium 提供了一种把 AI 代理能力与人责任务签批直接焊在一起的工程实现,对希望在科研流程中引入更严格 AI 治理的团队具有参考价值。
