agentsdeveloper-tools开源
Foreman
用并行 Jev 评估监督较慢的 Coding Agent,再由确定性策略控制干预。
Jev 决定什么
完成度、测试充分性、需求满足度、有效进展、偏航、worker 卡住、需要验证、可以结束及需要人工介入的概率。
Foreman 观察 Codex 或 OpenCode worker,用十个 Noul 问题评估完成度、测试、进度、偏航、验证需求和人工介入需求,再由 Python 策略决定继续、纠偏、验证、停止、重试、完成或升级。
NOUL
- Jev 的职责
- 持续评估自主软件工作是否完成、验证是否充分、是否仍在推进,以及是否需要干预。
- 输入
- 任务描述、受限的 diff 和输出尾部、仓库指令、近期执行事件及 worker 历史。
- 输出
- 一次评估返回十个经过校验的 Noul 概率。
- 决策频率
- 相关执行事件发生时及 worker 活跃期间的定期评估,并受可配置最小间隔限制。
- 兜底方式
- 短暂评估失败时让 worker 继续运行;连续失败达到配置上限后升级给人工。所有动作仍由确定性策略控制。
运行方式
输入
任务描述、受限的 diff 和输出尾部、仓库指令、近期执行事件及 worker 历史。
Jev
NOUL
输出
一次评估返回十个经过校验的 Noul 概率。
项目概览
Foreman 是一个实验性的异步软件工作监督器。Worker Agent 负责修改和测试仓库,独立的监督循环收集受限的执行证据,再让 Jev 评估整体任务和当前 worker 状态。
十个维度以相互独立的 Noul 问题在一次请求中完成。Jev 只提供概率,所有干预都由带安全优先阈值的确定性 Python 策略控制。仓库提供离线模拟和测试,但作者明确把它描述为架构实验,而不是已经优于传统 Coding Agent harness 的证明。
- 开发语言
- Python
- 许可证
- MIT
- 作者
- thruwire
来源核对于 2026年9月21日
信息来源
相关项目
开发工具
NOUL
fast-jev-compaction
不重写保留下来的上下文,只清理已经失去价值的 Coding Agent 工具历史。
Jev 决定什么
每个旧工具调用及其结果是否还应留在上下文中。
作者自报 · 已核对来源5.3k
开发工具
NOULCHOICESCORE
Jev Review
不用一条超长 reviewer prompt,而是用一连串类型化小判断组成代码审查流程。
Jev 决定什么
什么有风险、哪些文件和证据重要、可能如何失效、严重程度以及由谁复核。
作者自报 · 已核对来源409
开发工具
CHOICESCORENOUL
Distill
用受限的 Jev 判断处理 Coding Agent 的任务路由、推理强度和上下文保留。
Jev 决定什么
本次调用使用哪个已配置模型和 effort、哪些证据值得关注、是否需要再试一次,以及哪些上下文应被保留。
作者自报 · 已核对来源继续阅读