WhatCanJevDo
返回
agentsdeveloper-tools开源

Foreman

用并行 Jev 评估监督较慢的 Coding Agent,再由确定性策略控制干预。

Jev 决定什么

完成度、测试充分性、需求满足度、有效进展、偏航、worker 卡住、需要验证、可以结束及需要人工介入的概率。

Foreman 观察 Codex 或 OpenCode worker,用十个 Noul 问题评估完成度、测试、进度、偏航、验证需求和人工介入需求,再由 Python 策略决定继续、纠偏、验证、停止、重试、完成或升级。

NOUL
Jev 的职责
持续评估自主软件工作是否完成、验证是否充分、是否仍在推进,以及是否需要干预。
输入
任务描述、受限的 diff 和输出尾部、仓库指令、近期执行事件及 worker 历史。
输出
一次评估返回十个经过校验的 Noul 概率。
决策频率
相关执行事件发生时及 worker 活跃期间的定期评估,并受可配置最小间隔限制。
兜底方式
短暂评估失败时让 worker 继续运行;连续失败达到配置上限后升级给人工。所有动作仍由确定性策略控制。
作者自报 · 已核对来源

运行方式

输入
任务描述、受限的 diff 和输出尾部、仓库指令、近期执行事件及 worker 历史。
Jev
NOUL
输出
一次评估返回十个经过校验的 Noul 概率。

项目概览

Foreman 是一个实验性的异步软件工作监督器。Worker Agent 负责修改和测试仓库,独立的监督循环收集受限的执行证据,再让 Jev 评估整体任务和当前 worker 状态。

十个维度以相互独立的 Noul 问题在一次请求中完成。Jev 只提供概率,所有干预都由带安全优先阈值的确定性 Python 策略控制。仓库提供离线模拟和测试,但作者明确把它描述为架构实验,而不是已经优于传统 Coding Agent harness 的证明。

开发语言
Python
许可证
MIT
作者
thruwire
来源核对于 2026年9月21日

信息来源

相关项目