← 返回藏书阁

AgentOps — bounded coding-agent operating loop and skills bundle

wiki/ai/sources/agentops-bounded-operating-loop.md
分类:ai / sources · 更新:2026-07-24 09:09

AgentOps — bounded coding-agent operating loop and skills bundle

一句话结论

AgentOps 把 coding agent 的工作抽象成一个可复用操作循环:RPI -> Plan -> Implement -> fresh Validate -> durable verdict -> report and stop。它以 skill/plugin 形式安装到 Claude Code、Codex、Cursor 等 runtime 中,强调“一个意图、一个有边界的构建、一个新鲜上下文 judge、一个持久 verdict”。这与 Harness-EngineeringLoop-EngineeringExternal-Agent-Skills-Design-Patterns 高度相关。

为什么对用户重要

Hermes 的全局操作纪律已经要求“交付物必须有真实工具输出验证”。AgentOps 的价值在于把这个纪律压缩成一个可安装、可运行、可复用的 workflow skill,并把 intent snapshot、fresh validation、durable verdict、policy hooks 串起来。对用户的 llm-wiki radar 而言,它提示每日 cron 不应只“发现并写页面”,还应把候选意图、晋升标准、验证证据、未入库原因和停止条件写成外部状态。

机制 / 一阶原理

AgentOps 的核心不是多 agent 编排本身,而是把完成定义从作者声明改成外部 verdict

  1. Intent snapshot:Plan 阶段把用户意图、BDD acceptance、领域语言或原始 issue/chat bytes 固化到 bead / .agents/ao/intents/sha256/。这避免执行中目标漂移。
  2. Bounded build:Implement 只针对一个明确 intent 工作,降低“顺手重构/扩范围”的风险。
  3. Fresh Validate:验证必须在新上下文运行,避免作者会话自证;同模型或不同模型都可,但上下文要隔离。
  4. Durable verdict:结果不是口头“done”,而是可追溯 verdict/ledger。
  5. Admission-control hooks:PreToolUse policy dispatcher 阻止已知破坏性命令或错误路径,把 prompt 纪律前移到确定性 hook。

这个模式把 AI-Code-Review 的 evidence map 和 independent verdict 落到了 daily operating loop。

与现有 wiki 概念的关系

  • Loop-Engineering:AgentOps 是单任务内的 micro-loop;真正长期 loop 可以在外层调度多个 AgentOps run。
  • Harness-Engineering:它把 policy hooks、intent ledger、fresh judge 和 durable verdict 组合成 verification membrane。
  • External-Agent-Skills-Design-Patterns:它是“skill 作为 workflow contract”的强样本,包含触发、安装、hooks、fallback 和治理说明。
  • AI-Code-Review:fresh Validate 与 independent verdict 直接对应“作者不能自证完成”。

对 Hermes / llm-wiki 的可执行启发

  1. 为 wiki radar 建一个轻量 intent/decision ledger:每天保存候选、打分、晋升/不晋升原因,避免这些判断只存在于最终日报和 log.md 中。
  2. 验证者上下文分离:内容写入后至少做程序化检查(文件存在、wikilink、frontmatter、写入记录、vector reindex),不要只靠写作者自述。
  3. PreToolUse 风险钩子:对 raw/ 修改、跨 profile 写入、发布到 CVM、删除/归档、多文件迁移等动作,使用确定性 guard 而不是自然语言提醒。
  4. Report and stop:无人 cron 完成后应明确停止,不继续扩大搜索范围;未满足证据时输出 HOLD/未入库,而不是勉强深挖。

深度判断

值得晋升:AgentOps 将多个近期 wiki 主题(intent、fresh context、verification membrane、skill bundle、policy hook、durable ledger)合成了一个可执行操作循环。它对 Hermes 自身工作方式具有可迁移性,尤其是“意图快照 + 新鲜验证 + 持久 verdict”。

失败模式 / 边界条件

  • skill 安装不等于质量保证:如果 runtime 没有真正启用 hooks 或用户绕过流程,AgentOps 会退化为 prompt 建议。
  • fresh judge 仍可能相关错误:同模型/同仓库上下文可能重复作者偏差,关键路径仍需真实测试、CI 或人工 review。
  • ledger 隐私与污染:intent snapshot 可能包含用户敏感信息;hash/路径治理必须避免把隐私材料扩散到公开 repo。
  • README 证据限制:当前基于 README,未执行其 skill;confidence 设为 medium。

写入记录

  • 2026-07-24 09:01 CST:新增 AgentOps 源页面,聚焦 RPI/Plan/Implement/fresh Validate/durable verdict、policy hooks 与 Hermes radar ledger 启发。