← 返回藏书阁

octopus-skill — host-agnostic long-horizon agent discipline

wiki/ai/sources/octopus-skill-long-horizon-agent-discipline.md
分类:ai / sources · 更新:2026-07-24 09:09

octopus-skill — host-agnostic long-horizon agent discipline

一句话结论

octopus-skill 是一组面向长周期 agent 工作的跨宿主 prompt/skill 方法库。它把“一个大脑,多只手臂”作为隐喻:核心 methodology 保持一致,再编译到 Claude Code、grok、Cursor、Codex 等不同 host 的 loop / goal 形态。它值得入库,因为它明确把 Loop-EngineeringExternal-Agent-Skills-Design-Patterns 中的纪律抽象成可移植、可裁剪、拒绝膨胀的 skill library。

为什么对用户重要

Hermes 的技能体系和 llm-wiki radar 本身也面临同一个问题:同一套方法论要在不同执行上下文中复用,例如定时 cron、交互式 Feishu thread、代码修改任务、网页读取、wiki ingest、发布到 CVM。octopus 的启发是:不要为每个 runtime 写一堆互相漂移的 prompt,而应维护一个核心方法论层,再为不同宿主生成轻量 adapter。

机制 / 一阶原理

README 中最有价值的不是某个具体 prompt,而是三层设计:

  1. Brain / methodology:核心规则解释“为什么存在”,并绑定具体失败模式,例如假完成、测试剧场、范围膨胀、没有 owner red line。
  2. Arms / host dialects:不同宿主有不同能力:有的支持 /loop,有的支持 /goal,有的有 stop/notification hook。adapter 只处理宿主差异,不复制整套知识。
  3. Durable files as coordination boundary:loop-graph 使用 executor node + clean-context supervisor node,通过持久文件单向传递 directives,避免同一上下文互相污染。
  4. Anti-bloat governance:没有真实 consumer / proven run 的 prompt 不进入库。这个 admission rule 对 agent skill 生态尤其重要。

这本质上是把 Context-Engineering 的渐进披露和 Loop-Engineering 的外部状态结合起来。

与现有 wiki 概念的关系

  • Loop-Engineering:octopus 提供 clean-context supervisor、durable ledger、owner-gated convergence 的具体 skill 形态。
  • External-Agent-Skills-Design-Patterns:它强化了“skill 不是 junk drawer”,必须有触发、宿主适配、consumer 证明和反膨胀治理。
  • Agentic-Coding:长任务最危险的是看似持续推进但没有收敛;octopus 的 supervisor/executor split 是一种收敛控制。
  • Harness-Engineering:host dialects 说明 harness 必须尊重 runtime 能力,而不是假设所有 agent 都有相同工具/stop semantics。

对 Hermes / llm-wiki 的可执行启发

  1. 把 llm-wiki skill 拆成 methodology + adapters:核心 ingest/query/lint 原则应稳定;cron、交互、批量书籍摄入、CVM 发布只是不同 adapter。
  2. 新增 skill 需要真实 consumer 证明:不要因为 radar 发现一个有趣 prompt 就安装;必须有用户任务或测试样例证明它会被使用。
  3. 引入 clean-context verifier 模式:对于大规模 wiki 更新,可用单独验证脚本/子任务检查新增页面,而不是让写作者自己口头保证。
  4. 反膨胀指标:每日 radar 不应无限扩关注名单;应记录哪些来源连续低价值并降权。

深度判断

值得晋升:octopus-skill 的 durable value 在于 skill library governance 和 host-agnostic methodology,而不是 README 里的单个 prompt。它能帮助用户未来整理 Hermes skills:核心方法论集中维护,宿主差异显式隔离,只有被实际任务证明的 prompt 才进入库。

失败模式 / 边界条件

  • 过度抽象:如果 methodology 太抽象,adapter 可能无法覆盖具体工具约束。
  • prompt 纪律仍非强制控制:除非宿主有 hook / tool guard / verifier,skill 规则仍可能被模型忽略。
  • 跨宿主语义不一致:同一规则在 Claude Code、Codex、grok 中的执行语义可能不同,需要 host-specific eval。
  • README 证据限制:当前基于 README,尚未验证实际技能安装和运行效果;confidence 设为 medium。

写入记录

  • 2026-07-24 09:01 CST:新增 octopus-skill 源页面,聚焦跨宿主 skill 方法论、clean-context supervisor、durable files 与反膨胀治理。