octopus-skill — host-agnostic long-horizon agent discipline
octopus-skill — host-agnostic long-horizon agent discipline
一句话结论
octopus-skill 是一组面向长周期 agent 工作的跨宿主 prompt/skill 方法库。它把“一个大脑,多只手臂”作为隐喻:核心 methodology 保持一致,再编译到 Claude Code、grok、Cursor、Codex 等不同 host 的 loop / goal 形态。它值得入库,因为它明确把 Loop-Engineering 和 External-Agent-Skills-Design-Patterns 中的纪律抽象成可移植、可裁剪、拒绝膨胀的 skill library。
为什么对用户重要
Hermes 的技能体系和 llm-wiki radar 本身也面临同一个问题:同一套方法论要在不同执行上下文中复用,例如定时 cron、交互式 Feishu thread、代码修改任务、网页读取、wiki ingest、发布到 CVM。octopus 的启发是:不要为每个 runtime 写一堆互相漂移的 prompt,而应维护一个核心方法论层,再为不同宿主生成轻量 adapter。
机制 / 一阶原理
README 中最有价值的不是某个具体 prompt,而是三层设计:
- Brain / methodology:核心规则解释“为什么存在”,并绑定具体失败模式,例如假完成、测试剧场、范围膨胀、没有 owner red line。
- Arms / host dialects:不同宿主有不同能力:有的支持
/loop,有的支持/goal,有的有 stop/notification hook。adapter 只处理宿主差异,不复制整套知识。 - Durable files as coordination boundary:loop-graph 使用 executor node + clean-context supervisor node,通过持久文件单向传递 directives,避免同一上下文互相污染。
- Anti-bloat governance:没有真实 consumer / proven run 的 prompt 不进入库。这个 admission rule 对 agent skill 生态尤其重要。
这本质上是把 Context-Engineering 的渐进披露和 Loop-Engineering 的外部状态结合起来。
与现有 wiki 概念的关系
- 对 Loop-Engineering:octopus 提供 clean-context supervisor、durable ledger、owner-gated convergence 的具体 skill 形态。
- 对 External-Agent-Skills-Design-Patterns:它强化了“skill 不是 junk drawer”,必须有触发、宿主适配、consumer 证明和反膨胀治理。
- 对 Agentic-Coding:长任务最危险的是看似持续推进但没有收敛;octopus 的 supervisor/executor split 是一种收敛控制。
- 对 Harness-Engineering:host dialects 说明 harness 必须尊重 runtime 能力,而不是假设所有 agent 都有相同工具/stop semantics。
对 Hermes / llm-wiki 的可执行启发
- 把 llm-wiki skill 拆成 methodology + adapters:核心 ingest/query/lint 原则应稳定;cron、交互、批量书籍摄入、CVM 发布只是不同 adapter。
- 新增 skill 需要真实 consumer 证明:不要因为 radar 发现一个有趣 prompt 就安装;必须有用户任务或测试样例证明它会被使用。
- 引入 clean-context verifier 模式:对于大规模 wiki 更新,可用单独验证脚本/子任务检查新增页面,而不是让写作者自己口头保证。
- 反膨胀指标:每日 radar 不应无限扩关注名单;应记录哪些来源连续低价值并降权。
深度判断
值得晋升:octopus-skill 的 durable value 在于 skill library governance 和 host-agnostic methodology,而不是 README 里的单个 prompt。它能帮助用户未来整理 Hermes skills:核心方法论集中维护,宿主差异显式隔离,只有被实际任务证明的 prompt 才进入库。
失败模式 / 边界条件
- 过度抽象:如果 methodology 太抽象,adapter 可能无法覆盖具体工具约束。
- prompt 纪律仍非强制控制:除非宿主有 hook / tool guard / verifier,skill 规则仍可能被模型忽略。
- 跨宿主语义不一致:同一规则在 Claude Code、Codex、grok 中的执行语义可能不同,需要 host-specific eval。
- README 证据限制:当前基于 README,尚未验证实际技能安装和运行效果;confidence 设为 medium。
写入记录
- 2026-07-24 09:01 CST:新增 octopus-skill 源页面,聚焦跨宿主 skill 方法论、clean-context supervisor、durable files 与反膨胀治理。