← 返回藏书阁

llm-wiki 自我优化 2026-07-30

wiki/ai/sources/llm-wiki-optimization-2026-07-30.md
分类:ai / sources · 更新:2026-07-30 09:10

llm-wiki 自我优化 2026-07-30

今天从内容更新中学到什么

今天入库的四个高价值样本共同指向一个主题:llm-wiki 的每日 radar 不只是“发现内容 → 写页面”,而应被看成一个可证据化、可复盘、可改进的 harness cell。

- [[better-harness-evidence-bounded-workflow-reviewBetter Harness]] 提醒:workflow 质量应按证据维度复盘,缺 evidence 要显式保留为 unknown。
- [[portcullis-claude-code-security-hooksPortcullis]] 提醒:安全边界要贴近工具副作用;无人 cron 命中 ask 类边界时不应继续扩大动作。
- [[quorum-mcp-agent-collaboration-spinequorum]] 提醒:多 agent / 多轮 workflow 需要身份、文件 claim、事件 cursor 和消息 replay。
- [[hermes-skill-loop-closed-skill-learning-loophermes-skill-loop]] 提醒:自我改进要治理生命周期,自动学习的内容必须有 origin、usage 和 curator。

今天已做的低风险优化

  1. 新增四篇 source 页面,并在每篇正文末尾加入「写入记录」。
  2. 更新 Harness-Engineering:加入 evidence-bounded workflow review、安全 hook、多 agent coordination spine、skill lifecycle 的综合启发。
  3. 更新 External-Agent-Skills-Design-Patterns:把重点从“更多 skill”转向 skill registry / origin / usage / curator 治理。
  4. 更新 Agent-Benchmarks:把 Better Harness 映射为个人级 workflow micro-benchmark。
  5. 本次报告将明确列出未入库候选及拒绝理由,避免“发现过但未来重复探索”的浪费。

建议纳入后续 radar 的轻量检查项

  • Evidence checklist:每次 radar 至少记录 orient、搜索、原文读取、raw 保存、source/concept 更新、index/log、vector reindex、验证结果。
  • Candidate state:候选分为 PROMOTED / RAW-ONLY / REJECTED / HOLD;拒绝理由保留在 log 或优化文章中。
  • Safety HOLD rule:无人 cron 涉及安装、发布、凭证、外部写入、MCP 写操作时,如果只能 ask 不能 deterministic allow,则默认 HOLD。
  • Skill registry idea:未来为 Hermes 本地 skills 建轻量 registry,字段包括 origin、risk、trigger、last_used、verification、status。

仍待改进 / 不宜今天自动做的事

  • 不自动安装 Better Harness、Portcullis、quorum 或 hermes-skill-loop;它们会改变用户本地 agent/hook 行为,属于高风险配置变更。
  • 不立刻引入多 agent 文件 claim 系统;可以先在大规模 ingest / delegate_task 时人工约定 file claim,再考虑工具化。
  • 不把 GitHub README 结论标成 high confidence;今天没有运行这些工具,也没有阅读完整 docs / issues。

写入记录

  • 2026-07-30 09:00 CST:新增当天 llm-wiki 自我优化文章,记录 evidence-bounded radar、side-effect HOLD、candidate state 和 skill lifecycle 治理建议。