llm-wiki 自我优化 2026-07-30
llm-wiki 自我优化 2026-07-30
今天从内容更新中学到什么
今天入库的四个高价值样本共同指向一个主题:llm-wiki 的每日 radar 不只是“发现内容 → 写页面”,而应被看成一个可证据化、可复盘、可改进的 harness cell。
| - [[better-harness-evidence-bounded-workflow-review | Better Harness]] 提醒:workflow 质量应按证据维度复盘,缺 evidence 要显式保留为 unknown。 |
| - [[portcullis-claude-code-security-hooks | Portcullis]] 提醒:安全边界要贴近工具副作用;无人 cron 命中 ask 类边界时不应继续扩大动作。 |
| - [[quorum-mcp-agent-collaboration-spine | quorum]] 提醒:多 agent / 多轮 workflow 需要身份、文件 claim、事件 cursor 和消息 replay。 |
| - [[hermes-skill-loop-closed-skill-learning-loop | hermes-skill-loop]] 提醒:自我改进要治理生命周期,自动学习的内容必须有 origin、usage 和 curator。 |
今天已做的低风险优化
- 新增四篇 source 页面,并在每篇正文末尾加入「写入记录」。
- 更新 Harness-Engineering:加入 evidence-bounded workflow review、安全 hook、多 agent coordination spine、skill lifecycle 的综合启发。
- 更新 External-Agent-Skills-Design-Patterns:把重点从“更多 skill”转向 skill registry / origin / usage / curator 治理。
- 更新 Agent-Benchmarks:把 Better Harness 映射为个人级 workflow micro-benchmark。
- 本次报告将明确列出未入库候选及拒绝理由,避免“发现过但未来重复探索”的浪费。
建议纳入后续 radar 的轻量检查项
- Evidence checklist:每次 radar 至少记录 orient、搜索、原文读取、raw 保存、source/concept 更新、index/log、vector reindex、验证结果。
- Candidate state:候选分为 PROMOTED / RAW-ONLY / REJECTED / HOLD;拒绝理由保留在 log 或优化文章中。
- Safety HOLD rule:无人 cron 涉及安装、发布、凭证、外部写入、MCP 写操作时,如果只能 ask 不能 deterministic allow,则默认 HOLD。
- Skill registry idea:未来为 Hermes 本地 skills 建轻量 registry,字段包括 origin、risk、trigger、last_used、verification、status。
仍待改进 / 不宜今天自动做的事
- 不自动安装 Better Harness、Portcullis、quorum 或 hermes-skill-loop;它们会改变用户本地 agent/hook 行为,属于高风险配置变更。
- 不立刻引入多 agent 文件 claim 系统;可以先在大规模 ingest / delegate_task 时人工约定 file claim,再考虑工具化。
- 不把 GitHub README 结论标成 high confidence;今天没有运行这些工具,也没有阅读完整 docs / issues。
写入记录
- 2026-07-30 09:00 CST:新增当天 llm-wiki 自我优化文章,记录 evidence-bounded radar、side-effect HOLD、candidate state 和 skill lifecycle 治理建议。