llm-wiki 自我优化 2026-07-26
llm-wiki 自我优化 2026-07-26
今天从内容更新中学到什么
今天入库的材料共同指向一个更底层的趋势:agent workflow 的可靠性正在从“更好的 agent 提示词”迁移到 事实路由、session evidence、human gate、runner-observed verification、结构化 context pack。
对 llm-wiki 来说,这意味着每日 radar 不应只优化搜索词和页面摘要,而应把自身逐步变成一个可观察 workflow:每一步是否完成、依据什么事实前进、哪些内容因预算未读、哪些 claim 由工具输出支撑、哪些动作因高风险进入 HOLD。
今天实际优化了什么
- 新增 5 个 source 页面,将 Agent Graph、agent-session-io、Approving、ContextIQ、AI Dev Team 分别沉淀为 route、session、approval、code-context、runner verification 五类机制,而不是合并成“agent 工具合集”。
- 更新 Harness-Engineering:补充 fact-routed workflow、session evidence、human gate 与 runner-observed verification。
- 更新 Context-Engineering:补充 route-first context loading、AST code graph、context pack 和 adoption/savings evidence。
- 保留未入库原因:Squint、QE agents workflow 等材料有价值,但今日优先选择更底层、可复用于 Hermes/llm-wiki 的 substrate;未读/未晋升项目不被伪装成已验证知识。
对 radar / llm-wiki 的低风险修正
今天已执行的低风险修正是:把“完成声明必须绑定 runner/tool output”的原则写回 Harness 页面,并在本页记录本次 workflow 的 evidence boundary。后续每日 radar 可以继续沿这个方向增加轻量 context manifest:
- deterministic evidence:读过
_index.md/log.md,保存 raw+sha256,写入页面,更新 index/log,重建 vector index 的真实命令输出。 - LLM synthesis:深度判断、概念关系、未入库原因、实践启发。
- dropped context:因为网络失败、rate limit、低价值或预算限制未读/未晋升的来源。
仍需人工确认或后续验证
- 是否要把 Agent Graph / ContextIQ / sessionio 真正在一个小型 sandbox repo 里 smoke test。无人 cron 不应直接安装到主 Hermes 环境。
- 是否要为 llm-wiki 新增一个机器可读
radar-state/或_meta/context-manifest/目录,记录每日 route facts;这会改变 vault 结构,建议先人工确认。 - GitHub API 今天已触发 rate limit,原文读取主要依赖 raw.githubusercontent.com;arXiv API 返回 429/timeout,因此今日没有晋升新论文。
写入记录
- 2026-07-26 09:00 CST:新增当天优化文章,总结 fact-routed workflow、session evidence、human gates、runner verification 和 AST context pack 对 llm-wiki radar 自评的启发。