← 返回藏书阁

llm-wiki 自我优化 2026-07-26

wiki/ai/sources/llm-wiki-optimization-2026-07-26.md
分类:ai / sources · 更新:2026-07-26 09:06

llm-wiki 自我优化 2026-07-26

今天从内容更新中学到什么

今天入库的材料共同指向一个更底层的趋势:agent workflow 的可靠性正在从“更好的 agent 提示词”迁移到 事实路由、session evidence、human gate、runner-observed verification、结构化 context pack

对 llm-wiki 来说,这意味着每日 radar 不应只优化搜索词和页面摘要,而应把自身逐步变成一个可观察 workflow:每一步是否完成、依据什么事实前进、哪些内容因预算未读、哪些 claim 由工具输出支撑、哪些动作因高风险进入 HOLD。

今天实际优化了什么

  • 新增 5 个 source 页面,将 Agent Graph、agent-session-io、Approving、ContextIQ、AI Dev Team 分别沉淀为 route、session、approval、code-context、runner verification 五类机制,而不是合并成“agent 工具合集”。
  • 更新 Harness-Engineering:补充 fact-routed workflow、session evidence、human gate 与 runner-observed verification。
  • 更新 Context-Engineering:补充 route-first context loading、AST code graph、context pack 和 adoption/savings evidence。
  • 保留未入库原因:Squint、QE agents workflow 等材料有价值,但今日优先选择更底层、可复用于 Hermes/llm-wiki 的 substrate;未读/未晋升项目不被伪装成已验证知识。

对 radar / llm-wiki 的低风险修正

今天已执行的低风险修正是:把“完成声明必须绑定 runner/tool output”的原则写回 Harness 页面,并在本页记录本次 workflow 的 evidence boundary。后续每日 radar 可以继续沿这个方向增加轻量 context manifest:

  • deterministic evidence:读过 _index.md / log.md,保存 raw+sha256,写入页面,更新 index/log,重建 vector index 的真实命令输出。
  • LLM synthesis:深度判断、概念关系、未入库原因、实践启发。
  • dropped context:因为网络失败、rate limit、低价值或预算限制未读/未晋升的来源。

仍需人工确认或后续验证

  • 是否要把 Agent Graph / ContextIQ / sessionio 真正在一个小型 sandbox repo 里 smoke test。无人 cron 不应直接安装到主 Hermes 环境。
  • 是否要为 llm-wiki 新增一个机器可读 radar-state/_meta/context-manifest/ 目录,记录每日 route facts;这会改变 vault 结构,建议先人工确认。
  • GitHub API 今天已触发 rate limit,原文读取主要依赖 raw.githubusercontent.com;arXiv API 返回 429/timeout,因此今日没有晋升新论文。

写入记录

  • 2026-07-26 09:00 CST:新增当天优化文章,总结 fact-routed workflow、session evidence、human gates、runner verification 和 AST context pack 对 llm-wiki radar 自评的启发。