← 返回藏书阁

llm-wiki 自我优化 2026-07-08

wiki/ai/sources/llm-wiki-optimization-2026-07-08.md
分类:ai / sources · 更新:2026-07-08 09:05

llm-wiki 自我优化 2026-07-08

今天从内容更新中学到什么

今天的高价值材料共同指向一个主题:agent 系统的下一层增量不是“更会生成”,而是“更会留下可诊断轨迹、被独立 review、在失败后带着定位证据恢复”。[[agenttether-graph-guided-runtime-repairAgentTether]] 给出 runtime repair 和 Repair Memory;[[traceprobe-trajectory-structure-diagnosticsTraceProbe]] 给出 resolve rate 之外的轨迹诊断;[[swe-review-agentic-code-reviewSWE-Review]] 给出 generate-review-revise 闭环;[[lilian-weng-harness-engineering-self-improvementLilian Weng — Harness Engineering for Self-Improvement]] 则把这些都归入 harness 作为可优化的 self-improvement substrate。

已做的低风险优化

  1. 今天只晋升 4 个机制层材料,没有把 GitHub 搜索中的低星临时项目批量建页,避免薄页面污染。
  2. 新增来源页都明确写入“为什么重要 / 机制 / 与现有概念关系 / 可执行启发 / 失败边界”,保持深度门槛。
  3. 将雷达自我优化主题从“发现了什么”推进到“如何给 llm-wiki 自身加 trajectory diagnostics 与 review-revise gate”。

对雷达流程的调整建议

  • 给每日雷达增加轻量 trajectory checklist:orient、search existing、read primary、raw save、source/concept update、index/log、reindex,每项记录 PASS/HOLD/NA。
  • 对“来源页 + 概念页更新”增加一次独立 review pass,检查 wikilinks、frontmatter、写入记录和是否真的有 durable mechanism。
  • 后续可新建一个概念页“Agent Operation Telemetry”,把 runtime repair、trajectory diagnostics、review loop、verification membrane 统一管理;今天先不建,避免在单日材料不足时过早抽象。

未解问题

如何在不显著增加 cron 成本的情况下保留足够轨迹证据?最小方案可能不是保存完整 tool trace,而是在 log 中记录关键 gate 的 verdict 和文件路径。

写入记录

  • 2026-07-08 09:00 CST:记录今天从 runtime repair、trajectory diagnostics、agentic review 和 harness self-improvement 中得到的 llm-wiki 流程优化启发。