llm-wiki 自我优化 2026-07-27
llm-wiki 自我优化 2026-07-27
今天从内容更新中学到什么
今天入库的材料共同提示:agent workflow 的下一步优化不只是“更强模型 / 更多工具”,而是对 预算、catalog、artifact、知识边界 做治理。
| - [[token-diet-token-efficiency-skill | token-diet]] 说明 token budget 是 harness 资源:少叙事、少重复读、少无边界工具调用,但不能少证据、少测试、少错误原文。 |
| - [[sail-skill-secure-ai-lifecycle | SAIL Skill]] 说明安全类 skill 要有 catalog-backed grounding:风险 ID、生命周期阶段、标准映射和 mitigation,而不是模型自由列清单。 |
| - [[sitegeist-visual-diversity-benchmark | Sitegeist]] 说明开放式生成 benchmark 要检查 artifact integrity 和模式重复,而不只是能 build。 |
| - [[design-harness-evidence-board | design-harness]] 说明复杂设计需要 source / idea / output 的证据板,并把 human judgment 与 agent synthesis 分离。 |
| - [[okf-gem-local-knowledge-bundles | OKF Gem]] 说明项目知识应有 repo-local、typed、lint/search/graph 可用的 knowledge bundle;全局 llm-wiki 不应承载所有项目细节。 |
今天实际优化了什么
- 新增 5 个 source 页面,将 token efficiency、secure lifecycle skill、visual diversity benchmark、evidence design board、repo-local knowledge bundle 分别沉淀,而不是合并成泛泛“新 agent skill 工具”。
- 更新 External-Agent-Skills-Design-Patterns:新增 token/context impact 与 grounding substrate 作为外部 skill 评估维度。
- 更新 Harness-Engineering:补充 token budget、artifact diversity、security catalog、knowledge boundary 四类合同。
- 更新 Agent-Benchmarks:补充视觉生成 benchmark 的 artifact diversity / integrity 和 duplicate audit。
- 未直接安装任何外部 skill / plugin;这属于 profile 或工具链高影响改动,需用户确认。
对 radar / llm-wiki 的低风险修正
今天的低风险修正是:把“页面膨胀/重复主题”作为 radar 自评项写入 Agent-Benchmarks 与 Harness-Engineering。原因是最近多日 AI radar 都在 harness / skill / control plane 附近扩展,虽然每篇有独立机制,但后续应主动判断何时需要 comparison 或 consolidation。
可继续机械化的检查:
- source-note duplicate audit:按标题和摘要检查连续 7 天新增 source 是否只是同一主题换名。
- report token discipline:日报保留发现、入库、未入库、验证与文件路径,减少过程性叙事。
- skill adoption gate:任何外部 skill 进入 Hermes profile 前,先检查 token/context impact、permission manifest、dependency/version/hash、grounding substrate、最小 eval。
仍需人工确认或后续验证
- 是否要把 design-harness 的 evidence board 模式用于某个具体产品/系统设计项目;无人 cron 不应擅自改变 vault 结构。
- 是否要为 llm-wiki 增加 repo-local bundle / OKF-like 导出;这需要决定目标仓库和格式。
- 是否要对 token-diet 做本地 A/B 测试;不建议直接安装 always-on 外部规则。
- arXiv API 今天仍返回 429/timeout;本次没有晋升新论文。OpenAI / DeepMind RSS 或官网抓取也部分失败/低相关,未作为深度来源。
写入记录
- 2026-07-27 09:07 CST:新增当天优化文章,总结 token budget、security catalog、visual benchmark、evidence board 和 repo-local knowledge bundle 对 llm-wiki radar 的自我优化启发。