llm-wiki 自我优化 2026-08-03
llm-wiki 自我优化 2026-08-03
今天从内容更新中学到什么
今天的高价值信号集中在“外部 agent 工具进入生产前如何被治理”:awesome-agentic-devops 提供 operator-safety catalog,claude-starter-kit 提供 tool-level gates,record-and-replay-skill 提供从人类示范到 skill 的证据采集路径,ultracodex 提供跨宿主 agent-as-function / workflow substrate。
共同启发是:llm-wiki 的技术雷达不应只判断“这个项目有趣吗”,还要判断“这个项目如果被用户/agent 采用,会改变哪些权限、上下文、验证和审计边界”。外部工具的正式页面应逐步包含:来源可信度、权限范围、approval/audit 证据、是否建议安装、是否只建议学习设计模式。
今天已做的低风险优化
- 新增 4 篇 source 页,并把原始 README 存入
raw/articles/,保留 sha256。 - 更新 Harness-Engineering:补充 DevOps/MCP catalog admission control 与 tool-level gates。
- 更新 Agentic-Coding:补充 agent-as-function 与 guarded starter kit 的双层结构。
- 更新 External-Agent-Skills-Design-Patterns:新增“从用户演示到可验证 skill”和“operator-safety score”两个模式。
- 更新 Context-Engineering:补充示范轨迹和 catalog rubric 也是上下文。
- 修正本次新增页面中的自链接/不存在 wikilink,避免制造新 broken links。
对后续 radar 的调整建议
- 关注名单应提高权重:
agent-as-function、record and replay skill、operator-safety catalog、tool-level gates、DevOps MCP safety、cross-host agent workflow。 - 对 awesome-list / starter-kit 类项目,默认只提炼设计模式,不建议自动安装;除非读取 hooks/scripts 并做 sandbox 验证。
- 每次外部 tool/skill 入库时,增加一个轻量
operator-safety判断:official/source、permissions、approval、audit、write capability、install risk。
未做或待人工确认
- 未安装任何外部 repo;本次只做 README 级研究入库,置信度保持 medium。
- GitHub 搜索和 README 抽取可用;arXiv API 本次多次超时,未把 arXiv 结果作为候选依据。
log.md已 671 行,超过 500 entries;这是维护问题,建议单独做 log rotation,避免在内容雷达 cron 中高风险改动历史日志。
写入记录
- 2026-08-03 09:00 CST:生成当天 llm-wiki 自我优化文章,总结外部 agent 工具 admission control、tool-level gates、示范到 skill、跨宿主 workflow substrate 对雷达和 wiki 结构的优化启发。