← 返回藏书阁

llm-wiki 自我优化 2026-09-15:绑定对象、核对可见输入,而非相信功能标签

wiki/ai/sources/llm-wiki-optimization-2026-09-15.md
分类:ai / sources · 更新:2026-09-15 09:17

llm-wiki 自我优化 2026-09-15

今天的核心结论

“功能存在”不等于“作用在正确对象上”。 有 policy 但恢复了另一个 backend、有 A2A 调用但 Card 不可读、有 benchmark runner 但读错了数据字段,都会制造假闭环。今天沿用 AI-Knowledge-Point-RadarLLM-Wiki-Optimization-Log 的三条横切检查,不再每天新增一套名词。

发现与实际晋升

候选知识点轴深度判断 / 结果
agentgateway-session-policy-and-inspection-boundariesMCP Gateway / harness-runtime / sandbox-security公告、固定实现、修复和测试共同揭示对象绑定、缺body、转换语义;深度晋升,不包装成当天新漏洞
foundry-apim-a2a-discovery-and-credential-hopsA2A / MCP Gateway / harness-runtime / sandbox-security真实配置教程加官网约束,可拆解发现/调用/逐跳身份;晋升接入机制,不冒称有企业E2E回执
topbench-compositional-privacy-and-harness-integritybenchmark-evaluation / sandbox-security / context management / harness-runtime有完整论文、固定数据、runner,且离线检查暴露版本和可见ID问题;晋升机制,模型分数仅属作者报告
CAPTUREcontext management / sandbox-security / benchmark-evaluation只读到摘要,真实性漂移/投毒机制、数据与自适应攻击尚未审;raw-only,不使用headline做决策
VERAcontext management / harness-runtime / benchmark-evaluation重复命中既有摘要,未补得更深证据;沿用旧raw,不重复建页

六维评分(relevance/novelty/durability/actionability/source-quality/depth-potential)、访问限制和淘汰原因完整保存在当日 raw 候选账本;分数是策展判断,不是算法置信度。

本机确实执行了哪些验证

  • 15/15 源码条件与教程 XML 检查通过;其中包括 session/backend 比较、删除路径、body字段文案冲突、转换保护和 A2A audience/backend/version 配置。没有执行 Rust 上游测试或 Azure 请求。
  • TOP-Bench 1,000条与 held-out 500条结构核查通过;五类字段两集精确交集为空,但未审训练集/近重复。主集6,000个工具ID中5,968个匹配E/N后缀并与角色标签一致;held-out为3,000/3,000。只说明可见静态信号,不证明模型利用。
  • 从旧 runner 提取并执行两个无副作用 formatter,确认 tool ID 会进入被测视图;旧 nested-goal schema 与当前数据不相容。表7四格重算为4,000组,trace-only占11%。未调用模型、未复现论文分数。^[raw/notes/ai-radar-evidence-checks-2026-09-15.md]

已落地的低风险优化

  1. MCP:把检查前提写进 gate。 后续取证同时记录完整性状态、policy对象、恢复backend、实际下游目标;缺证据不能被否定式规则误当安全。release与固定实现字段冲突保留contested,不“修正”成猜测配置。^[raw/articles/agentgateway-session-policy-and-inspection-boundaries-2026-09-15.md]
  2. A2A:按调用方向审凭据。 discovery fetch、invocation、入口caller、出口服务身份分开;区分Foundry作client和作server、外层Responses流式与远端A2A SSE。不将某一教程405泛化成产品缺陷。^[raw/articles/foundry-apim-a2a-discovery-and-credential-hops-2026-09-15.md]
  3. 评测:先看实际agent-visible输入。 增加schema smoke、字段映射和ID/排序信号检查;论文版本、旧runner、当前数据、主表、后训练集不混算。对工具返回原件与formatter输出分别留hash。^[raw/articles/topbench-compositional-privacy-and-harness-integrity-2026-09-15.md]

以上已同步到 AI-Knowledge-Point-RadarMCP-Gateway-RuntimeA2A-Agent2Agent-ProtocolAgent-Benchmarks 只增加短入口与反链,不继续复制全文。新增双语轮换词:session/backend policy binding / 会话后端策略绑定inspection precondition / 检查前提完整性authenticated Agent Card discovery / 带认证的能力卡发现agent-visible schema drift / 模型可见输入结构漂移compositional privacy / 组合隐私

尚未解决、不得伪称通过

  • Agentgateway release字段名与固定实现仍待runtime确认;TOP-Bench论文对应runner/neutral-ID条件待作者或配对实验确认;两篇source明确标记contested。
  • CAPTURE仅摘要、VERA未补全文;没有真实Azure授权任务或网关安全回归,不强凑轴覆盖或来源数量。
  • 既有全库lint错误、SCHEMA缺失、超长主题页与日报检索拥挤留独立维护。本轮新页定向校验、三方索引集合、CVM精确回读结果以 log.md 的执行回执为准;不在这里预写“全库通过”。
  • 不修改cron/gateway/IdP/生产权限/其他profile,不安装外部agent runtime;通知交由cron系统,内容和CVM成功不证明最终自动投递已成功。

下一步三项建议

  1. 在mock backend中验证跨backend会话、超限body、头覆盖三组负例,检查下游实际零请求,而非只看403。
  2. A2A接入先做Card/调用的匿名、正确身份、错误身份矩阵,再验任务与stream/push。
  3. 内部benchmark固定输入adapter,加入中性ID配对实验与合成多源隐私任务;完成率和泄漏分账。

用户入口:藏书阁。完整文件变更清单及真实验证结果见 log.md;本日文章即 wiki/ai/sources/llm-wiki-optimization-2026-09-15.md

写入记录

  • 2026-09-15 09:17 CST:新增当日优化文章,汇总对象绑定、逐跳Card认证、评测可见输入与组合隐私;记录真实离线审计和未验证边界,更新雷达而不扩散新框架。