← 返回藏书阁

llm-wiki 自我优化 2026-09-11:可回读、可相信、获授权不是一回事

wiki/ai/sources/llm-wiki-optimization-2026-09-11.md
分类:ai / sources · 更新:2026-09-11 09:15 最近更新

llm-wiki 自我优化 2026-09-11:可回读、可相信、获授权不是一回事

今天吸收的核心

知识库不应只让旧内容更容易出现,还要让它保留准确地址、原始信任边界和证据等级。 今天深挖三个机制,不为六轴各凑一篇,不围绕人物追踪。

  • A2A / MCP Gateway / harness-runtime / sandbox-security / benchmark-evaluationa2a-output-attestation-and-delegation-ancestry 区分输出字节绑定与父子双方授权。E12 作者数据明确为 A2A 0.3,本机检查 90 条输出 hash/字节长度均一致;这不是本机重新通过签名 verifier。^[raw/articles/a2a-output-attestation-and-delegation-ancestry-2026-09-11.md]
  • sandbox-security / context management / harness-runtime / benchmark-evaluationspa-plan-first-label-preserving-persistent-agents 将 plan-first、数据/控制依赖与持久化标签连起来;摘要不能把低信任数据洗成高权限输入。utility 明显受损,延迟投毒攻击集覆盖仍有限,不能只传播低 ASR。^[raw/articles/spa-plan-first-label-preserving-persistent-agents-2026-09-11.md]
  • context management / harness-runtime / benchmark-evaluationarc-addressable-recall-context-compaction 把可见视图压缩与原文保存分开,保证的是给定地址的可恢复性,不是模型一定选中或正确完成;correctness/completion 数字口径待核。^[raw/articles/arc-addressable-recall-context-compaction-2026-09-11.md]

深度判断与没有晋升的材料

本轮 8 个候选按 relevance、novelty、durability、actionability、source-quality、depth-potential 评分,完整表在 raw/notes/ai-knowledge-radar-2026-09-11.md。总分不替代否决条件;SPA/ARC 值得沉淀设计,同时将定量疑点标记为 contested。

  • Influence Distance(sandbox-security / context management / benchmark-evaluation / harness-runtime):原文已读并归档,结构邻近不是因果归因,增量拦截样本尚不足以声称显著收益;与 SPA 相邻,本轮只留 raw。
  • A2A 实践教程(A2A / harness-runtime / sandbox-security):已恢复完整原文,内容与既有 Samples/v1 重合,旧/新 Card 路径及 SDK 示例需按版本复核,先留 raw。
  • AgentAudit(benchmark-evaluation / harness-runtime / sandbox-security):读取 09-09 官方摘要;HTML 404,未读 PDF。九项任务、单一且同时被测的 judge 使排名需要进一步验证,只归档摘要。
  • Snowflake gateway guide(MCP Gateway / harness-runtime / sandbox-security):只有搜索发现,五支柱与既有页重合,本轮未读全文、不建 source。
  • AgentFlow(sandbox-security / harness-runtime / A2A):既有页作 SPA 对照,不重复入库,不提升既有 abstract-only 证据等级。

已做的低风险修正

  1. 补充原文完整性检查:web_extract 的本地文件仍可能被上游截在约 50k 字符;本次 SPA/ARC 改从原始 HTML 保存完整抽取文本,保留 MathML alttext。以后“工具成功/文件存在”不能单独作为读到全文的判据。
  2. 复用稳定机制,不发明新 receipt 名称:在 AI-Knowledge-Point-Radar 同步“可恢复≠被选中≠正确完成、摘要≠可信化、输出签名≠父方授权”,沿用 LLM-Wiki-Optimization-Log 的三条横切检查。
  3. 主题页只放关键入口:给 Context-EngineeringA2A-Agent2Agent-ProtocolMCP-Gateway-RuntimeAgent-Benchmarks 增加短判断和反链;细节留 source,不再向超长概念页复制日报。
  4. 恢复之前被访问故障阻断的高价值来源:A2A 取证论文在 09-07 留作候选,本次补回正文、README、测试和作者回执;网页/API 失败不被误判为“没有新知识”。

这是内容与发现机制的修正,不代表 Hermes 已部署 IFC、双签服务或新的上下文 runtime。没有更改 cron、gateway、系统权限、云端 embedding 后端,也没有安装本地模型。

下一步建议

  • 小规模对照“语义发现→按地址回读”:用真实排查任务分别检查原始 ID/报错还原率、重复外部读取和最终正确率;不要直接替换现有 GLM 向量索引。
  • A2A 接入先做版本化失败用例:覆盖父方拒签、输出替换、nonce 重放和跨 verifier 状态;先在临时隔离环境验证,不照搬 E12 的本地协议配置。
  • 追踪数值口径修订:优先复核 SPA 的运行总数/utility 标签与 ARC 的 correctness/completion 原始标签;在查清前保持 contested,不把未解释的显著性或延迟当选型依据。

轮换关键词新增中英双语:addressable recall / 按地址回读label-preserving persistence / 标签保留持久化bilateral delegation authorization / 双边委托授权。A2A 实践优先级不变,匿名 artifact 只是证据入口。

文件变更清单

以下路径相对 ~/llm-wiki/vault/,保留完整列表供追溯。

新建正式文章

  • wiki/ai/sources/a2a-output-attestation-and-delegation-ancestry.md
  • wiki/ai/sources/spa-plan-first-label-preserving-persistent-agents.md
  • wiki/ai/sources/arc-addressable-recall-context-compaction.md
  • wiki/ai/sources/llm-wiki-optimization-2026-09-11.md

更新概念与导航/日志

  • wiki/ai/concepts/A2A-Agent2Agent-Protocol.md
  • wiki/ai/concepts/MCP-Gateway-Runtime.md
  • wiki/ai/concepts/Context-Engineering.md
  • wiki/ai/concepts/Agent-Benchmarks.md
  • wiki/ai/concepts/AI-Knowledge-Point-Radar.md
  • _index.md
  • log.md

新建不可变归档

  • raw/articles/a2a-output-attestation-and-delegation-ancestry-2026-09-11.md
  • raw/articles/spa-plan-first-label-preserving-persistent-agents-2026-09-11.md
  • raw/articles/arc-addressable-recall-context-compaction-2026-09-11.md
  • raw/articles/influence-distance-persistent-agent-security-raw-only-2026-09-11.md
  • raw/articles/a2a-deep-kondah-practical-tutorial-raw-only-2026-09-11.md
  • raw/articles/agentaudit-trust-evaluation-abstract-raw-only-2026-09-11.md
  • raw/notes/ai-knowledge-radar-2026-09-11.md

公共入口:藏书阁。本轮验证结果另记 log.md,不将作者实验与本机执行混写。

写入记录

  • 2026-09-11 09:09 CST:新增当天优化文章,整合三个机制的实际价值、未晋升原因、已做低风险修正、三条下一步建议和完整文件清单。