llm-wiki 自我优化 2026-09-11:可回读、可相信、获授权不是一回事
llm-wiki 自我优化 2026-09-11:可回读、可相信、获授权不是一回事
今天吸收的核心
知识库不应只让旧内容更容易出现,还要让它保留准确地址、原始信任边界和证据等级。 今天深挖三个机制,不为六轴各凑一篇,不围绕人物追踪。
- A2A / MCP Gateway / harness-runtime / sandbox-security / benchmark-evaluation:a2a-output-attestation-and-delegation-ancestry 区分输出字节绑定与父子双方授权。E12 作者数据明确为 A2A 0.3,本机检查 90 条输出 hash/字节长度均一致;这不是本机重新通过签名 verifier。^[raw/articles/a2a-output-attestation-and-delegation-ancestry-2026-09-11.md]
- sandbox-security / context management / harness-runtime / benchmark-evaluation:spa-plan-first-label-preserving-persistent-agents 将 plan-first、数据/控制依赖与持久化标签连起来;摘要不能把低信任数据洗成高权限输入。utility 明显受损,延迟投毒攻击集覆盖仍有限,不能只传播低 ASR。^[raw/articles/spa-plan-first-label-preserving-persistent-agents-2026-09-11.md]
- context management / harness-runtime / benchmark-evaluation:arc-addressable-recall-context-compaction 把可见视图压缩与原文保存分开,保证的是给定地址的可恢复性,不是模型一定选中或正确完成;correctness/completion 数字口径待核。^[raw/articles/arc-addressable-recall-context-compaction-2026-09-11.md]
深度判断与没有晋升的材料
本轮 8 个候选按 relevance、novelty、durability、actionability、source-quality、depth-potential 评分,完整表在 raw/notes/ai-knowledge-radar-2026-09-11.md。总分不替代否决条件;SPA/ARC 值得沉淀设计,同时将定量疑点标记为 contested。
- Influence Distance(sandbox-security / context management / benchmark-evaluation / harness-runtime):原文已读并归档,结构邻近不是因果归因,增量拦截样本尚不足以声称显著收益;与 SPA 相邻,本轮只留 raw。
- A2A 实践教程(A2A / harness-runtime / sandbox-security):已恢复完整原文,内容与既有 Samples/v1 重合,旧/新 Card 路径及 SDK 示例需按版本复核,先留 raw。
- AgentAudit(benchmark-evaluation / harness-runtime / sandbox-security):读取 09-09 官方摘要;HTML 404,未读 PDF。九项任务、单一且同时被测的 judge 使排名需要进一步验证,只归档摘要。
- Snowflake gateway guide(MCP Gateway / harness-runtime / sandbox-security):只有搜索发现,五支柱与既有页重合,本轮未读全文、不建 source。
- AgentFlow(sandbox-security / harness-runtime / A2A):既有页作 SPA 对照,不重复入库,不提升既有 abstract-only 证据等级。
已做的低风险修正
- 补充原文完整性检查:web_extract 的本地文件仍可能被上游截在约 50k 字符;本次 SPA/ARC 改从原始 HTML 保存完整抽取文本,保留 MathML alttext。以后“工具成功/文件存在”不能单独作为读到全文的判据。
- 复用稳定机制,不发明新 receipt 名称:在 AI-Knowledge-Point-Radar 同步“可恢复≠被选中≠正确完成、摘要≠可信化、输出签名≠父方授权”,沿用 LLM-Wiki-Optimization-Log 的三条横切检查。
- 主题页只放关键入口:给 Context-Engineering、A2A-Agent2Agent-Protocol、MCP-Gateway-Runtime、Agent-Benchmarks 增加短判断和反链;细节留 source,不再向超长概念页复制日报。
- 恢复之前被访问故障阻断的高价值来源:A2A 取证论文在 09-07 留作候选,本次补回正文、README、测试和作者回执;网页/API 失败不被误判为“没有新知识”。
这是内容与发现机制的修正,不代表 Hermes 已部署 IFC、双签服务或新的上下文 runtime。没有更改 cron、gateway、系统权限、云端 embedding 后端,也没有安装本地模型。
下一步建议
- 小规模对照“语义发现→按地址回读”:用真实排查任务分别检查原始 ID/报错还原率、重复外部读取和最终正确率;不要直接替换现有 GLM 向量索引。
- A2A 接入先做版本化失败用例:覆盖父方拒签、输出替换、nonce 重放和跨 verifier 状态;先在临时隔离环境验证,不照搬 E12 的本地协议配置。
- 追踪数值口径修订:优先复核 SPA 的运行总数/utility 标签与 ARC 的 correctness/completion 原始标签;在查清前保持 contested,不把未解释的显著性或延迟当选型依据。
轮换关键词新增中英双语:addressable recall / 按地址回读、label-preserving persistence / 标签保留持久化、bilateral delegation authorization / 双边委托授权。A2A 实践优先级不变,匿名 artifact 只是证据入口。
文件变更清单
以下路径相对 ~/llm-wiki/vault/,保留完整列表供追溯。
新建正式文章
wiki/ai/sources/a2a-output-attestation-and-delegation-ancestry.mdwiki/ai/sources/spa-plan-first-label-preserving-persistent-agents.mdwiki/ai/sources/arc-addressable-recall-context-compaction.mdwiki/ai/sources/llm-wiki-optimization-2026-09-11.md
更新概念与导航/日志
wiki/ai/concepts/A2A-Agent2Agent-Protocol.mdwiki/ai/concepts/MCP-Gateway-Runtime.mdwiki/ai/concepts/Context-Engineering.mdwiki/ai/concepts/Agent-Benchmarks.mdwiki/ai/concepts/AI-Knowledge-Point-Radar.md_index.mdlog.md
新建不可变归档
raw/articles/a2a-output-attestation-and-delegation-ancestry-2026-09-11.mdraw/articles/spa-plan-first-label-preserving-persistent-agents-2026-09-11.mdraw/articles/arc-addressable-recall-context-compaction-2026-09-11.mdraw/articles/influence-distance-persistent-agent-security-raw-only-2026-09-11.mdraw/articles/a2a-deep-kondah-practical-tutorial-raw-only-2026-09-11.mdraw/articles/agentaudit-trust-evaluation-abstract-raw-only-2026-09-11.mdraw/notes/ai-knowledge-radar-2026-09-11.md
公共入口:藏书阁。本轮验证结果另记 log.md,不将作者实验与本机执行混写。
写入记录
- 2026-09-11 09:09 CST:新增当天优化文章,整合三个机制的实际价值、未晋升原因、已做低风险修正、三条下一步建议和完整文件清单。