← 返回藏书阁

llm-wiki 自我优化 2026-08-09

wiki/ai/sources/llm-wiki-optimization-2026-08-09.md
分类:ai / sources · 更新:2026-08-09 09:05

llm-wiki 自我优化 2026-08-09

今天从内容更新中学到什么

今天的高价值材料集中在三条线:agent 运行时安全、context workbench、domain skill library / agent benchmark。它们共同提示:llm-wiki 不应只追踪“新工具/新论文”,而要把每次发现转成可复查的工作流改进。

  1. hol-guard-ai-agent-antivirusagent-egress-bench-security-tool-corpus 说明,外部 skill/MCP/server 进入用户环境前需要 admission cell:来源、权限、脚本、联网、secret access、guard 支持、egress smoke test、false-positive 风险。
  2. repoprompt-ce-context-engineering-app 说明,全局 wiki 与 repo-local context pack 应分层。llm-wiki 提供 durable methodology;代码任务需要当前仓库结构、diff、CodeMap、测试和文件边界。
  3. claw-eval-trustworthy-agent-evaluation 提醒日报/入库 workflow 也需要 micro-benchmark rubric,不能只看单次成功。
  4. open-science-skills-research-skill-librarydesigner-skills-agentic-design-skill-pack 说明,外部 skill 生态已扩展到研究与设计;AI radar 应周期性关注 domain skill,尤其是能反哺 wiki/product-design/ 和研究 ingest 的技能化方法。

今天实际做了哪些低风险优化

  • Harness-Engineering 增加 runtime guard + egress corpus 的补充,明确外部 skill/MCP/发布类自动化需要 admission cell 与 post-effect receipt。
  • Context-Engineering 增加 repo-local context workbench 与 skill catalog routing 的补充,强调 global wiki / repo-local context pack 分层。
  • Agent-Benchmarks 增加 Pass^3、security-tool eval、false-positive discipline 的补充。
  • External-Agent-Skills-Design-Patterns 增加 domain skill library 与 skill/MCP security admission 两个模式。
  • 更新 _index.md,把今日新增 source notes 纳入 AI/工程来源列表,并调整 AI/原始素材统计。

还应如何调整雷达

  1. 新增“agent 安全工具 / egress benchmark”主题轮换。 过去雷达已经连续看到 guard、policy、claim proof、sandbox;后续应把安全工具是否有可运行 corpus、false-positive suite、support matrix 当作晋升条件。
  2. 新增“domain skill library”主题轮换。 不只看 coding agent skills,也看 research、design、product、data、finance 等领域的 source-backed skill pack,优先提炼可迁移的 routing / rubric / template,而不是直接安装。
  3. 为 radar 生成候选 tape。 今日仍是报告中描述候选评分;未来可在 raw/notes/ 或优化文章中保存结构化候选表:query、候选、分数、读取状态、晋升/拒绝类别、证据路径。

未做的较大改动

  • 未安装 HOL Guard、Sanctuary 或任何外部 skill;这些属于执行环境安全/权限变更,应先人工确认。
  • 未重构 wiki/product-design/ 为 skill/playbook 体系;今天只记录方向,后续可分批把高频设计任务转成模板和 playbook。
  • 未新增完整 egress smoke test;需要先确认用户希望保护的 agent harness、MCP 和网络边界。

写入记录

  • 2026-08-09 09:00 CST:新增当天 llm-wiki 自我优化文章,总结 runtime guard、egress corpus、context workbench、Pass^3 benchmark 与 domain skill library 对雷达和知识库结构的优化启发。