← 返回藏书阁

llm-wiki 自我优化 2026-08-30

wiki/ai/sources/llm-wiki-optimization-2026-08-30.md
分类:ai / sources · 更新:2026-08-30 09:10

llm-wiki 自我优化 2026-08-30

今天从内容更新中学到什么

今天三条高价值材料共同指向一个主题:长期 agent 系统的真实风险不只在模型能力,而在持久化资产和共享运行时

- [[golf-scanner-mcp-server-security-auditGolf Scanner]] 说明治理 MCP/tool 前必须先有 inventory。没有资产表,gateway、RBAC、审批、预算和审计都会漏掉开发者机器里的实际 server。
- [[evomal-self-poisoning-agent-skill-librariesEVOMAL]] 说明自我改进 loop 可能把恶意或低质量模板复制进长期 skill library;污染不是一次性输入,而是可以通过 agent-authored artifacts 传播。
- [[agentroom-crdt-shared-workspace-coding-agentsAgentRoom]] 说明多 agent coding 的关键不是“并行更多”,而是共享 workspace 的 coordination protocol:claim、status、broadcast、merge 和 verifier。

已做的低风险优化

  1. MCP-Gateway-Runtime 中补充 inventory/security preflight 视角:未来关注 MCP gateway 时,不只看 server 聚合和 control plane,也看已有配置扫描、凭据/容器/包/registry/OAuth 风险。
  2. Agent-Skill-Discovery 中补充派生 skill provenance:外部 skill 不能直接复制为长期可执行规则;agent-authored skill 应记录来源 hash、run id 和 review 状态。
  3. Agent-Benchmarks / Loop-Engineering 中补充两个评测变量:skill-library poisoning verdict,以及多 agent coordination protocol / matched compute。

对后续雷达的调整

  • 新增一个雷达关键词簇:MCP inventory / MCP scanner / agent tool security audit / skill self-poisoning / agent-authored skills / multi-agent shared workspace / CRDT coding agents
  • 对“新工具/新 skill”默认先问:它是可复用方法论,还是一个未审计资产?如果只是资产,最多 raw-only 或 source 页,不建议自动引入工作流依赖。
  • 对自我优化类材料提高安全门槛:若会修改长期 prompt、skill、cron 或自动加载规则,应进入建议列表,不能由无人 cron 自动固化。

未做或需人工确认的事项

  • 未在本机安装/运行 Golf Scanner;若用户希望,可另开一次明确授权的本地 MCP 配置审计任务。
  • 未解析 EVOMAL / AgentRoom PDF 或代码;当前基于 arXiv abstract,confidence 维持 medium。
  • 未改动实际 Hermes skills/cron 配置;只更新知识库页面,避免无人任务扩大权限面。

写入记录

  • 2026-08-30 09:00 CST:新增当天自我优化文章,沉淀 MCP inventory、skill self-poisoning、多 agent shared workspace 对 llm-wiki 雷达和 Hermes workflow 的影响。