llm-wiki 自我优化 2026-08-30
llm-wiki 自我优化 2026-08-30
今天从内容更新中学到什么
今天三条高价值材料共同指向一个主题:长期 agent 系统的真实风险不只在模型能力,而在持久化资产和共享运行时。
| - [[golf-scanner-mcp-server-security-audit | Golf Scanner]] 说明治理 MCP/tool 前必须先有 inventory。没有资产表,gateway、RBAC、审批、预算和审计都会漏掉开发者机器里的实际 server。 |
| - [[evomal-self-poisoning-agent-skill-libraries | EVOMAL]] 说明自我改进 loop 可能把恶意或低质量模板复制进长期 skill library;污染不是一次性输入,而是可以通过 agent-authored artifacts 传播。 |
| - [[agentroom-crdt-shared-workspace-coding-agents | AgentRoom]] 说明多 agent coding 的关键不是“并行更多”,而是共享 workspace 的 coordination protocol:claim、status、broadcast、merge 和 verifier。 |
已做的低风险优化
- 在 MCP-Gateway-Runtime 中补充
inventory/security preflight视角:未来关注 MCP gateway 时,不只看 server 聚合和 control plane,也看已有配置扫描、凭据/容器/包/registry/OAuth 风险。 - 在 Agent-Skill-Discovery 中补充派生 skill provenance:外部 skill 不能直接复制为长期可执行规则;agent-authored skill 应记录来源 hash、run id 和 review 状态。
- 在 Agent-Benchmarks / Loop-Engineering 中补充两个评测变量:skill-library poisoning verdict,以及多 agent coordination protocol / matched compute。
对后续雷达的调整
- 新增一个雷达关键词簇:
MCP inventory / MCP scanner / agent tool security audit / skill self-poisoning / agent-authored skills / multi-agent shared workspace / CRDT coding agents。 - 对“新工具/新 skill”默认先问:它是可复用方法论,还是一个未审计资产?如果只是资产,最多 raw-only 或 source 页,不建议自动引入工作流依赖。
- 对自我优化类材料提高安全门槛:若会修改长期 prompt、skill、cron 或自动加载规则,应进入建议列表,不能由无人 cron 自动固化。
未做或需人工确认的事项
- 未在本机安装/运行 Golf Scanner;若用户希望,可另开一次明确授权的本地 MCP 配置审计任务。
- 未解析 EVOMAL / AgentRoom PDF 或代码;当前基于 arXiv abstract,confidence 维持 medium。
- 未改动实际 Hermes skills/cron 配置;只更新知识库页面,避免无人任务扩大权限面。
写入记录
- 2026-08-30 09:00 CST:新增当天自我优化文章,沉淀 MCP inventory、skill self-poisoning、多 agent shared workspace 对 llm-wiki 雷达和 Hermes workflow 的影响。