llm-wiki 自我优化 2026-08-15
llm-wiki 自我优化 2026-08-15
今天从内容更新中学到什么
| 今天的高价值信号集中在“不要只相信 prompt / 单次运行 / 自然语言 claim”:[[agnix-agent-config-linter | Agnix]] 要求先 lint agent 配置,[[promtact-inline-policy-enforcement-point | Promtact]] 要求副作用前 inline gate,[[agentrelbench-stochastic-agent-damage-benchmark | AgentRelBench]] 要求重复运行测随机 damage,[[repotrials-private-repository-coding-agent-eval | RepoTrials]] 要求在自己的仓库和历史任务上做私有回归评测。 |
对 llm-wiki radar 来说,这意味着每日任务不能只追求“发现更多项目”。更重要的是:配置是否完整、候选是否真的读过、入库是否有 raw/hash/page/index/log receipt、未入库原因是否结构化、失败分布是否长期可见。
已做的低风险优化
- 今日 deep ingest 把 4 个来源都保存为 raw + source page,并更新了 Agent-Benchmarks、Harness-Engineering、External-Agent-Skills-Design-Patterns 三个概念页。
- 在概念页中明确增加“config preflight / inline PEP / stochastic damage / private regression set”四个 radar 质量门槛。
- 今日未安装任何外部工具,避免把尚未审计的 executable package 引入 Hermes 环境。
后续建议的雷达调整
- 新增一个候选维度:
config-preflight-value,优先发现能检查 AGENTS.md / SKILL.md / MCP / hook / cron prompt 的工具。 - 对所有“agent security control plane”候选,区分 observability、post-hoc audit、inline gate、human approval、tamper-evident receipt 五个层级,避免把记录工具误判为控制工具。
- 建立 llm-wiki radar 的小型回归集:用过去 10 天的任务检查 orient、raw hash、source page、concept update、_index/log、写入记录、reindex、未入库理由是否持续满足。
写入记录
- 2026-08-15 09:01 CST:新增当天自我优化文章,总结 config lint、inline PEP、stochastic damage 与私有回归评测对 llm-wiki radar 的优化启发。