llm-wiki 自我优化 2026-08-12
llm-wiki 自我优化 2026-08-12
今天从内容更新中学到什么
今天入库的四类材料共同指向一个方向:每日 AI 雷达本身需要从“发现 + 写页”升级为可审计的生产 agent cell。prodagent-production-agent-framework 提醒我们记录预算、恢复、熔断、权限和观察性;xorcise-cyber-agent-evidence-benchmark 提醒最终报告要 trust evidence, not claims;gpu-server-setup-agent-skill 提醒操作型 skill 应有窄边界和硬 gate;kadath-evolutionary-agent-runtime 提醒 self-improvement 不能让被优化对象修改自己的评分器和目标。
已做的低风险优化
- 今日继续使用 web/GitHub/API 优先,而不是 X/Twitter。
- 对候选明确区分 BACKED / HOLD:GitHub README 成功读取的项目才晋升;arXiv 429、OpenAI 403、DeepMind timeout 不被伪装成已读。
- 拒绝把高 star 但要求关闭防病毒、运行带密码 installer 的
agent-skills-collection晋升为正式页,只在报告中作为供应链风险样本说明。 - 新建/更新页面均追加
## 写入记录,并把 raw archive + source page + concept update + index/log 作为完成 receipts。
后续应调整的雷达
- 增加“生产控制面 / agent runtime”轮换主题:预算、checkpoint、event log、权限、HITL、OTel、CI eval。
- 增加“skill installability risk”字段:是否要求可执行 installer、是否需要关闭安全软件、是否有 lockfile/hash、是否有 with/without-skill eval。
- 对 self-improvement 类项目单独设 HOLD/RESEARCH gate:只学习外层控制面,不把自改执行体引入 Hermes cron。
写入记录
- 2026-08-12 09:00 CST:总结 2026-08-12 AI 雷达对 llm-wiki 自我优化的启发,并记录低风险修正和后续雷达方向。