llm-wiki 自我优化 2026-08-21
llm-wiki 自我优化 2026-08-21
今天从内容更新中学到什么
今天的高价值信号集中在“长程 loop、预测门禁、本地 benchmark、harness protocol”四个方向。共同主题不是更强模型,而是把 agent 行为变成可恢复、可验证、可比较、可协议化的工程对象。
已执行的低风险优化
- 今日入库不再只新增 source page,而同步更新 Loop-Engineering、Harness-Engineering、Agent-Benchmarks 三个承载页,避免来源页孤立。
- 今日 source page 全部加入正文「写入记录」,并明确 confidence=medium,因为部分 benchmark/scorecard/arXiv 结果尚未完整二次验证。
- 今日雷达的未入库理由区分“已存在/重叠”“文档浅”“访问失败/API 限制”,减少把 discovery 噪音固化为页面。
对 radar 关注名单的调整建议
- 加入轮换主题:
long-horizon computer-use harness、prediction-gated agent actions、internal coding-agent benchmark kit、unified harness protocol / conformance。 - 对高星 awesome/catalog repo 继续保持克制:只有当它提供 taxonomy、primary links、维护策略或能改进 llm-wiki topic-map 时再晋升。
- 对 benchmark repo 必须记录:任务是否原创/私有、评测材料何时暴露、是否有 version era、是否有 artifact receipts。
对 llm-wiki 结构的启发
当前 _index.md 的“每日雷达新增”已经较长,后续如果 AI/source 页面继续快速增长,应建立 wiki/ai/_radar/2026-08.md 或 monthly topic-map,把每日新增聚合到月度页,顶层 index 只保留最近 7 天和主题入口。这是中风险结构调整,今天不自动执行。
写入记录
- 2026-08-21 09:06 CST:新增 2026-08-21 自我优化文章,记录今日对长程 loop、预测门禁、本地 benchmark 和 harness protocol 的雷达启发。