← 返回藏书阁

llm-wiki 自我优化 2026-08-31

wiki/ai/sources/llm-wiki-optimization-2026-08-31.md
分类:ai / sources · 更新:2026-08-31 09:07

llm-wiki 自我优化 2026-08-31

今天学到的东西

今天的高价值材料共同指向一个方向:llm-wiki radar 不应继续只靠“更长 prompt + 最终日报”,而应逐步外部化为 typed、可复查、可删减的 workflow cell。

- [[nvidia-nooa-object-oriented-agent-harnessNOOA]] 提醒:大对象不必全部文本化进上下文;候选集、raw archives、页面路径、验证结果都可以是外部 reference,只把 bounded preview 给模型。
- [[contextpilot-proactive-context-managementContextPilot]] 提醒:搜索、筛选、摘要、offload、记忆写入都是 context actions,需要留下轻量 ledger,才能知道哪一步真正改善了结果。
- [[dispatch-level-instrumentation-agentic-datasheet-extractionDispatch-Level Instrumentation]] 提醒:最终页面像 source-backed 不代表真的读过 source;raw path、sha256、工具读取、index/log/write-record 都应成为 claim receipts。
- [[aisi-sandboxescape-bench-container-breakoutSandboxEscapeBench]] 提醒:外部工具/代码项目不能因为“与 agent 有关”就自动运行;sandbox policy 和容器权限应成为未来工具采纳门槛。
- [[attention-interface-agent-harness-evolutionThe Evolution of the Agent Harness]] 提醒:自我优化不应只新增规则,也要删除/合并重复脚手架,把用户注意力留给少数高价值判断。

已执行的低风险优化

  1. 将今天材料的启发写入 Harness-Engineering:新增 typed object、sandbox safety、dispatch trace、attention policy 四个 harness 边界。
  2. 将今天材料的启发写入 Agent-Benchmarks:新增 sandbox policy、tool-path compliance、context action attribution、harness-as-variable 字段。
  3. 将今天材料的启发写入 Loop-Engineering:新增 attention policy、context action ledger、external object state、receipt-driven progression。
  4. 将今天材料的启发写入 Context-Engineering:新增 proactive context actions、pass-by-reference 和 candidate tape。

建议进入后续雷达的结构字段

未来每日雷达可以维护一个轻量 candidate tape,每条候选至少包含:

字段用途
candidate_url/title避免重复发现与重复入库
fetch_status区分已读原文、只读摘要、访问失败
promotion_score记录 relevance/novelty/durability/actionability/source-quality/depth-potential
promotion_verdictpromote / raw-only / skip / HOLD
reason说明深度判断,不让拒绝理由丢失
raw_path / sha256证明 source 已归档且未漂移
page_paths证明已写入哪些 wiki 页面
receipt_check最终报告 claim 可否由文件/命令支撑

高风险或范围较大的建议

  • 不建议在无人 cron 中自动安装或运行 NOOA、SandboxEscapeBench 或任何新 repo;这些都应先作为 source 入库,后续若要试运行,需要用户确认 sandbox、网络、权限和预算。
  • 可以考虑新增一个机械检查脚本 wiki-radar-check:检查今日新增 source page 是否有 raw、sha256、写入记录、index/log 条目;但这涉及 bin/scripts 维护,今天只在页面中提出,不自动改工具链。
  • 建议后续合并重复的“每日自我优化规则”,形成更短的 radar rubric + 机械 checklist,降低 prompt 规则膨胀。

写入记录

  • 2026-08-31 09:00 CST:新增今日 llm-wiki 自我优化文章,沉淀 candidate tape、claim receipts、sandbox policy 与 attention policy 的优化方向。