llm-wiki 自我优化 2026-08-20
llm-wiki 自我优化 2026-08-20
今天从内容更新中学到什么
今天深挖的四个来源共同指向一个主题:agentic workflow 正在从 prompt discipline 走向 artifact discipline。
| - [[pipelex-declarative-ai-methods | Pipelex]] 把 AI procedure 变成 typed、repeatable、composable method。 |
| - [[context-engineering-kit-agent-skills | Context Engineering Kit]] 把上下文工程变成 granular、按需加载的 plugin/skill marketplace。 |
| - [[preloop-agent-control-plane | Preloop]] 把工具调用、模型流量、审批、预算、审计纳入 control plane。 |
| - [[cooperbench-cooperative-coding-agents | CooperBench]] 把多 agent 协作失败从“感觉问题”变成可测 benchmark 与 coordination metrics。 |
这说明 llm-wiki 的每日雷达不能只写更长 prompt,而应逐步把高频流程转成可验证 artifact:candidate manifest、promotion method、concept update contract、coordination receipts、control-plane risk fields 和最终 report receipts。
已做的低风险优化
- 在本次入库中显式区分 artifact 类型:workflow DSL / benchmark / skill marketplace / control plane,而不是把它们都归为泛化“agent 工具”。
- 概念页补充了新边界:Agent-Benchmarks 增加 multi-agent coordination;Context-Engineering 增加 typed method + granular plugin;Harness-Engineering 增加工具面/模型面/协作面三层证据;External-Agent-Skills-Design-Patterns 增加 skill-method-plugin 候选治理。
- 未自动安装任何外部工具:Pipelex、CEK、Preloop 都可能改变本地 agent runtime 或引入外部依赖;本次只做 source/concept ingest,避免无人 cron 高风险副作用。
下一步应如何调整雷达
1. 增加候选 manifest 字段
后续 radar 候选建议统一记录:
artifact_type: workflow-dsl / skill-plugin / benchmark / control-plane / context-provider / paper / reporuntime_scope: Claude Code / Hermes / Codex / MCP / generic / unknownexecution_risk: docs-only / config-rewrite / runs-scripts / credentialed / networkedverification_path: README-only / docs-read / installed-smoke-test / benchmark-run / paper-readpromotion_decision: promote / raw-only / hold / reject
这样可以避免“看到高星 repo 就入库”或“可执行 skill 被当成普通文档”的风险。
2. 为 mass-ingest / delegate_task 设计 coordination receipts
CooperBench 提醒,多 agent 并行需要 owner、claim、status、artifact path、merge/verifier。未来如果一次 ingest 10+ 页面或使用子代理,应先写任务认领表,最后由主 agent 合并和验证 wikilinks/index/log。
3. 将每日 radar 拆成 method-like 小合同
参考 Pipelex,可以先不用引入 DSL,而是在 wiki 内定义轻量 markdown contracts:
discover-candidates: 输入关注主题,输出候选与来源路径;score-candidate: 输出 relevance/novelty/durability/actionability/source-quality/depth-potential;promote-source: 输出 raw、source page、concept deltas、write records;verify-run: 输出文件存在、wikilink、index/log、reindex 状态;report: 输出中文日报并明确未入库原因。
这些合同未来可进一步工具化,减少 cron prompt 漂移。
边界与未解问题
- 今天 GitHub API 命中 403 rate limit,arXiv API timeout/429;发现仍可通过 raw.githubusercontent.com 和 GitHub HTML fallback 继续,但来源覆盖会偏 GitHub README。
- 本次没有安装/运行 Pipelex、CEK、Preloop,也没有运行 CooperBench;因此所有工具能力判断为 medium confidence,不能直接作为选型结论。
_index.md的 AI 来源行已经很长,持续追加每日雷达会降低可读性;应考虑月度 topic-map 或 category-local index,但这是范围较大的结构调整,建议单独执行。
写入记录
- 2026-08-20 09:01 CST:新增自我优化文章,总结今日从 typed methods、skill marketplace、control plane、multi-agent benchmark 中学到的 llm-wiki 工作流优化方向,并提出候选 manifest、coordination receipts、method-like contracts。