DM-Code-Agent:本地优先、可审计、可分叉重跑的 coding agent
DM-Code-Agent:本地优先、可审计、可分叉重跑的 coding agent
核心判断
DM-Code-Agent 是一个本地优先 Python code agent,核心是一个 ReAct loop;它把计划、工具调用和 observation 写成 append-only JSONL trace,并提供 trace view/analyze/diff/fork/replay、上下文折叠净收益护栏、插件钩子和隐藏测试 benchmark。
为什么对用户重要
它不是单纯“又一个 coding agent”,而是把可审计 trace、可分叉重跑、只读 Web 展厅、完成门和隐藏测试基准合成一个可研究 harness。对长期 agent workflow,最有价值的是它把失败诊断和报告证据作为一等产物。
机制 / 一阶原理
机制上,运行历史是一棵不删除的树:每条日志有 id/parent_id,折叠只追加派生记录而不删原文;插件通过 before_tool_call、after_tool_result、before_llm_request、before_finish、on_run_start/end 等钩子介入;benchmark 使用隐藏测试、逐题 pass/fail 翻转和真实 harness 结果,而不是只报总分。
与既有 wiki 概念的关系
- 关联页面:Harness-Engineering, Loop-Engineering, Agent-Benchmarks, Agentic-Coding。
- 本页补充的是 2026-08-23 雷达中的工程样本,重点不在新闻性,而在可迁移的 benchmark / harness / runtime 设计。
对 Hermes / llm-wiki 的可执行启发
Hermes 可借鉴三点:cron/radar 的 action ledger 应 append-only;失败复盘应支持 diff/fork/replay;“默认开护栏、默认关行为算法”的原则适合无人自动化,避免把未验证策略静默上线。
失败模式、边界条件与未解问题
边界条件:README 中的分数和特性仍需本地复验;作为完整 agent runtime,安装和执行权限比只读 wiki ingest 风险高;隐藏 benchmark 小规模结果不应外推到所有仓库;插件系统需要信任边界。
深度判断
本条被晋升为正式 source page,因为它满足至少一个高权重主题,并且 README/项目描述提供了可复用机制,而不只是发布新闻或单工具介绍。后续若要采用到 Hermes 运行时,仍需本地复验、权限审计和最小任务实验。
写入记录
- 2026-08-23 09:00 CST:新增 2026-08-23 AI 雷达 source page,覆盖重要性、机制、既有概念关系、Hermes 启发与边界条件。