← 返回藏书阁

NVIDIA NOOA:对象式 Agent Harness

wiki/ai/sources/nvidia-nooa-object-oriented-agent-harness.md
分类:ai / sources · 更新:2026-08-31 09:05

NVIDIA NOOA:对象式 Agent Harness

核心判断

NVIDIA Labs Object-Oriented Agents(NOOA)的长期价值不在“又一个 agent framework”,而在它把 Harness-Engineering 的多个隐性部件收敛到一个可审查的 Python object:methods 是 capabilities,fields 是 state,docstrings 是 prompts,type annotations 是 contracts,LLM 通过写 Python 和调用 typed methods 行动。

这对用户重要,因为 Hermes / llm-wiki 的许多失败并不是模型不会推理,而是工具结果被文本化塞进上下文、状态无法复用、验证 gate 散落在 prompt 和工具输出之间。NOOA 的“pass by reference + typed object state + deterministic methods”给了一个可迁移设计:把大对象留在执行环境,只把 bounded preview 暴露给模型;把可判定条件写成代码,而不是让模型自由解释自然语言状态。

机制 / 一阶原理

NOOA 的核心机制是把 agent 从 chat transcript 改写成 ordinary software object。模型可见的是对象字段、方法签名、docstring 和受控 preview;真正的大型工具返回值、数据库对象、图像、workspace 等以引用形式存在。这样做降低 token tax,也避免每次工具返回都破坏 prompt cache 或触发 context compaction。

第二个机制是“模型写代码作为 action”。相比固定 tool menu,模型可以在 Python 控制流里组合普通 deterministic methods 与 LLM-backed methods;验证逻辑因此可以和探索逻辑在同一 trace 中被 code review、unit test、diff 和 replay。NVIDIA 文章提到漏洞发现流程中三个 deterministic gates:把 verifier raw output 转成 verdict、确认 crash 匹配漏洞、重新运行输入验证复现。这是 Agent-Benchmarks 中 claim-level receipts 的工程化实现。

与已有 wiki 的关系

  • Harness-Engineering:NOOA 支持“harness 是工程制品而不是 prompt”的判断,尤其是 typed contracts、state、trace、deterministic gate。
  • Context-Engineering:pass-by-reference 说明 context engineering 不一定是更会摘要,也可以是不把对象文本化;上下文只暴露当前决策需要的 preview。
  • Loop-Engineering:programmable loop engineering 和 object state 让 loop 状态可由代码持有,而不是散落在自然语言进度文件中。
  • Agent-Benchmarks:同一模型在 SWE-bench Verified、ARC-AGI-3、CyberGym L1 中的 reported 成绩和 token/cost 差异,提供了 harness-as-variable 的强信号;但这些数字来自 NVIDIA 文章,仍需技术报告/代码复核。

可执行启发

  1. 在 Hermes 的复杂工具输出中引入“引用 + preview”思维:大文件、搜索结果、轨迹、候选集不要全部进入最终上下文,应有 path/id/summary + 可按需读取。
  2. wiki-radar 的候选 tape 可被建模为 typed objects:candidate、source_fetch、promotion_verdict、raw_path、page_path、reindex_receipt,而不是最终日报里的一段散文。
  3. 对高风险 action 使用 deterministic gates:例如 raw hash 是否匹配、wiki 页面是否有写入记录、index 是否含新增 wikilink、最终报告 claim 是否能由文件存在性支撑。

边界与失败模式

  • 文章包含部分 AI-generated summary 和 vendor 自报 benchmark 数字;正式结论应标 medium confidence,等待技术报告、代码和独立复现。
  • 模型写代码作为 action 增强了组合能力,也扩大了执行风险;必须配合 sandbox、权限、resource budget 和 post-effect verification。
  • pass-by-reference 若 preview 设计不当,会隐藏关键细节,导致模型在不完整状态上决策。

写入记录

  • 2026-08-31 09:00 CST:新增 NVIDIA NOOA source page,提炼对象式 harness、pass-by-reference、typed state 与 deterministic verification gates 对 Hermes/llm-wiki 的启发。