Agent Harness
现代 Agent Engineering 学习路线:Agent Harness
0 子目录6 文档
文档
6Agent Harness 推荐阅读Agent Harness 推荐阅读 Claude Code Overview:从产品行为观察工具、权限、hooks、subagents 与 MCP。 OpenAI Codex:研究开源 coding agent 的 CLI、sandbox、approval 与执行闭环。 learn claude code:从零复刻 Claude Code like Harness。 claw0:从 loop 走到 session、channel、gaAgent Harness 架构:模型之外的能力来源Agent Harness 架构:模型之外的能力来源 Agent Harness 是承载模型执行任务的运行时。它决定模型能看到什么、能调用什么、如何执行、何时停止、如何记录、如何恢复。相同模型放入不同 Harness,实际能力和可靠性可能差异很大。 1. 典型模块 2. Agent Loop Loop 负责模型请求、工具调用回填和终止;它不应独自承担所有逻辑。Provider 重试、工具超时、权限、状态提交和 final validatTool Registry、Permission Gate、Session Store 与 CompactionTool Registry、Permission Gate、Session Store 与 Compaction 1. Tool Registry Registry 管理工具元数据、版本、handler 和 capability。它需要支持: 名称冲突检测; 按会话、角色、平台选择可见工具; provider schema 转换; 工具搜索与延迟加载; 禁用或降级不可用工具; 版本和 deprecation; 统一 metrics 与 Trace、调试、失败恢复与 ValidationTrace、调试、失败恢复与 Validation 1. Trace 的最小字段 敏感值做脱敏或只存引用;大工具输出存对象存储,trace 只保留 hash 与定位。 2. 故障定位分层 Prompt/Context:目标或约束缺失、摘要丢信息; Model:选择错误工具、格式漂移; Tool:参数、超时、外部依赖; Retrieval:召回或排序错误; State:并发覆盖、恢复不一致; Permission:策略误判或范围过宽; VExecutor 执行器:从已解析决策到可恢复的真实动作Executor 执行器:从已解析决策到可恢复的真实动作 “Executor”在 Agent 资料中常被用于不同层次。先区分术语,才能正确设计边界: 名称 调度单位 核心职责 Runner / Orchestrator 一次 run / turn 驱动 Agent Loop、模型调用、停止和 finalization Workflow Executor 图中的 node / task 按边和状态执行确定性或 Agent 节点 Tool Middleware、Hooks 与 Callbacks:横切能力的可控扩展点Middleware、Hooks 与 Callbacks:横切能力的可控扩展点 Agent Runtime 需要日志、guardrail、上下文注入、缓存、重试、指标和审批,但把它们全部写进主 Loop 会形成难以测试的巨型函数。Middleware 与 hooks 提供扩展点;同时也可能引入隐藏控制流,所以必须规定顺序、输入输出、短路和异常语义。 1. 三个相近概念 概念 常见形态 适合用途 Middleware 包裹 next 的链