| 非确定性 | 同样的起始条件也可能产出不同响应的系统特性,Agent 就是这一类;它让「复现一次再打断点」的传统调试直觉失去着力点。 | Writing effective tools for agents — with agents — Anthropic Engineering |
| 轨迹改道 | 一步失败就让 Agent 转去探索一条完全不同的轨迹,后面所有轮次都长在错分支上,最终结果不可预测。 | How we built our multi-agent research system — Anthropic Engineering |
| 跨轮次复利 | Agent 有状态、能跑很长时间,在很多次工具调用之间维持状态,所以错误会一轮轮复利累积。 | How we built our multi-agent research system — Anthropic Engineering |
| 涌现行为 | 多 Agent 系统里没有被专门编程过、却自己冒出来的行为,比如对主 Agent 的小改动不可预测地改变子代理。 | How we built our multi-agent research system — Anthropic Engineering |
| 评测跑道 | 上一门课建的那套终态判分、验证器与评测集,只回答「这次挂没挂」,不回答「为什么」。 | How we built our multi-agent research system — Anthropic Engineering |
| 像你的 Agent 一样思考 | 用系统里一模一样的提示词和工具搭出模拟环境,一步一步看 Agent 干活的做法。 | How we built our multi-agent research system — Anthropic Engineering |
| 抽象层 | 框架为了简化调用 LLM、定义解析工具、串联调用而加上的中间层,它会遮住底层的提示词与响应。 | Building Effective AI Agents — Anthropic Engineering |
| 沙箱环境 | 让能动手的 Agent 先在里面做广泛测试的隔离环境,配合合适的护栏使用。 | Building Effective AI Agents — Anthropic Engineering |
| 工具边界 | 确定性系统与非确定性 Agent 之间的契约面,也是唯一会在记录里留下痕迹的位置。 | Building Effective AI Agents — Anthropic Engineering |
| ground truth | Agent 执行过程中每一步从环境拿到的实打实反馈,比如工具调用结果、代码执行结果。 | Building Effective AI Agents — Anthropic Engineering |
| 原始记录 | 一次运行里每个工具调用的工具名与完整参数、每个工具响应的完整返回或报错,是第一手证据。 | Writing effective tools for agents — with agents — Anthropic Engineering |
| 自述 | Agent 写的关于它自己的文字:收尾总结、推理段落、工具执行后的自我评价,属于二手材料。 | Writing effective tools for agents — with agents — Anthropic Engineering |
| 思维链 | 模型在给出答案前写出来的那段推理过程,简称 CoT。 | Writing effective tools for agents — with agents — Anthropic Engineering |
| 四问 | 读记录的检查清单:调错了工具、调对了工具但参数传错、调得太少、把工具响应处理错了。 | Writing effective tools for agents — with agents — Anthropic Engineering |
| tool_use | 模型点名要调哪个工具的内容块,里面有工具名和一份由模型自己生成的完整参数对象。 | Writing effective tools for agents — with agents — Anthropic Engineering |
| tool_result | 宿主真跑一遍工具之后回传的块,成功是完整返回值,失败是报错内容加一个错误标记。 | Writing effective tools for agents — with agents — Anthropic Engineering |
| is_error | 工具结果上的错误标记,用来区分「工具返回了内容」和「工具抛了错」。 | Writing effective tools for agents — with agents — Anthropic Engineering |
| 内容农场 | 经过 SEO 优化、排名靠前但权威性差的来源;人工测试发现早期 Agent 一贯偏爱它们而放过学术 PDF 与个人博客。 | How we built our multi-agent research system — Anthropic Engineering |
| 转录 | 会话消息被持久化下来的文件,例如 Claude Code 落在磁盘上的那些 JSONL 会话记录。 | Monitoring — Claude Code 官方文档 |
| 结构化日志 | 把每一步落成带字段的 JSON 记录,让证据除了能被人读,还能被过滤、被聚合、被算分布。 | Writing effective tools for agents — with agents — Anthropic Engineering |
| 散文日志 | 把结构编码进自然语言的日志写法,读起来顺但只能被人解码。 | Writing effective tools for agents — with agents — Anthropic Engineering |
| JSON Lines | 一个文件、每行一个完整 JSON 对象、行间没有逗号和外层数组的格式,常写作 JSONL。 | Writing effective tools for agents — with agents — Anthropic Engineering |
| session_id | 一次会话的标识,跨多轮不变,用来回答「这次会话总共花了多少钱、中途换过权限模式没有」。 | Monitoring — Claude Code 官方文档 |
| prompt_id | 一次用户提示的标识,它触发的所有模型请求和工具调用共用这个值。 | Monitoring — Claude Code 官方文档 |
| 关联 ID | 给「一次触发」发的身份证号,凡是这次触发引出的事件都抄一遍,不需要任何基础设施,就是一个字段。 | Monitoring — Claude Code 官方文档 |
| duration_ms | 一步耗时的毫秒数,用来找性能瓶颈,也用来看「是不是卡住了」。 | Writing effective tools for agents — with agents — Anthropic Engineering |
| tool_input | 发给工具的参数,PostToolUse 载荷里直接给你的那一半完整调用记录。 | Hooks reference — Claude Code 官方文档 |
| tool_response | 工具返回的结果,和 tool_input 一起构成一次触发就拿到手的完整往返记录。 | Hooks reference — Claude Code 官方文档 |
| error | 记录上的报错字段,只在出错时出现,是定位时第一个要过滤的字段。 | Writing effective tools for agents — with agents — Anthropic Engineering |
| 指标 | 单次工具调用与整任务的运行时长、工具调用总次数、token 总消耗、工具报错这一组数。 | Writing effective tools for agents — with agents — Anthropic Engineering |
| 冗余调用 | 大量重复的工具调用,往往提示分页大小或 token 上限这类参数需要重新调一调。 | Writing effective tools for agents — with agents — Anthropic Engineering |
| 无效参数报错 | 大量因参数不合法而报的错,指向工具描述该写清楚、该补例子。 | Writing effective tools for agents — with agents — Anthropic Engineering |
| 报错率 | 报错数除以调用次数得到的比例指标,用来替代绝对数看健康度。 | Writing effective tools for agents — with agents — Anthropic Engineering |
| 终点信号 | 内部重试彻底放弃之后才发出的那一条报错事件,代表「这个请求最终失败了」。 | Monitoring — Claude Code 官方文档 |
| 疑似卡死 | 某次提示的最后一条记录带报错、之后再无任何后续记录的状态,与「从报错里恢复了」相对。 | Monitoring — Claude Code 官方文档 |
| 阈值 | 判断「多少算异常」的那条线;一手材料里没有任何数字,错误预算与 SLO 同理。 | Monitoring — Claude Code 官方文档 |
| SIEM | 安全信息与事件管理系统,异常检测、建立基线、跨会话关联和告警都是它这一侧的职责。 | Monitoring — Claude Code 官方文档 |
| 审计轨迹 | 带上终端用户身份属性之后,工具决定、工具结果、MCP 连接、权限模式变更这些事件构成的按用户记录。 | Observability with OpenTelemetry — Claude Agent SDK 官方文档 |
| span | 一段有始有终的活儿的记录:有名字、开始结束时间、若干属性,还能指认自己的父亲。 | Monitoring — Claude Code 官方文档 |
| trace | 由父子关系串起来的一整棵 span 树,一次完整请求从头到尾发生的所有事读成一棵树。 | Monitoring — Claude Code 官方文档 |
| claude_code.interaction | 第一方 trace 里每条用户提示对应的根 span 名。 | Monitoring — Claude Code 官方文档 |
| 子代理 | 通过 Agent 工具派出去的下级 Agent,它的模型请求与工具 span 嵌在父 Agent 的工具 span 之下。 | Observability with OpenTelemetry — Claude Agent SDK 官方文档 |
| 导出器 | 进程里负责把 span 打包发出去的那段代码,英文 exporter。 | Observability with OpenTelemetry — Claude Agent SDK 官方文档 |
| collector | 接收 span 的中转站或后端服务,导出器把数据发给它,你在它的界面上看树。 | Observability with OpenTelemetry — Claude Agent SDK 官方文档 |
| 静默失败 | 端点不可达或后端拒收时,Agent 照常运行、遥测被直接丢掉、应用里不冒任何错误的默认行为。 | Observability with OpenTelemetry — Claude Agent SDK 官方文档 |
| 批量导出 | 把遥测攒成批、按间隔发出去的机制,默认指标 60 秒、trace 与日志 5 秒一次。 | Observability with OpenTelemetry — Claude Agent SDK 官方文档 |
| service.name | 标识数据来自哪个服务的资源属性,CLI 默认把它报成 claude-code。 | Observability with OpenTelemetry — Claude Agent SDK 官方文档 |
| claude_code.session.count | 会话一启动就会发的计数指标,是验证导出配置有没有生效最省事的探针。 | Monitoring — Claude Code 官方文档 |
| TRACEPARENT | 装着 trace id 与当前 span id 的标准格式环境变量,Bash 与 PowerShell 子进程会自动继承它。 | Monitoring — Claude Code 官方文档 |
| W3C trace context | 一个标准格式的字符串,里面装着 trace id 和当前 span 的 id,谁拿到它谁就知道自己该挂在哪儿。 | Observability with OpenTelemetry — Claude Agent SDK 官方文档 |
| CLAUDE_CODE_ENHANCED_TELEMETRY_BETA | 打开之后 Agent 循环的每一步才成为可在追踪后端里检视的 span 的开关。 | Observability with OpenTelemetry — Claude Agent SDK 官方文档 |
| hooks | 在 Claude Code 生命周期特定点自动执行的用户自定义命令、HTTP 端点或 LLM 提示。 | Hooks reference — Claude Code 官方文档 |
| matcher | 决定一个 hook 在哪些情况下被触发的匹配规则,省略或设成通配就是一钩全记。 | Hooks reference — Claude Code 官方文档 |
| PreToolUse | 跑在模型已经创建好工具参数之后、这次工具调用被处理之前的事件。 | Hooks reference — Claude Code 官方文档 |
| PostToolUse | 工具已经成功执行之后触发的事件,输入里同时带参数与返回结果。 | Hooks reference — Claude Code 官方文档 |
| SessionStart | 每会话一次的事件,新开会话时触发,恢复已有会话时也触发。 | Hooks reference — Claude Code 官方文档 |
| Stop | 每轮一次节奏里的收尾事件,与 UserPromptSubmit 配对可以算出一轮的耗时。 | Hooks reference — Claude Code 官方文档 |
| 载荷 | 事件触发且 matcher 命中时,交给你的处理器的那份 JSON 上下文。 | Hooks reference — Claude Code 官方文档 |
| OTEL_* | 遥测导出相关的一组环境变量,Claude Code 会把它们从每一个派生的子进程里移除,hooks 也不例外。 | Hooks reference — Claude Code 官方文档 |
| debug 日志 | 记录哪些 hook 命中了、它们的退出码、完整 stdout 与 stderr 的日志文件。 | Hooks reference — Claude Code 官方文档 |
| 五步定位 | 本课编排的调试走法:按关联 id 收窄、找第一处分岔、重放观察、反复压同一个组件、修复后从出错处恢复。 | How we built our multi-agent research system — Anthropic Engineering |
| 收窄 | 第一步:把范围从「Agent 出问题了」缩到「这一条 id 底下的十来条事件」。 | Monitoring — Claude Code 官方文档 |
| 第一处分岔 | 行为开始偏离预期的那一步;末尾那些荒唐绝大多数是它的下游噪声。 | How we built our multi-agent research system — Anthropic Engineering |
| 传染 | 分岔点之后那些看起来同样离谱、但只是在错误前提上继续往前推的步骤。 | How we built our multi-agent research system — Anthropic Engineering |
| 重放观察 | 用一模一样的提示词和工具搭模拟环境、逐步观看 Agent 干活,把失败模式立刻逼出来。 | How we built our multi-agent research system — Anthropic Engineering |
| 桩 client | 不发网络请求、按顺序从固定数组返回预写响应对象的替身,让模型这一侧变得可复现。 | How we built our multi-agent research system — Anthropic Engineering |
| 响应队列 | 桩 client 背后那个按顺序取用的响应数组,每个元素都带完整的停止原因、内容块与用量。 | How we built our multi-agent research system — Anthropic Engineering |
| 工具测试 Agent | 给它一个有缺陷的工具、让它反复试用并重写工具描述以避开失败的 Agent;测试几十次就能找出关键细节和 bug。 | How we built our multi-agent research system — Anthropic Engineering |
| trace_id | 一次运行一个的 id,把散落在同一条流里的行串回同一次运行。 | Monitoring — Claude Code 官方文档 |
| span_id | 本条记录自己的 id,别的记录靠指向它来声明「我在你下面」。 | Monitoring — Claude Code 官方文档 |
| parent_id | 指向父记录 id 的字段,树就是靠它从磁盘上的 JSONL 重建出来的。 | Monitoring — Claude Code 官方文档 |
| MAX_ROUNDS | 循环轮数上限这道硬闸,超了就抛错、记一条中断记录、非零退出。 | Building Effective AI Agents — Anthropic Engineering |
| stop_reason | 模型响应里驱动 harness 循环继续或收尾的那个字段。 | Building Effective AI Agents — Anthropic Engineering |
| HEAD_CHARS | 日志里每段内容最多保留多少字符摘要的那条线,设成 0 就一个字的内容都不落盘。 | Observability with OpenTelemetry — Claude Agent SDK 官方文档 |
| shape | 记录里描述一个值的类型与规模的字段,比如是字符串还是对象、多长、有哪些键。 | Observability with OpenTelemetry — Claude Agent SDK 官方文档 |
| 指标汇总 | 一行输出总轮数、工具调用次数、token、报错数与总耗时的观测三件套之一。 | Writing effective tools for agents — with agents — Anthropic Engineering |
| compare-runs.mjs | 读两份运行日志、按记录类型与工具名并排对比、报错非零就退出的对比脚本。 | Writing effective tools for agents — with agents — Anthropic Engineering |
| gate | 把某个判定接成退出码的闸门,非零就能被 CI、cron 或任何「非零就报警」的地方接住。 | Writing effective tools for agents — with agents — Anthropic Engineering |