Glossary

78 terms from "可观测性与调试:看清 Agent 的每一步." Look them up when you get stuck; the first mention in the text carries a hover definition.

TermDefinitionSource
非确定性同样的起始条件也可能产出不同响应的系统特性,Agent 就是这一类;它让「复现一次再打断点」的传统调试直觉失去着力点。Writing effective tools for agents — with agents — Anthropic Engineering
轨迹改道一步失败就让 Agent 转去探索一条完全不同的轨迹,后面所有轮次都长在错分支上,最终结果不可预测。How we built our multi-agent research system — Anthropic Engineering
跨轮次复利Agent 有状态、能跑很长时间,在很多次工具调用之间维持状态,所以错误会一轮轮复利累积。How we built our multi-agent research system — Anthropic Engineering
涌现行为多 Agent 系统里没有被专门编程过、却自己冒出来的行为,比如对主 Agent 的小改动不可预测地改变子代理。How we built our multi-agent research system — Anthropic Engineering
评测跑道上一门课建的那套终态判分、验证器与评测集,只回答「这次挂没挂」,不回答「为什么」。How we built our multi-agent research system — Anthropic Engineering
像你的 Agent 一样思考用系统里一模一样的提示词和工具搭出模拟环境,一步一步看 Agent 干活的做法。How we built our multi-agent research system — Anthropic Engineering
抽象层框架为了简化调用 LLM、定义解析工具、串联调用而加上的中间层,它会遮住底层的提示词与响应。Building Effective AI Agents — Anthropic Engineering
沙箱环境让能动手的 Agent 先在里面做广泛测试的隔离环境,配合合适的护栏使用。Building Effective AI Agents — Anthropic Engineering
工具边界确定性系统与非确定性 Agent 之间的契约面,也是唯一会在记录里留下痕迹的位置。Building Effective AI Agents — Anthropic Engineering
ground truthAgent 执行过程中每一步从环境拿到的实打实反馈,比如工具调用结果、代码执行结果。Building Effective AI Agents — Anthropic Engineering
原始记录一次运行里每个工具调用的工具名与完整参数、每个工具响应的完整返回或报错,是第一手证据。Writing effective tools for agents — with agents — Anthropic Engineering
自述Agent 写的关于它自己的文字:收尾总结、推理段落、工具执行后的自我评价,属于二手材料。Writing effective tools for agents — with agents — Anthropic Engineering
思维链模型在给出答案前写出来的那段推理过程,简称 CoT。Writing effective tools for agents — with agents — Anthropic Engineering
四问读记录的检查清单:调错了工具、调对了工具但参数传错、调得太少、把工具响应处理错了。Writing effective tools for agents — with agents — Anthropic Engineering
tool_use模型点名要调哪个工具的内容块,里面有工具名和一份由模型自己生成的完整参数对象。Writing effective tools for agents — with agents — Anthropic Engineering
tool_result宿主真跑一遍工具之后回传的块,成功是完整返回值,失败是报错内容加一个错误标记。Writing effective tools for agents — with agents — Anthropic Engineering
is_error工具结果上的错误标记,用来区分「工具返回了内容」和「工具抛了错」。Writing effective tools for agents — with agents — Anthropic Engineering
内容农场经过 SEO 优化、排名靠前但权威性差的来源;人工测试发现早期 Agent 一贯偏爱它们而放过学术 PDF 与个人博客。How we built our multi-agent research system — Anthropic Engineering
转录会话消息被持久化下来的文件,例如 Claude Code 落在磁盘上的那些 JSONL 会话记录。Monitoring — Claude Code 官方文档
结构化日志把每一步落成带字段的 JSON 记录,让证据除了能被人读,还能被过滤、被聚合、被算分布。Writing effective tools for agents — with agents — Anthropic Engineering
散文日志把结构编码进自然语言的日志写法,读起来顺但只能被人解码。Writing effective tools for agents — with agents — Anthropic Engineering
JSON Lines一个文件、每行一个完整 JSON 对象、行间没有逗号和外层数组的格式,常写作 JSONL。Writing effective tools for agents — with agents — Anthropic Engineering
session_id一次会话的标识,跨多轮不变,用来回答「这次会话总共花了多少钱、中途换过权限模式没有」。Monitoring — Claude Code 官方文档
prompt_id一次用户提示的标识,它触发的所有模型请求和工具调用共用这个值。Monitoring — Claude Code 官方文档
关联 ID给「一次触发」发的身份证号,凡是这次触发引出的事件都抄一遍,不需要任何基础设施,就是一个字段。Monitoring — Claude Code 官方文档
duration_ms一步耗时的毫秒数,用来找性能瓶颈,也用来看「是不是卡住了」。Writing effective tools for agents — with agents — Anthropic Engineering
tool_input发给工具的参数,PostToolUse 载荷里直接给你的那一半完整调用记录。Hooks reference — Claude Code 官方文档
tool_response工具返回的结果,和 tool_input 一起构成一次触发就拿到手的完整往返记录。Hooks reference — Claude Code 官方文档
error记录上的报错字段,只在出错时出现,是定位时第一个要过滤的字段。Writing effective tools for agents — with agents — Anthropic Engineering
指标单次工具调用与整任务的运行时长、工具调用总次数、token 总消耗、工具报错这一组数。Writing effective tools for agents — with agents — Anthropic Engineering
冗余调用大量重复的工具调用,往往提示分页大小或 token 上限这类参数需要重新调一调。Writing effective tools for agents — with agents — Anthropic Engineering
无效参数报错大量因参数不合法而报的错,指向工具描述该写清楚、该补例子。Writing effective tools for agents — with agents — Anthropic Engineering
报错率报错数除以调用次数得到的比例指标,用来替代绝对数看健康度。Writing effective tools for agents — with agents — Anthropic Engineering
终点信号内部重试彻底放弃之后才发出的那一条报错事件,代表「这个请求最终失败了」。Monitoring — Claude Code 官方文档
疑似卡死某次提示的最后一条记录带报错、之后再无任何后续记录的状态,与「从报错里恢复了」相对。Monitoring — Claude Code 官方文档
阈值判断「多少算异常」的那条线;一手材料里没有任何数字,错误预算与 SLO 同理。Monitoring — Claude Code 官方文档
SIEM安全信息与事件管理系统,异常检测、建立基线、跨会话关联和告警都是它这一侧的职责。Monitoring — Claude Code 官方文档
审计轨迹带上终端用户身份属性之后,工具决定、工具结果、MCP 连接、权限模式变更这些事件构成的按用户记录。Observability with OpenTelemetry — Claude Agent SDK 官方文档
span一段有始有终的活儿的记录:有名字、开始结束时间、若干属性,还能指认自己的父亲。Monitoring — Claude Code 官方文档
trace由父子关系串起来的一整棵 span 树,一次完整请求从头到尾发生的所有事读成一棵树。Monitoring — Claude Code 官方文档
claude_code.interaction第一方 trace 里每条用户提示对应的根 span 名。Monitoring — Claude Code 官方文档
子代理通过 Agent 工具派出去的下级 Agent,它的模型请求与工具 span 嵌在父 Agent 的工具 span 之下。Observability with OpenTelemetry — Claude Agent SDK 官方文档
导出器进程里负责把 span 打包发出去的那段代码,英文 exporter。Observability with OpenTelemetry — Claude Agent SDK 官方文档
collector接收 span 的中转站或后端服务,导出器把数据发给它,你在它的界面上看树。Observability with OpenTelemetry — Claude Agent SDK 官方文档
静默失败端点不可达或后端拒收时,Agent 照常运行、遥测被直接丢掉、应用里不冒任何错误的默认行为。Observability with OpenTelemetry — Claude Agent SDK 官方文档
批量导出把遥测攒成批、按间隔发出去的机制,默认指标 60 秒、trace 与日志 5 秒一次。Observability with OpenTelemetry — Claude Agent SDK 官方文档
service.name标识数据来自哪个服务的资源属性,CLI 默认把它报成 claude-code。Observability with OpenTelemetry — Claude Agent SDK 官方文档
claude_code.session.count会话一启动就会发的计数指标,是验证导出配置有没有生效最省事的探针。Monitoring — Claude Code 官方文档
TRACEPARENT装着 trace id 与当前 span id 的标准格式环境变量,Bash 与 PowerShell 子进程会自动继承它。Monitoring — Claude Code 官方文档
W3C trace context一个标准格式的字符串,里面装着 trace id 和当前 span 的 id,谁拿到它谁就知道自己该挂在哪儿。Observability with OpenTelemetry — Claude Agent SDK 官方文档
CLAUDE_CODE_ENHANCED_TELEMETRY_BETA打开之后 Agent 循环的每一步才成为可在追踪后端里检视的 span 的开关。Observability with OpenTelemetry — Claude Agent SDK 官方文档
hooks在 Claude Code 生命周期特定点自动执行的用户自定义命令、HTTP 端点或 LLM 提示。Hooks reference — Claude Code 官方文档
matcher决定一个 hook 在哪些情况下被触发的匹配规则,省略或设成通配就是一钩全记。Hooks reference — Claude Code 官方文档
PreToolUse跑在模型已经创建好工具参数之后、这次工具调用被处理之前的事件。Hooks reference — Claude Code 官方文档
PostToolUse工具已经成功执行之后触发的事件,输入里同时带参数与返回结果。Hooks reference — Claude Code 官方文档
SessionStart每会话一次的事件,新开会话时触发,恢复已有会话时也触发。Hooks reference — Claude Code 官方文档
Stop每轮一次节奏里的收尾事件,与 UserPromptSubmit 配对可以算出一轮的耗时。Hooks reference — Claude Code 官方文档
载荷事件触发且 matcher 命中时,交给你的处理器的那份 JSON 上下文。Hooks reference — Claude Code 官方文档
OTEL_*遥测导出相关的一组环境变量,Claude Code 会把它们从每一个派生的子进程里移除,hooks 也不例外。Hooks reference — Claude Code 官方文档
debug 日志记录哪些 hook 命中了、它们的退出码、完整 stdout 与 stderr 的日志文件。Hooks reference — Claude Code 官方文档
五步定位本课编排的调试走法:按关联 id 收窄、找第一处分岔、重放观察、反复压同一个组件、修复后从出错处恢复。How we built our multi-agent research system — Anthropic Engineering
收窄第一步:把范围从「Agent 出问题了」缩到「这一条 id 底下的十来条事件」。Monitoring — Claude Code 官方文档
第一处分岔行为开始偏离预期的那一步;末尾那些荒唐绝大多数是它的下游噪声。How we built our multi-agent research system — Anthropic Engineering
传染分岔点之后那些看起来同样离谱、但只是在错误前提上继续往前推的步骤。How we built our multi-agent research system — Anthropic Engineering
重放观察用一模一样的提示词和工具搭模拟环境、逐步观看 Agent 干活,把失败模式立刻逼出来。How we built our multi-agent research system — Anthropic Engineering
桩 client不发网络请求、按顺序从固定数组返回预写响应对象的替身,让模型这一侧变得可复现。How we built our multi-agent research system — Anthropic Engineering
响应队列桩 client 背后那个按顺序取用的响应数组,每个元素都带完整的停止原因、内容块与用量。How we built our multi-agent research system — Anthropic Engineering
工具测试 Agent给它一个有缺陷的工具、让它反复试用并重写工具描述以避开失败的 Agent;测试几十次就能找出关键细节和 bug。How we built our multi-agent research system — Anthropic Engineering
trace_id一次运行一个的 id,把散落在同一条流里的行串回同一次运行。Monitoring — Claude Code 官方文档
span_id本条记录自己的 id,别的记录靠指向它来声明「我在你下面」。Monitoring — Claude Code 官方文档
parent_id指向父记录 id 的字段,树就是靠它从磁盘上的 JSONL 重建出来的。Monitoring — Claude Code 官方文档
MAX_ROUNDS循环轮数上限这道硬闸,超了就抛错、记一条中断记录、非零退出。Building Effective AI Agents — Anthropic Engineering
stop_reason模型响应里驱动 harness 循环继续或收尾的那个字段。Building Effective AI Agents — Anthropic Engineering
HEAD_CHARS日志里每段内容最多保留多少字符摘要的那条线,设成 0 就一个字的内容都不落盘。Observability with OpenTelemetry — Claude Agent SDK 官方文档
shape记录里描述一个值的类型与规模的字段,比如是字符串还是对象、多长、有哪些键。Observability with OpenTelemetry — Claude Agent SDK 官方文档
指标汇总一行输出总轮数、工具调用次数、token、报错数与总耗时的观测三件套之一。Writing effective tools for agents — with agents — Anthropic Engineering
compare-runs.mjs读两份运行日志、按记录类型与工具名并排对比、报错非零就退出的对比脚本。Writing effective tools for agents — with agents — Anthropic Engineering
gate把某个判定接成退出码的闸门,非零就能被 CI、cron 或任何「非零就报警」的地方接住。Writing effective tools for agents — with agents — Anthropic Engineering