智能体回答超时10秒、Token消耗异常飙升、输出结果不符合预期——这些问题的根因往往隐藏在复杂的调用链路中。华为云AgentArts调用链分析通过Trace-Span树状结构,将请求全生命周期可视化。本文从调用链列表筛选、详情五维视图到典型排查场景,完整拆解调用链分析的核心能力。
调用链基础——Trace与Span的树状结构
调用链由一个或多个Span组成,呈树状结构。根节点为Root Span(代表用户发起的整次请求),子节点为各个子步骤(如大模型、工具调用等)。当用户通过API发起一次请求时,系统会为该请求创建一个Root Span,请求执行过程中每经过一个子步骤,系统会自动创建一个Span并挂载到Root Span下。
三种Span类型的筛选逻辑
ALL Span:查看所有子请求的完整请求链路,适合全面分析整个调用流程。Root Span:用户发起的整次请求入口,适合快速统计调用次数、概览请求状态。Model Span:大模型调用节点,适合聚焦模型调用性能分析。
调用链列表——多维度筛选与快速定位
调用链分析页面展示调用链数据列表,每条记录包含Trace ID、请求状态、响应时间、Tokens等信息。支持按以下维度筛选:
上报时间:支持选择30天内的数据。应用类型:单智能体应用、工作流应用、多智能体应用。应用:在选定应用类型后进一步筛选具体Agent。数据类型:ALL Span、Root Span、Model Span。Trace ID:根据Trace ID精确筛选。请求状态:成功或失败。输入/输出:根据输入或输出中包含的特定信息筛选。会话ID:根据会话ID筛选。标注:根据标注信息筛选。
调用链详情——五维视图深度分析
进入调用链详情页面后,左侧展示调用树,右侧展示选中Span的详细信息面板。
链路信息——输入输出与报错定位
在左侧调用树中单击目标Span节点,可在“链路信息”页签查看该节点的具体输入与输出内容。如果调用过程中节点发生报错,单击报错节点,“链路信息”页签将展示相应的报错详情,快速定位问题根因。
元数据——运行环境上下文
元数据以键值对形式存储补充信息,例如应用程序版本、运行环境和调用的模型等。以JSON格式展示,支持一键复制。
标注——自定义标记与回流
展示当前数据的详细标注结果,涵盖标签名称、标注内容等信息。标注数据支持按场景筛选并回流至评测集,用于对特定场景下的智能体进行定向评估。
指标——Token与耗时趋势
以折线图形式展示当前Span的关键性能指标,涵盖Token消耗趋势与平均响应时间变化。仅展示当前Span前后15分钟(最大到当前时间)的指标数据。
日志——思考过程与工具调用记录
展示智能体运行的日志信息,包含智能体的思考过程、工具调用的原始输入输出信息。失败状态的Span可在日志中查看具体错误原因。
三个典型排查场景
场景一:定位耗时瓶颈——某次调用响应时间为30秒,通过调用链发现某个工具调用耗时25秒,针对性优化工具逻辑。
场景二:排查回答异常——智能体回答不符合预期,通过调用链查看Model Span的输入内容,发现上下文拼接错误导致模型理解偏差。
场景三:Token消耗异常——调用链分析发现模型在多次对话中反复调用高成本的长文本生成服务,通过增加上下文判断逻辑避免重复生成。