帮你快速理解、总结文档立即下载

Agent 可观测应用详情

最近更新时间:2026-09-24 16:00:01
本文档已由 AI 辅助审校
我的收藏

快速体验

如果您尚未完成应用接入,可先访问 Agent 可观测 Demo 环境,无需登录即可预览 Agent 可观测的完整页面,直观了解接入后可以看到的仪表盘、调用链与会话详情。Demo 环境展示的是演示数据,仅供功能预览,不支持数据写入与配置修改。完成接入后,您可在 CLS 控制台 > Agent 可观测 查看自己应用的真实数据。
说明:
如果您正在使用 AI 工具,可安装 腾讯云 Agent 可观测助手 Skill,让 AI 一站式完成 Agent 应用的可观测接入与数据分析。接入完成后,只需在 AI 对话中描述分析需求(如"帮我看看 Agent 最近的运行情况"),即可基于已上报的 Trace 数据自动执行多维度分析。

概述

应用详情页是 Agent 可观测的核心功能页面,为已接入的 AI 应用提供全方位的监控与分析视图。进入 CLS 控制台 > Agent 可观测 ,即可查看应用详情。
页面包含三大功能模块:仪表盘、调用链和会话,帮助您从宏观指标到微观链路全面掌握 AI 应用的运行状况。
场景
能力
核心价值
整体运行状态如何?
仪表盘 - 总览
请求数、错误数、模型调用次数、Token 消耗等核心指标一览,支持按 Agent/模型维度 Top10排行
性能是否有瓶颈?
仪表盘 - 性能
请求耗时分布、P50/P90/P99分位趋势、模型平均耗时排行,定位慢模型和长尾延迟
Token 成本花在哪?
仪表盘 - 成本&Token
输入/输出 Token 总量、分位趋势,掌握成本走向
应用内部组件表现如何?
仪表盘 - 应用观测
按操作类型(generation/tool/agent/retriever 等)分析调用分布和耗时
单次请求发生了什么?
调用链
完整的 Trace 列表和详情,支持按状态/错误类型/耗时等过滤,展示调用树和每个节点的 Input/Output
用户多轮对话全貌?
会话
以 Session 维度聚合 Trace,还原多轮对话上下文,统计会话级 Token 和成本

应用列表

进入 CLS 控制台 > Agent 可观测 页面,可查看所有已接入的 AI 应用。页面顶部展示以下全局指标:
指标
说明
已接入应用
当前已成功接入 Agent 可观测的应用总数。
昨日写数据总量
前一日所有应用写入 CLS 的数据总量。
昨日 Token 总数
前一日所有应用消耗的 Token 总数。
应用列表展示每个应用的名称/ID、地域、接入类型、创建时间、昨日写数据量和昨日 Token 数等信息。单击操作列中的进入观测,即可进入该应用的详情页。


仪表盘

仪表盘页面提供应用运行的可视化监控面板,通过指标卡片和时序图直观展示应用各项核心指标。仪表盘包含四个子 Tab:总览、性能、成本&Token 和应用观测。


筛选条件

仪表盘页面顶部提供用户 ID、用户名和服务名三个筛选框,可按指定维度过滤统计数据。筛选条件对总览、性能、成本&Token 和应用观测四个子 Tab 中的所有图表同时生效,便于按具体用户或服务下钻分析。
筛选项依赖上报数据中的对应字段,不同接入类型的字段名称如下:
筛选项
说明
Agent 接入类型对应字段
Langfuse 接入类型对应字段
用户 ID
按发起请求的终端用户唯一标识过滤,用于分析单个用户的调用情况。
attribute.gen_ai.user.id
attribute.user.id
用户名
按终端用户名称过滤。
attribute.gen_ai.user.name
暂不支持
服务名
按上报数据的服务名称过滤,用于区分同一应用下的多个服务。
resource.service.name
service

总览

总览面板提供应用运行状态的全局视角,适合日常巡检和快速定位异常。
功能
说明
核心指标卡片
展示 Agent 数量、请求数、模型调用次数、输入/输出 Tokens、Tokens 总量等核心 KPI,并显示环比变化百分比。
请求数 / 错误数趋势
支持切换查看请求数或错误数随时间的变化趋势。
模型调用次数时序
展示底层大模型调用次数随时间的变化趋势。
请求数 Top10(按 Agent)
按 Agent 维度统计请求量排行,定位高频调用的 Agent。
模型调用次数 Top10(按 Agent + 模型)
按 Agent 和模型组合维度统计调用量排行。
Tokens 总量分布
展示单次请求 Token 消耗的直方图分布,了解 Token 使用集中区间。
Tokens 总量(按模型)Top10
按模型统计 Token 消耗总量,识别高消耗模型。
模型调用错误数
统计模型调用产生的错误数量。
每秒输出 Tokens(TPS,按模型)
评估各模型的输出吞吐率。

性能

性能面板聚焦于延迟和吞吐分析,帮助发现和优化性能瓶颈。
功能
说明
核心指标卡片
展示请求数、错误数、平均耗时、模型调用次数、模型错误数和模型平均耗时。
请求耗时分布
以直方图展示请求耗时分布,支持查看 P50、P90、P99和平均值。
请求耗时分位
展示 P50、P90、P99请求耗时随时间的变化趋势,监控长尾延迟变化。
模型调用耗时分布
以直方图展示模型调用耗时分布。
模型平均耗时趋势
展示各模型平均调用耗时随时间的变化。
模型调用次数 Top10
按模型统计调用次数排行。
模型平均耗时 Top10
按模型统计平均调用耗时排行。
请求数(按模型)Top10
按模型统计请求数量排行。
模型 P95 耗时趋势
展示各模型 P95调用耗时随时间的变化。
模型 P99 耗时趋势
展示各模型 P99调用耗时随时间的变化。
TPS(按模型)
展示各模型每秒输出 Token 数。
性能明细(按模型)
展示模型、调用次数、平均耗时、P95、P99、输入 Tokens 和输出 Tokens。

成本&Token

成本&Token 面板帮助您监控和管理 Token 消耗趋势。
功能
说明
Token 指标卡片
展示输入 Tokens、输出 Tokens、Tokens 总量,以及平均输入、平均输出和平均总量。
Token 总量趋势
展示 Token 总量随时间的变化趋势。
Token 分位趋势
展示单次请求 Token 消耗的 P50、P90、P99分位变化趋势。
Token 总量分布
展示单次请求 Token 消耗的分布情况。
请求平均 Token 分布
展示请求平均 Token 消耗的分布情况。
Token 总量(按模型)Top10
按模型统计 Token 消耗总量排行。
TPS 趋势
展示每秒输出 Token 数随时间的变化。
Token 总量(按模型)趋势
展示各模型 Token 总量随时间的变化。
Token 输入/输出(按模型)Top10
按模型对比输入和输出 Token 消耗。
请求平均 Token 趋势
展示请求平均 Token 消耗随时间的变化。
平均 Token(按模型)趋势
展示各模型平均 Token 消耗随时间的变化。
输入 Token 分布直方图
展示单次请求输入 Token 的分布情况。
Token 明细(按模型)
展示各模型的输入、输出及总 Token 消耗明细。

应用观测

应用观测面板提供应用内部组件级别的运行分析,按 LLM、SKILL、TOOL、AGENT 等操作类型展示各组件的调用和性能情况。
功能
说明
操作类型分布
按 LLM、SKILL、TOOL、AGENT 等操作类型展示调用分布。
Observation 平均耗时
对比不同操作类型 Observation 的平均执行耗时。
LLM 组
展示 LLM 调用次数、LLM 耗时分位趋势、LLM 调用模型排行和 LLM 平均耗时 Top10。其中,LLM 耗时分位趋势展示 P50、P90、P99分位变化,模型排行和平均耗时 Top10均按模型统计。
SKILL 组
展示 SKILL 调用次数,以及按 Skill 名称统计的成功/错误调用次数 Top10。
TOOL 组
展示 TOOL 调用次数、TOOL 平均耗时 Top10,以及按 Tool 名称统计的成功/错误调用次数 Top10。
AGENT 组
展示按模型统计的操作类型明细。

调用链

调用链页面提供请求级别的细粒度追踪能力,帮助您深入分析单次请求的完整执行路径。支持 Traces 和 Observations 两个视图切换。


Trace 列表与筛选

功能
说明
Trace 状态筛选
按成功(OK)或错误(ERROR)状态过滤,快速聚焦异常请求。
错误类型筛选
按具体错误类型(tool 调用失败、LLM 调用失败、Root span 状态码异常、AGENT 执行失败等)分类过滤。
Trace ID / Session ID 查询
精确查找特定 Trace 或某个会话下的所有 Trace。
Duration 范围筛选
按耗时范围筛选,快速定位慢请求。
列表展示
每条 Trace 显示状态、错误类型、时间戳、Trace ID、Operation 名称、调用模型等信息。

Trace 详情

单击任意一条 Trace 可展开详情视图,完整还原单次请求的调用链路。

功能
说明
基本信息
Trace ID、起始时间、总耗时、Observations 数量、Token 消耗总量(输入→输出)、费用、版本号、Session ID。
调用树
左侧以树形结构展示本次请求的完整调用链路,包括各节点的操作类型(generation/tool/guardrail 等)、耗时和错误状态标识。
节点详情
选中调用树中的任意节点,右侧展示该节点的 Tags、Input/Output 内容、Observation 类型、延迟和执行状态。
错误诊断
ERROR 状态的 Trace 会标注错误信号来源(如"由以下上浮到 Trace 的 Observation 错误触发"),帮助快速定位根因。

会话

会话页面以 Session 维度聚合展示用户与 AI 应用的交互过程,帮助您了解用户的使用模式和对话质量。

功能
说明
Session ID 搜索
支持精确搜索特定会话。
Session Duration 筛选
按会话持续时长范围过滤。
Traces Count 筛选
按会话包含的 Trace 数量过滤。
Input / Output / Total Tokens 筛选
按会话级别的 Token 消耗量过滤。
Input / Output Cost 筛选
按会话级别的成本过滤。
会话列表
展示 Session ID、创建时间、持续时长、模型、用户输入摘要等信息。
会话详情
选中会话后展示该 Session 下的所有 Trace 调用树,右侧展示 Trace 详细信息(Tags、Input/Output 内容、Token 消耗、费用)。