帮你快速理解、总结文档立即下载

Agent 可观测

最近更新时间:2026-08-04 19:15:03
我的收藏
Agent 可观测是腾讯云可观测平台为 AI Agent 应用提供的综合监控分析能力。

操作步骤

1. 登录 腾讯云可观测平台,前往 AI 可观测 > Agent 可观测 页面。
2. 通过右上方的时间选择器指定查询时间跨度。
3. 通过标签页切换功能模块。

应用列表

应用列表展示当前业务系统下所有已接入 AI Agent 应用。


功能说明

应用过滤:单击页面上方过滤器,可以基于应用名、应用 ID 和应用标签进行过滤。
清理应用:清理应用功能仅针对已经不再上报监控数据的应用,请先确保该应用的探针已经成功卸载(如果通过代码上报,请删除相关逻辑)。在执行完清理操作后,系统将删除和该应用相关的所有数据。
编辑标签:通过该功能,可以为应用关联多个标签,用于应用查询以及细粒度的权限配置。标签键和标签值引用自腾讯云统一的标签中心,如果需要维护标签,请前往 标签列表

表格列说明

列名
说明
应用名称/ID
应用的名称和唯一标识
AI 请求数
选定时间范围内该应用的 AI 请求总数
AI 请求平均耗时
从请求发起到响应完成的端到端平均耗时
模型调用次数
该应用发起的 LLM 模型调用总次数
总 Token
该应用在选定时间范围内消耗的总 Token 数量
操作
支持清理应用编辑标签操作

应用详情

单击列表中的任意行,可打开应用详情面板。应用详情以右侧滑出抽屉形式展示,包含以下子页面:
性能概览:该应用维度下的请求量、耗时、错误率和 Token 趋势图表。
模型性能分析:该应用的模型调用次数、错误率、首 Token 耗时和调用耗时分析。
链路追踪:该应用相关的 Trace/Span 列表,应用过滤项已锁定为当前应用。
用量分析:该应用的 Token 消耗趋势和分布。

性能概览

性能概览提供全局视角的关键性能指标和趋势图表,帮助快速判断当前 AI 应用整体运行状态是否健康。


指标卡片

页面顶部以卡片形式展示核心指标的当前值和环比变化:
指标
说明
AI 请求数
选定时间范围内的请求总量和每秒请求数(QPS)
AI 请求耗时
平均耗时和 P99耗时
AI 请求错误率
请求维度的错误比例
模型调用次数
LLM 实际调用总量
模型调用错误率
模型调用维度的错误比例
Token 使用量
总 Token、输入 Token、输出 Token 的消耗汇总

趋势图表

指标卡片下方展示如下时序趋势图:
AI 请求数:请求量随时间的变化趋势。
AI 请求耗时(毫秒):平均/P99/P95/P50多条线对比。
AI 请求错误率(%):错误率变化趋势。
模型调用次数(次):模型调用量趋势。
模型调用错误率(%):模型调用错误趋势。
Token 使用:总 Token/输入 Token/输出 Token 三条线对比。

用量分析

用量分析帮助团队掌握 Token 消耗情况,及时发现异常用量、控制成本。


指标卡片

页面顶部以卡片形式展示核心指标的当前值和环比变化:
指标
说明
总 Token
选定范围内的 Token 消耗总量
输入 Token
Prompt 部分的 Token 消耗
输出 Token
Completion 部分的 Token 消耗
调用次数
产生 Token 消耗的模型调用总次数

趋势图表

Token 使用:总 Token/输入 Token/输出 Token 趋势对比。
平均每个请求 Token 使用:反映单次请求的 Token 效率。
平均每个用户 Token 使用:识别高消耗用户。

Top 10分布

页面下方展示 Token 消耗的 Top 10排行,支持按以下维度切换:
模型分布:哪些模型消耗了最多 Token。
应用分布:哪些应用消耗了最多 Token。
用户分布:哪些用户产生了最多 Token 消耗。

会话分析

会话分析按会话(Session)维度聚合观测数据,帮助理解用户的真实交互过程和单次会话的资源消耗情况。


会话列表

以表格形式展示所有会话记录,列包含:
列名
说明
会话 ID
会话的唯一标识
开始时间
会话首条消息的时间戳
会话时长
从首条消息到末条消息的时间跨度
轮次
对话来回的轮数
Token
整个会话消耗的总 Token
输入 Token
会话中所有 Prompt 的 Token 总和
输出 Token
会话中所有 Completion 的 Token 总和
用户 ID
发起该会话的用户标识

会话详情

单击任意会话行,可打开会话详情面板。包含如下内容:
顶部指标栏:开始时间、总耗时、轮次、总 Tokens、输入 Tokens、输出 Tokens、User ID。
链路列表:该会话关联的 Trace 时间轴,展示调用耗时和 Token 消耗、链路 ID、总/输入/输出 Tokens、首 Token 耗时(TTFT)、LLM 调用次数、工具调用次数等详细信息。
会话消息:以聊天气泡形式格式化展示每一轮对话内容,支持格式化原始数据两种查看模式。