Agent 可观测是腾讯云可观测平台为 AI Agent 应用提供的综合监控分析能力。
操作步骤
2. 通过右上方的时间选择器指定查询时间跨度。
3. 通过标签页切换功能模块。
应用列表
应用列表展示当前业务系统下所有已接入 AI Agent 应用。

功能说明
应用过滤:单击页面上方过滤器,可以基于应用名、应用 ID 和应用标签进行过滤。
清理应用:清理应用功能仅针对已经不再上报监控数据的应用,请先确保该应用的探针已经成功卸载(如果通过代码上报,请删除相关逻辑)。在执行完清理操作后,系统将删除和该应用相关的所有数据。
编辑标签:通过该功能,可以为应用关联多个标签,用于应用查询以及细粒度的权限配置。标签键和标签值引用自腾讯云统一的标签中心,如果需要维护标签,请前往 标签列表。
表格列说明
列名 | 说明 |
应用名称/ID | 应用的名称和唯一标识 |
AI 请求数 | 选定时间范围内该应用的 AI 请求总数 |
AI 请求平均耗时 | 从请求发起到响应完成的端到端平均耗时 |
模型调用次数 | 该应用发起的 LLM 模型调用总次数 |
总 Token | 该应用在选定时间范围内消耗的总 Token 数量 |
操作 | 支持清理应用和编辑标签操作 |
应用详情
单击列表中的任意行,可打开应用详情面板。应用详情以右侧滑出抽屉形式展示,包含以下子页面:
性能概览:该应用维度下的请求量、耗时、错误率和 Token 趋势图表。
模型性能分析:该应用的模型调用次数、错误率、首 Token 耗时和调用耗时分析。
链路追踪:该应用相关的 Trace/Span 列表,应用过滤项已锁定为当前应用。
用量分析:该应用的 Token 消耗趋势和分布。
性能概览
性能概览提供全局视角的关键性能指标和趋势图表,帮助快速判断当前 AI 应用整体运行状态是否健康。

指标卡片
页面顶部以卡片形式展示核心指标的当前值和环比变化:
指标 | 说明 |
AI 请求数 | 选定时间范围内的请求总量和每秒请求数(QPS) |
AI 请求耗时 | 平均耗时和 P99耗时 |
AI 请求错误率 | 请求维度的错误比例 |
模型调用次数 | LLM 实际调用总量 |
模型调用错误率 | 模型调用维度的错误比例 |
Token 使用量 | 总 Token、输入 Token、输出 Token 的消耗汇总 |
趋势图表
指标卡片下方展示如下时序趋势图:
AI 请求数:请求量随时间的变化趋势。
AI 请求耗时(毫秒):平均/P99/P95/P50多条线对比。
AI 请求错误率(%):错误率变化趋势。
模型调用次数(次):模型调用量趋势。
模型调用错误率(%):模型调用错误趋势。
Token 使用:总 Token/输入 Token/输出 Token 三条线对比。
用量分析
用量分析帮助团队掌握 Token 消耗情况,及时发现异常用量、控制成本。

指标卡片
页面顶部以卡片形式展示核心指标的当前值和环比变化:
指标 | 说明 |
总 Token | 选定范围内的 Token 消耗总量 |
输入 Token | Prompt 部分的 Token 消耗 |
输出 Token | Completion 部分的 Token 消耗 |
调用次数 | 产生 Token 消耗的模型调用总次数 |
趋势图表
Token 使用:总 Token/输入 Token/输出 Token 趋势对比。
平均每个请求 Token 使用:反映单次请求的 Token 效率。
平均每个用户 Token 使用:识别高消耗用户。
Top 10分布
页面下方展示 Token 消耗的 Top 10排行,支持按以下维度切换:
模型分布:哪些模型消耗了最多 Token。
应用分布:哪些应用消耗了最多 Token。
用户分布:哪些用户产生了最多 Token 消耗。
会话分析
会话分析按会话(Session)维度聚合观测数据,帮助理解用户的真实交互过程和单次会话的资源消耗情况。

会话列表
以表格形式展示所有会话记录,列包含:
列名 | 说明 |
会话 ID | 会话的唯一标识 |
开始时间 | 会话首条消息的时间戳 |
会话时长 | 从首条消息到末条消息的时间跨度 |
轮次 | 对话来回的轮数 |
Token | 整个会话消耗的总 Token |
输入 Token | 会话中所有 Prompt 的 Token 总和 |
输出 Token | 会话中所有 Completion 的 Token 总和 |
用户 ID | 发起该会话的用户标识 |
会话详情
单击任意会话行,可打开会话详情面板。包含如下内容:
顶部指标栏:开始时间、总耗时、轮次、总 Tokens、输入 Tokens、输出 Tokens、User ID。
链路列表:该会话关联的 Trace 时间轴,展示调用耗时和 Token 消耗、链路 ID、总/输入/输出 Tokens、首 Token 耗时(TTFT)、LLM 调用次数、工具调用次数等详细信息。
会话消息:以聊天气泡形式格式化展示每一轮对话内容,支持格式化和原始数据两种查看模式。
