帮你快速理解、总结文档立即下载
文档中心>腾讯云智能体开发平台>购买指南>套餐订阅>PU 资源使用场景与抵扣规则(套餐订阅)

PU 资源使用场景与抵扣规则(套餐订阅)

最近更新时间:2026-10-10 17:58:31
我的收藏
注意:
自 2026 年 10 月 12 日起,腾讯云智能体开发平台上线新版订阅套餐,包含体验版、进阶版与企业标准版。本文档中的套餐额度与抵扣规则均按新版套餐说明,已购套餐在原有效期内,原套餐已包含的权益及已购增购资源保持不变,并将继续按照原续费周期和原权益自动续费。如后续续费规则发生变化,我们将另行通知。现有套餐到期后,可选择购买进阶版或企业标准版。

核心计费概念说明

PU 的定义:PU 是腾讯云智能体开发平台部分计费场景用于消耗结算的通用单位,1 PU =0.001 元人民币。
抵扣范围:可用于抵扣模型服务、连接器与工具、知识库超量存储、资源超量使用、平台服务场景的使用量。
抵扣顺序:企业账号下所有可用的 PU 资源(含套餐包 PU、赠领 PU、PU 增购包)统一按到期时间由近到远依次抵扣,即先到期的先抵扣。套餐包中的 PU 资源按月重置,不累计;赠领 PU 与 PU 增购包在各自有效期内可用,到期后不可继续使用。
使用规则:套餐版本与各版本包含的 PU 额度,请参见 计费概述(套餐订阅)。

模型服务

模型服务在多个场景中使用,仅对平台内置的模型进行收费。包括:
1. 对话场景
以下对话入口中,使用模型会进行收费:
对话测试:应用设置的对话页面或工作流调试页面执行。
应用评测:通过应用评测功能使用。
体验用户端及渠道:经由微信、企业微信、体验用户端三类入口使用。
API:调用对话 API,工作流异步任务接口、知识检索 API。
收费场景说明:
在标准模式下选用相应生成模型、思考模型、多模态问答模型、多模态阅读理解模型、Prompt 改写模型、向量模型、重排序模型、nl2sql 模型、文档解析模型等进行收费。
生成模型/思考模型:
在标准模式下的应用设置中选择生成模型,对话中模型输出结果为问答回复、文档回复、大模型直接回复、数据库回复场景。
在标准模式下的应用设置中选择思考模型,使用思考模型判断对话意图。
在工作流的大模型节点中选择模型,对话调用相关节点。
在知识库问答工具中选择模型,对话时调用工具。
Multi-Agent 模式下,调用 Agent 时,按 Agent 模型上报用量。
对话过程中启用长期记忆功能,对记忆内容的写入、更新及检索操作,按所选模型对写入数据进行计量。
开启推荐问题功能,生成的推荐问题将使用应用设置中的生成模型收费。
多模态模型:此场景下仅收取多模态问答模型 Token ,不再叠加生成模型费用。
多模态问答模型:用户提问包含图片,基于图片理解的回复会按照选择的多模态问答模型上报用量。
多模态阅读理解模型:在应用设置中开启“检索知识库回答图片问题”功能,且用户提问包含图片,使用图片检索知识库进行回复的场景,会按照多模态阅读理解模型中选择的模型上报用量。
Prompt 改写模型:
在应用设置中开启“模型上下文改写”时,将对用户提问改写的结果上报用量。
在应用设置中开启“检索知识库回答图片问题”功能,且用户提问包含图片,使用图片检索知识库进行回复的场景下,调用改写模型处理问题与图片理解内容。
向量模型:
标准模式下,检索知识库结果用于回复的场景,会按照选择的向量模型上报用量。
对话时调用工作流的大模型知识问答、知识检索节点。
对话时调用知识库问答工具、知识检索工具。
重排序模型:
标准模式下,检索知识库结果用于回复的场景。
对话时调用工作流的大模型知识问答、知识检索节点。
对话时调用知识库问答工具、知识检索工具、重排序工具。
nl2sql 模型:
标准模式下,开启数据库或开启 Excel 检索增强功能时,成功检索知识库中的智能化表格的场景,会按照选择的 nl2sql 模型上报用量。
对话时调用数据库 text2sql 工具。
文档解析模型:
用户在对话中输入文档,使用文档解析模型按页上报用量。
2. 一键优化场景
应用设置中,使用提示词、欢迎语、转角描述一键优化功能。
工作流节点、工作流描述中,使用一键优化功能。
3. 应用运营-对话记录智能分类
点击智能分类功能,依据所选生成模型和向量模型上报用量。
4. 生成 Widget
在 Widget 开发中,使用自然语言生成创建 Widget。
5. 知识库使用场景
文档生成问答对、相似问题生成,根据选择的问答对生成模型上报用量。
生成知识库 Schema ,根据选择的知识库 Schema 生成模型上报用量。
模型用量可以在数据报表 > 资源看板 > 模型用量中查看:



结算价格
注意:
因 DeepSeek 原厂近期调整部分模型价格,腾讯云智能体开发平台同步调整对应模型的计费价格, 具体价格及生效时间以本页面最新信息为准,请您及时关注。
自定义模型
模型名称
峰谷计费
输入/输出
PU 资源结算价格
(PU /百万 tokens)
现金折算价格
(元/百万 tokens)
DeepSeek-V4-Pro 0813 正式版
空闲时段(北京时间):
00:00-09:00、12:00-14:00、18:00-24:00
输入
4500
4.5
输出
13500
13.5
缓存
150
0.15
高峰时段(北京时间):
09:00-12:00、14:00-18:00
输入
9000
9.0
输出
27000
27.0
缓存
300
0.30
DeepSeek-V4-Flash 0731 正式版
空闲时段(北京时间):
00:00-09:00、12:00-14:00、18:00-24:00
输入
1500
1.5
输出
4500
4.5
缓存
50
0.05
高峰时段(北京时间):
09:00-12:00、14:00-18:00
输入
3000
3.0
输出
9000
9.0
缓存
100
0.10
DeepSeek-V4-Pro 0813(原厂)

新价格于北京时间 2026 年 8 月 17 日 00:00 生效
空闲时段(北京时间):
00:00-09:00、12:00-14:00、18:00-24:00
输入
4500
4.5
输出
13500
13.5
缓存
150
0.15
高峰时段(北京时间):
09:00-12:00、14:00-18:00
输入
9000
9.0
输出
27000
27.0
缓存
300
0.30

DeepSeek-V4.1-Flash


空闲时段(北京时间):
00:00-09:00、12:00-14:00、18:00-24:00
输入
1000
1
输出
4000
4
缓存
20
0.02
高峰时段(北京时间):
09:00-12:00、14:00-18:00
输入
2000
2
输出
8000
8
缓存
40
0.04

DeepSeek-V4.1-Flash(原厂)


空闲时段(北京时间):
00:00-09:00、12:00-14:00、18:00-24:00
输入
1000
1
输出
4000
4
缓存
20
0.02
高峰时段(北京时间):
09:00-12:00、14:00-18:00
输入
2000
2
输出
8000
8
缓存
40
0.04
DeepSeek-V4-Flash 0731(原厂)

新价格于北京时间 2026 年 9 月 10 日 12:00 生效
空闲时段(北京时间):
00:00-09:00、12:00-14:00、18:00-24:00
输入
1000
1.0
输出
4000
4.0
缓存
20
0.02
高峰时段(北京时间):
09:00-12:00、14:00-18:00
输入
2000
2.0
输出
8000
8.0
缓存
40
0.04
DeepSeek-V4-Flash-Vision-Exp (原厂)
新价格于北京时间 2026 年 9 月 10 日 12:00 生效
空闲时段(北京时间):
00:00-09:00、12:00-14:00、18:00-24:00
输入
1000
1.0
输出
4000
4.0
缓存
20
0.02
高峰时段(北京时间):
09:00-12:00、14:00-18:00
输入
2000
2.0
输出
8000
8.0
缓存
40
0.04
DeepSeek-V4-Flash 0731(原厂)

价格适用于北京时间 2026 年 9 月 10 日 12:00 前
空闲时段(北京时间):
00:00-09:00、12:00-14:00、18:00-24:00
输入
4500
4.5
输出
13500
13.5
缓存
150
0.15
高峰时段(北京时间):
09:00-12:00、14:00-18:00
输入
9000
9.0
输出
27000
27.0
缓存
300
0.30
DeepSeek-V4-Flash-Vision-Exp (原厂)

价格适用于北京时间 2026 年 9 月 10 日 12:00 前
空闲时段(北京时间):
00:00-09:00、12:00-14:00、18:00-24:00
输入
4500
4.5
输出
13500
13.5
缓存
150
0.15
高峰时段(北京时间):
09:00-12:00、14:00-18:00
输入
9000
9.0
输出
27000
27.0
缓存
300
0.30
DeepSeek-V4-Pro 0813(原厂)
价格适用于北京时间 2026 年 8 月 17 日 00:00 前
-
输入
3000
3
-
输出
6000
6
-
缓存
25
0.025
DeepSeek-V4-Flash 0731(原厂)
价格适用于北京时间 2026 年 8 月 17 日 00:00 前
-
输入
1000
1
-
输出
2000
2
-
缓存
20
0.02
DeepSeek-V4-Pro

-
输入
12000
12
-
输出
24000
24
-
缓存
1000
1
GLM-5
-
输入
6000
6
-
输出
22000
22
GLM-5-Turbo
-
输入
5000
5
-
输出
22000
22
-
缓存
1200
1.2
GLM-5V-Turbo
-
输入
5000
5
-
输出
22000
22
-
缓存
1200
1.2
GLM-5.1
-
输入
6000
6
-
输出
24000
24
-
缓存
1300
1.3
GLM-5.2
-
输入
8000
8
-
输出
28000
28
-
缓存
2000
2
GLM-5.3
-
输入
8000
8
-
输出
28000
28
-
缓存
2000
2
GLM-5.3-Flash
-
输入
800
0.8
-
输出
2800
2.8
-
缓存
230
0.23
Kimi K2.6
-
输入
6500
6.5
-
输出
27000
27
-
缓存
1100
1.1
Kimi K3
-
输入
20000
20
-
输出
100000
100
-
缓存
2000
2
MiniMax-M3
-
输入
2100
2.1
-
输出
8400
8.4
-
缓存
420
0.42
Hunyuan 模型
模型名称
输入/输出
PU 资源结算价格(PU /百万 tokens)
现金折算价格(元/百万 tokens)
Hy3
输入
1000
1
输出
4000
4
缓存
250
0.25
Hy4 preview
输入
6000
6
输出
18000
18
缓存
300
0.3
Youtu 模型
模型名称
输入/输出
PU 资源结算价格
现金折算价格
youtu-intent-pro
输入
800 PU/百万 tokens
0.8 元/百万 tokens
输出
1900 PU/百万 tokens
1.9 元/百万 tokens
youtu-mllm
输入
3000 PU/百万 tokens
3 元/百万 tokens
输出
9000 PU/百万 tokens
9 元/百万 tokens
youtu-rewrite
输入
2000 PU/百万 tokens
2 元/百万 tokens
输出
500 PU/百万 tokens
0.5 元/百万 tokens
youtu-embedding
-
500 PU/百万 tokens
0.5 元/百万 tokens
youtu-embedding-llm
-
500 PU/百万 tokens
0.5 元/百万 tokens
youtu-reranker
-
500 PU/百万 tokens
0.5 元/百万 tokens
youtu-reranker-llm
-
500 PU/百万 tokens
0.5 元/百万 tokens
youtu-doclm
-
200 PU/页
0.2 元/页

连接器与工具

除调用知识库问答工具、知识检索工具、数据库 text2sql 工具、重排序工具会产生模型用量以外,其他连接器与工具在被调用时均按连接器 / 工具上报用量,调用场景包括添加为 Agent 工具时调用,在工作流中调用和在智能工作台中调用。可在数据报表 > 资源看板 > 连接器与工具用量中查看:



结算价格
连接器与工具名称
计费类型
PU 资源结算价格
现金折算价格
网页解析
WebpageParsingQA 工具
按 tokens 计费-输入
120000 PU /百万 tokens
120 元/百万 tokens
按 tokens 计费-输出
120000 PU /百万 tokens
120 元/百万 tokens
文档解析
DocParsingQA 工具
按 tokens 计费
480000 PU /百万 tokens
480 元/百万 tokens
文档解析
DocParse 工具
按页计费
200 PU/页
0.2 元/页
DeepSeek AI 搜索
DeepSeekV3Search 工具
按次计费
55 PU/次
0.055 元/次
DeepSeek AI 搜索
DeepSeekR1Search 工具
按次计费
125 PU/次
0.125 元/次
混元 AI 搜索
按次计费
30 PU/次
0.03 元/次
图片理解
按 tokens 计费-输入
3000 PU /百万 tokens
3 元/百万 tokens
按 tokens 计费-输出
9000 PU /百万 tokens
9 元/百万 tokens
图片标签识别
按次计费
1 PU/次
0.001 元/次
腾讯医典
按次计费
100 PU/次
0.1 元/次
较真 AI-智能查真假
按千次计费
110000 PU/千次
110 元/千次
PDF 转 Office 文档
按次计费
8 PU/次
0.008 元/次
文档转 PDF
按次计费
8 PU/次
0.008 元/次
图片转 Office 文档
按次计费
8 PU/次
0.008 元/次
文档翻译
按次计费
8 PU/次
0.008 元/次
医疗报告解读
按次计费
2000 PU/次
2 元/次
AI 智能问药
LLMDiagnosisDrug 工具
按次计费
2000 PU/次
2 元/次
AI 智能问药
LLMDiagnosisDrugChat 工具
按次计费
1500 PU/次
1.5 元/次
药品说明书查询
按次计费
1000 PU/次
1 元/次
AI 症状自查
按次计费
1000 PU/次
1 元/次
视频处理
按时长计费
1.85 PU/秒
0.00185 元/秒
视频转码
按时长计费
0.3 PU/秒
0.0003 元/秒
综艺视频片段拆分
按时长计费
0.8 PU/秒
0.0008 元/秒
腾讯云语音识别
按时长计费
50 PU/分钟
0.05 元/分钟
短文本语音合成
按字符计费
120 PU/千字符
0.12 元/千字符
AI 人脸防护盾
按次计费
1200 PU/次
1.2 元/次
人脸年龄变化
按次计费
30 PU/次
0.03 元/次
人脸性别转换
按次计费
30 PU/次
0.03 元/次
人脸美颜
按次计费
10 PU/次
0.01 元/次
图片翻译
按次计费
45 PU/次
0.045 元/次
文档抽取(基础版)
按次计费
400 PU/次
0.4 元/次
文档抽取(多模态版)
按次计费
480 PU/次
0.48 元/次
通用文字识别(高精度版)
按次计费
500 PU/次
0.5 元/次
图片生成(2.0)
按张计费
500 PU/张
0.5 元/张
图片生成(3.0)
按张计费
200 PU/张
0.2 元/张
混元生3D
按个计费
1800 PU/个
1.8 元/个
混元生3D(专业版)
按个计费
2400 PU/个
2.4 元/个
长文本语音合成
按字符计费
320 PU/千字符
0.32 元/千字符
视频理解
按 tokens 计费-输入
3000 PU/百万 tokens
3 元/百万 tokens
按 tokens 计费-输出
9000 PU/百万 tokens
9 元/百万 tokens
赛灵
按次计费
300 PU/次
0.3 元/次
文档重排序
按 tokens 计费
500 PU/百万 tokens
0.5 元/百万 tokens
广告文字识别
按次计费
120 PU/次
0.12 元/次
港澳台地区及境外护照识别
按次计费
150 PU/次
0.15 元/次
中国大陆地区护照识别
按次计费
150 PU/次
0.15 元/次
驾驶证识别
按次计费
150 PU/次
0.15 元/次
行驶证识别
按次计费
150 PU/次
0.15 元/次
二代身份证识别
按次计费
150 PU/次
0.15 元/次
表格识别(V3)
按次计费
150 PU/次
0.15 元/次
公式识别
按页计费
100 PU/页
0.1 元/页
试题识别
按页计费
240 PU/页
0.24 元/页
试卷切题
按页计费
240 PU/页
0.24 元/页
营业执照识别
按次计费
150 PU/次
0.15 元/次
机动车登记证书识别
按次计费
150 PU/次
0.15 元/次
银行卡识别
按次计费
150 PU/次
0.15 元/次
车辆 VIN 码识别
按次计费
150 PU/次
0.15 元/次
车牌识别
按次计费
150 PU/次
0.15 元/次
Youtu-VITA
按 tokens 计费-输入
1200 PU/百万 tokens
1.2元/百万 tokens
按 tokens 计费-输出
3500 PU/百万 tokens
3.5元/百万 tokens
说明:
知识库问答工具与知识检索工具的计费规则:
根据您实际选用的模型计费,按该模型的输入/输出 Token 消耗量进行 PU 资源抵扣。各模型具体定价请参阅本页 PU 资源抵扣规则-模型服务 章节。
图片理解工具传入图片时,以模型实际计算的 token 为准。
计算公式:图片消耗 tokens = 256 + n * 64,其中 n 为图片包含448*448像素的个数(向上取整)。
连接器与工具付费分类:
官方收费:腾讯云智能体开发平台收费,在连接器与工具中心及选择列表中标注“官方收费连接器与工具”标签/图标。
公测(限时免费):限免期内不收费的连接器与工具,标注“公测”或“限时免费”角标。
第三方:不由腾讯云智能体开发平台控制,由第三方进行收费或免费行为。

知识库超量存储

使用场景:在知识库中上传文档、问答、数据库,需要对使用容量进行收费,企业维度生效,计算企业内用量之和,可使用套餐包中的知识库容量、PU 资源、增购预付费资源包。扣费优先级:套餐包中的知识库容量 > 套餐包中的 PU 包 > 预付费资源包。
扣费逻辑:上传的知识优先使用套餐包中的知识库容量,如超出套餐包知识库容量额度的部分被称为超额使用量,将对知识库超额使用量进行收费,直到超额部分被主动删除。 知识库超额使用量收费的计费公式如下:
超额使用量收费 = (知识库总使用量- 套餐额度)× 超额时间 × 单价金额(单位:元)。
超额时间为超出免费额度部分的使用时长,直到用户删除知识库文件,使用量恢复到套餐额度以下时停止计费,每天上报一次用量。超出部分所需支付的 PU,按资源超量使用中的结算价格从企业 PU 池中抵扣。
各版本知识库容量额度
版本
知识库容量额度
体验版
64 MB
进阶版
512 MB
企业标准版
10 GB
可在数据报表 > 资源看板 > 知识库容量中查看知识库使用情况。

知识库超量失效说明:知识库超出容量额度时,超出部分在使用 7 天后转为超量失效状态(对话与检索均不生效),180 天后自动删除;购买增购包或升级套餐后,需手动批量恢复。

资源超量使用

使用场景:工作空间、应用数量、共享知识库和知识库存储的实际用量超出套餐版本对应配额时,超出部分按使用时长折算为 PU 并从企业 PU 池中抵扣,直到删除资源、用量回落至配额以内,或购买对应增购包提升配额。
超出部分的 PU 按「核心计费概念说明」中的抵扣顺序抵扣;企业 PU 池中的 PU 用尽后,超出配额的资源将无法继续使用。
结算价格
资源
计量口径
PU 结算价格
工作空间
1个
3,333 PU / 个 / 天
应用数量
1个
67 PU / 个 / 天
共享知识库
1个
333 PU / 个 / 天
知识库存储
1 GB
1,333 PU / GB / 天

平台服务

1. 长期记忆
使用长期记忆时,按存储的对话条数每小时上报收费,例如 12:00 存入 1 条,12:30 存入 5 条,则 13:00 上报 12:00–13:00 区间共计 6 条。
2. 内容安全
使用自定义策略内容安全功能,按问答和答案调用次数收费,如一轮有问题和答案,则按“问题 + 答案”计为 2 次调用。
3. 联网搜索
标准模式下使用联网搜索功能,按调用搜索引擎的次数收费。
4. 对话体验(暂未收费)
涵盖音色、形象、语音通话等功能。
5. 智能工作台运行任务
智能工作台实际执行任务的运行时间,涵盖通过工作台、远程终端、定时任务等发起的所有任务。等待用户回复消息的时间不产生费用。每轮对话运行时间不足一分钟按一分钟计算。运行任务过程中调用的模型、工具等单独计费。
6. Claw 运行任务
Claw 模式应用实际执行任务的运行时间,涵盖通过对话调试、应用评测、体验链接、API 调用、发布渠道、常用应用等发起的所有对话。等待用户回复消息的时间不产生费用。每轮对话运行时间不足一分钟按一分钟计算。运行任务过程中调用的模型、工具等单独计费。
可在数据报表 > 资源看板 > 平台用量 中查看:




结算管理

支付方式:通过腾讯云账户在线支付(支持账户余额、代金券及多种线上支付渠道)。
发票申请:支付完成后,可通过【费用中心 > 发票管理】模块申请增值税普通发票或专用发票。
续费管理:支持在 计费资源 中对套餐包和专属并发续费,支持设置为自动续费或手动续费。
说明:
腾讯云不断为用户提供更丰富的服务类型和服务功能。请您理解,腾讯云有权对收费服务的价格进行提升或降低,并且在价格调整时在腾讯云官网进行公告或向您发送通知或在产品文档中展示,调整后的价格将在公告或通知确定的期限生效。
本篇计费概述将根据平台服务发展持续更新。