腾讯云大模型服务平台 TokenHub 已原生集成大模型 WAF(LLM-WAF),提供大模型调用一体化安全防护方案。用户在 TokenHub 控制台一键开通,零代码改造,即可对模型调用与推理服务提供多方面安全保障,涵盖提示词注入防护、内容合规检测、敏感数据防泄露等能力。支持按 Token 用量后付费,灵活满足企业安全需求。
为什么需要大模型 WAF
随着大语言模型深度融入企业核心应用,大模型服务面临提示词注入、内容合规、敏感数据泄露、算力滥用等新型安全风险。传统 Web 应用防火墙(WAF)主要针对 SQL 注入、XSS 等 Web 攻击,无法覆盖大模型特有的交互风险。
腾讯云大模型 WAF(LLM-WAF) 是面向大模型场景打造的安全防护引擎,可精准识别大模型输入输出的特有风险:
提示词攻击防护:基于自研安全检测模型,有效识别越狱、角色扮演、指令注入、上下文污染、编码绕过、多语言混淆、分段拼接等各类提示词注入攻击,降低模型调用过程的注入风险。
输入输出内容合规检测:对大模型的输入和输出内容进行深度检测,识别违法违规、不良信息等多类文本和图片风险,助力企业落实生成式 AI 应用的内容安全要求。
敏感数据防泄露:内置 30+ 种敏感数据类型自动识别能力,包括身份证、银行卡、手机号、护照、车牌号、AKSK、AES 密钥等,支持观察或拦截处置模式。企业可按需启用内置规则和自定义规则,防止模型交互过程中的敏感数据泄露。
个性化防护规则与审计:支持企业自定义数据分类、涉敏信息、关键词、正则表达式、编码类型等规则,适用于个性化安全要求。同时提供丰富的安全日志分析能力,帮助企业溯源审计。
此外,LLM-WAF 还支持 ToolCall 防护、意图行为分析、Skill 检测、算力消耗检测等 AI 运行时护栏能力,多方面保障企业 AI 业务安全。
操作步骤
1. 登录 TokenHub 控制台,在左侧导航栏选择平台配置 > 系统配置。
2. 在安全防护区域,单击大模型安全开关。
3. 在开通大模型安全页面,按需选择所需开启的能力项,单击同意开通&授权。

4. 在授权服务页面,单击同意授权,完成 LLM-WAF 按量服务开通。
5. 开通防护后,可单击 WAF 实例跳转至 LLM-WAF 控制台,配置和查看大模型防护规则。

说明:
开通后可在 LLM-WAF 控制台查阅生效状态,生效后即可对模型调用流量进行实时检测。
核心安全检测能力
能力项的具体规则范围和检测口径以 LLM-WAF 控制台展示为准。
计费说明
TokenHub 场景支持一键开通大模型 WAF 后付费(按量计费)模式,按各能力项实际检测量分别计费,无需预付套餐费。
各能力项独立计费,用户仅按实际开启的能力项与检测量付费。自定义防护规则不单独计费,开启规则后按对应计费项(提示词注入 / 内容安全 / 敏感数据)计价,具体价格请以 TokenHub 控制台 或 LLM-WAF 计费文档 展示为准。
注意事项
一键开通后,系统将按实际使用量开始计费,建议根据业务需要合理配置检测能力项。
开通防护仅对开通后的流量生效,此前产生的调用记录不会被回溯检测。
防护检测在网关层实时完成,通常会引入一定时延,具体数值受请求特征、规则复杂度等因素影响。
如发现误拦截情况,可通过自定义白名单规则排除特定请求,或联系技术支持协助排查。