帮你快速理解、总结文档立即下载

操作指引

最近更新时间:2026-08-04 19:09:17
我的收藏
本文为您介绍图像识别相关的产品服务及功能的快速入门指引,分为两块内容:视觉理解大模型与传统 CV 模型。

视觉理解大模型

应用场景模式

该模式为本产品的主推模式,更便于对业务场景规则的管理,支持在 产品控制台 直接页面使用和 线上 API 调用 两种使用方式。
1. 应用中心 先选择对应的业务场景。

2. 进入业务场景后,可在应用工作台 Tab 里直接使用相关功能。

3. 规则管理 Tab,可查看该场景下的规则,以及支持新建自定义规则。若需要以 API 的方式调用规则,在该页面上获取规则 ID 作为 rule_id 参数传入接口,详见 API 对接文档

4. 日志查询 Tab,可查看该场景下页面使用和 API 调用的记录。


自定义 Prompt 模式

该模式通过传入自定义的 Prompt,来实现对图片或视频内容的理解,支持在 产品控制台 直接页面使用和 线上 API 调用 两种使用方式。
控制台页面使用:访问 产品控制台

API 接口调用:参见 API 对接文档自定义 Prompt 模式章节。


传统 CV 模型

传统 CV 模型仅支持 API 接口调用的方式。您可以根据需求,选择下列不同的接口服务:
确定服务接口后,您可以按 图像识别相关接口 指引,调用接口上传图片进行图像识别。您可登录 产品控制台 查看各接口的调用情况。

说明:
接口服务调用涉及到密钥、签名、调试等相关操作,可参见下方说明:
创建密钥:完成注册后,您需要在 访问管理控制台 创建密钥。AppID、SecretID 和 SecretKey 是您进行应用开发的唯一凭证,请务必妥善保管。
生成签名:通过签名来验证请求的合法性,您可以使用主账号的 AppID、SecretID 和 SecretKey 生成签名,具体签名生成方法请参阅 接口鉴权
调试方式
通过 API 3.0 Explorer 进行在线调用图像识别服务:如果您是开发初学者、有代码编写基础,对 HTTP 请求和 API 调用有一定的了解,您可以通过此方式使用图像识别服务。该方式能够实现在线调用、签名验证、SDK 代码生成和快速检索接口等能力。
通过编写代码调用图像识别服务 API:如果您是开发工程师,熟悉代码编写,您可以通过腾讯云已编写好的开发工具集(SDK)来调用图像识别服务 API。SDK 已支持多种语言,包括 Python、Java、PHP、Go、Node.js、.NET 等。您可以在每个服务的文档中下载对应的 SDK,也可以通过 SDK 中心 获取。
您也可以通过 腾讯云命令行工具 来调用腾讯云 API ,管理您的腾讯云资源;您还可以基于腾讯云 CLI 来做自动化和脚本处理,从而简化一些具有复杂 API 的服务。