
腾讯云TokenHub平台是VITA模型的官方接入渠道。本文介绍如何在TokenHub平台上开通VITA服务、获取API密钥、调用API接口,以及通过ADP平台进行无代码配置接入。
腾讯云TokenHub平台是腾讯云提供的模型服务平台,用户可在该平台上开通VITA多模态理解模型服务,获取API密钥,并通过兼容OpenAI API协议的接口进行调用。
在腾讯云TokenHub平台上,VITA模型的调用名称为youtu-vita。VITA提供以下两个可用模型,用户可根据是否需要处理音频选择合适的模型:
可选模型 | 介绍 |
|---|---|
vita-video-3.0 | 支持视频画面(不含音频)和图片,若不需要处理音频,首推该模型 |
vita-video-long | 支持视频(含画面和音频)和图片,需要处理音频则选择该模型 |
访问腾讯云官网,登录腾讯云控制台。
在腾讯云控制台中,进入"腾讯云TokenHub平台"页面。
在TokenHub平台中创建API密钥。每个账号赠送100万免费Token额度,可用于测试和评估VITA的各项能力。
获取API密钥后,即可根据API接入文档进行接口调用。VITA API兼容OpenAI API协议,可直接使用OpenAI SDK进行接入。
https://tokenhub.tencentmaas.com/v1/chat/completions参数名 | 必选 | 类型 | 描述 |
|---|---|---|---|
model | 是 | String | 模型名称,可选值: |
messages | 是 | Array | 需要理解的内容 |
stream | 否 | Boolean | 是否启用流式输出,取值范围 |
temperature | 否 | Float | 输出随机性,取值范围 |
top_p | 否 | Float | 输出多样性(核采样),取值范围 |
max_tokens | 否 | Integer | 限制最大输出Token数 |
stop | 否 | Array of String | 指定模型输出的停止序列,最多4个 |
messages参数是一个数组,每个元素包含role和content字段:
字段 | 必选 | 类型 | 描述 |
|---|---|---|---|
role | 是 | String | 角色,固定为 |
content | 是 | Array | 需要理解的内容 |
content参数是一个数组,每个元素包含type字段和对应的内容字段:
字段 | 必选 | 类型 | 描述 |
|---|---|---|---|
type | 是 | String | 输入类型,可选值: |
text | 是 | String | 自定义的理解指令 |
image_url | 否 | Object | 需要理解的图片信息 |
video_url | 否 | Object | 需要理解的视频信息 |
curl -X POST 'https://tokenhub.tencentmaas.com/v1/chat/completions' \
-H 'Authorization: Bearer YOUR_API_KEY' \
-H 'Content-Type: application/json' \
-d '{
"model": "vita-video-long",
"messages": [{"role": "user", "content": [
{"type": "video_url", "video_url": {"url": "<video url>"}},
{"type": "text", "text": "请描述视频的内容"}
]}],
"stream": false
}'如果视频不含音频,建议使用vita-video-3.0模型。
curl -X POST 'https://tokenhub.tencentmaas.com/v1/chat/completions' \
-H 'Authorization: Bearer YOUR_API_KEY' \
-H 'Content-Type: application/json' \
-d '{
"model": "vita-video-3.0",
"messages": [{"role": "user", "content": [
{"type": "image_url", "image_url": {"url": "<image url 1>"}},
{"type": "image_url", "image_url": {"url": "<image url 2>"}},
{"type": "text", "text": "请描述图片的内容"}
]}],
"stream": false
}'from openai import OpenAI
client = OpenAI(
api_key="YOUR_API_KEY",
base_url="https://tokenhub.tencentmaas.com/v1"
)
response = client.chat.completions.create(
model="vita-video-long",
messages=[{"role": "user", "content": [
{"type": "video_url", "video_url": {"url": "<video url>"}},
{"type": "text", "text": "请描述视频的内容"}
]}],
stream=False
)
print(response.choices[0].message.content)YT-VITA支持一次传入多张图片(最多10张),而HY-Vision系列模型一次仅可传入单张图片。
在腾讯云TokenHub平台上使用VITA模型,主要有两种方式:一是直接调用兼容OpenAI API协议的接口,适合有开发能力的用户;二是通过ADP平台进行无代码配置接入,适合希望快速上线的用户。
想要体验VITA的多模态理解能力?可访问腾讯云TokenHub平台免费试用,每个账号赠送100万Token额度:https://console.cloud.tencent.com/tokenhub/multimodal?modelId=youtu-vita
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。