什么是高性能应用服务 HAI
高性能应用服务(Hyper Application Inventor,HAI)是腾讯云基于 GPU/NPU 异构算力构建的 AI 应用平台,为您预置常用运行环境和依赖,支持快速创建和使用。
您可按应用场景、模型和算力规模创建开发实例或模型服务。HAI 提供环境搭建、模型适配、服务部署和运行管理等能力支持,帮助您减少基础设施选型、环境配置和服务运维工作。
产品形态
HAI 应用实例
面向开发、调试和单实例应用场景,交付包含算力、存储、网络、AI 框架、模型环境和开发工具的实例。您可根据应用使用 JupyterLab、WebUI、终端或其他连接入口。
HAI 推理服务/可信集群
面向在线模型服务,支持从预置模型、部署模板、自有模型或自定义镜像创建推理服务,并配置推理框架、算力套餐、副本、网络、缓存、监控和日志。
HAI 可信推理
面向金融、医疗、政务和其他高敏数据场景,在支持的可信执行环境(TEE)中提供推理服务。
具身智能能力服务
面向机器人感知、规划和执行链路,提供云端具身模型、算力和推理能力。您可通过 HAI 部署 Tairos 等具身模型,或根据产品开放状态订阅具身智能算力背包。
如何使用高性能应用服务 HAI
腾讯云为您提供如下方式进行高性能应用服务 HAI 的配置和管理:
控制台:高性能应用服务 HAI 可使用 控制台,对算力资源进行管理。
API:腾讯云也提供了 API 接口方便您管理高性能应用服务 HAI。关于 API 说明,请参见 API 概览。
说明