
Ollama 是目前最流行的本地大模型运行框架,而 DeepSeek 凭借出色的推理能力成为开发者最喜爱的开源模型之一。本文将教你如何在腾讯云轻量应用服务器 Lighthouse 上部署 Ollama + DeepSeek,搭建属于你自己的私有 AI 推理服务。
Ollama 是一个开源的本地大模型管理工具,支持一键拉取和运行 Llama、DeepSeek、Qwen、Mistral 等主流开源模型。它提供与 OpenAI 兼容的 REST API,方便集成到各种应用中。
DeepSeek 由深度求索开发,是国产开源大模型的代表之一。DeepSeek-R1 系列凭借强大的推理能力,在编程、数学、逻辑推理等任务上表现出色,且支持多种参数量版本,从 1.5B 到 671B,适配不同硬件配置。
将 Ollama 与 DeepSeek 部署在云服务器上,你可以获得:
腾讯云 Lighthouse 提供了两种部署方式:
部署完成后,访问 http://你的服务器IP:3000 即可通过 Open WebUI 与 DeepSeek 对话。
如果希望使用其他参数版本的 DeepSeek 模型或自定义配置,可以手动部署。
通过 OrcaTerm 登录服务器,执行一键安装命令:
curl -fsSL https://ollama.com/install.sh | sh验证安装是否成功:
ollama --version根据你的服务器配置选择模型版本:
# 1.5B 版本(2 核 4G 配置推荐)
ollama pull deepseek-r1:1.5b
# 7B 版本(4 核 8G 配置推荐)
ollama pull deepseek-r1:7b启动模型:
ollama run deepseek-r1:1.5b在终端中即可直接与模型对话。退出对话输入 /bye。
为了让模型使用体验更友好,可以部署 Open WebUI:
docker run -d -p 3000:8080 \
-v ollama-webui:/app/backend/data \
-e OLLAMA_BASE_URL=http://127.0.0.1:11434 \
--name ollama-webui \
--restart always \
ghcr.io/open-webui/open-webui:main部署完成后,在浏览器访问 http://你的服务器IP:3000,注册账号后即可在图形界面中与 DeepSeek 对话。
模型版本 | 最低配置 | 推荐配置 | 适用场景 |
|---|---|---|---|
DeepSeek-R1 1.5B | 2 核 4G | 2 核 4G | 简单问答、文本生成 |
DeepSeek-R1 7B | 4 核 8G | 4 核 8G+ | 编程辅助、逻辑推理 |
DeepSeek-R1 14B | 8 核 16G | GPU 实例 | 复杂推理、长文本分析 |
DeepSeek-R1 32B+ | GPU 实例 | GPU 实例 | 专业级 AI 应用 |
Q1:为什么推荐海外地域拉取模型?
A:Ollama 的模型源在海外,国内地域拉取可能较慢。如果选择国内地域,建议先配置国内镜像源。
Q2:2 核 4G 跑 7B 模型会卡吗?
A:2 核 4G 可以运行 7B 模型,但推理速度较慢,适合不追求实时响应的场景。日常交互推荐 1.5B 版本,响应更快。
Q3:如何通过 API 调用部署好的模型?
A:Ollama 默认在 11434 端口提供 REST API。可通过 curl 测试:curl http://localhost:11434/api/generate -d '{"model": "deepseek-r1:1.5b", "prompt": "你好"}'
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。