2026自部署AI助手完全指南:在VPS上搭建私有AI Agent
在VPS上自部署私有AI助手:从选服务器到装Ollama、部署Agent框架、接自动化,全流程步骤。
💡 你将学到
在VPS上自部署私有AI助手:从选服务器到装Ollama、部署Agent框架、接自动化,全流程步骤。
📜 目录
2026自部署AI助手完全指南:在VPS上搭建私有AI Agent
每天用 ChatGPT、Claude、Gemini,但数据隐私、Token 费用、服务停运总让人不放心。每次大模型改价,工作流就崩一次。本文给你一条完整出路:在 VPS 上搭一个真正属于自己的 AI 助手——模型开源、数据在自己手里、不按 token 收费。
一、为什么自部署:三个痛点
- 数据隐私:商业 API 会把你的对话内容送到别人的服务器,敏感数据(代码、合同、客户信息)不适合过 API
- 成本不可控:API 按 token 计费,量一大账单线性涨;自部署是固定硬件成本,用得越多越划算
- 依赖风险:服务改价、限流、停运,你的工作流随时可能断
自部署通过开源模型(Llama、Mistral、Qwen 系)运行在自己的服务器上,数据不出机器。OpenClaw(38 万+ 星)、Ollama、n8n 等开源工具让这件事变得前所未有的简单。
二、方案总览:三件套
| 组件 | 工具 | 作用 |
|---|---|---|
| 推理引擎 | Ollama | 跑开源模型,提供 OpenAI 兼容 API |
| Agent 框架 | OpenClaw | 给模型接工具、记忆、多平台(微信/Telegram 等) |
| 自动化 | n8n | 工作流编排:定时任务、事件触发、对接业务系统 |
三、第一步:选 VPS
建议配置(按模型规模): - 7B 量化模型(日常问答够用):4 核 CPU + 16GB 内存起步,无 GPU 也能跑,速度一般 - 7B 流畅体验:8GB 以上显存的 GPU 实例 - 70B 级别:多卡 GPU 实例,个人用成本偏高
省流:个人自用推荐 4 核 16GB 的 CPU 实例跑 7B 量化版,或先用家里闲置电脑/NAS 练手。硬盘建议 50GB+(模型文件动辄 4-10GB)。
四、第二步:装 Ollama 并拉模型
# 安装
curl -fsSL https://ollama.com/install.sh | sh
# 拉一个 7B 模型(以 Qwen 系为例,中文效果好)
ollama pull qwen2.5:7b
# 验证
ollama run qwen2.5:7b "你好,介绍一下你自己"
启动 API 服务并允许局域网访问(注意安全组限制来源 IP):
OLLAMA_HOST=0.0.0.0:11434 ollama serve
五、第三步:部署 Agent 框架
以 OpenClaw 为例(安装步骤以官方文档为准):
# 安装 OpenClaw(各平台安装方式见官方文档)
# 初始化配置,填入模型地址(指向本机 Ollama 的 OpenAI 兼容端点)
# 启动后即可在支持的平台(如微信/Telegram)与你的私有 Agent 对话
核心配置项:
- 模型地址:http://localhost:11434/v1
- 模型名:qwen2.5:7b
- 工具开关:联网搜索、代码执行、浏览器操作等按需开启
配好后,你的 Agent 就是"你的":对话记录存在你的服务器上,模型行为由你控制。
六、第四步:接自动化(n8n)
n8n 是开源可视化工作流工具:收到邮件 → 调 Agent 总结 → 存进数据库;定时任务 → 抓数据 → Agent 分析 → 推送结果。和 Agent 组合能覆盖大量重复劳动。
示例流:每天 9:00 → 读取昨日销售数据 → Agent 写分析摘要 → 推送到你的 IM
七、成本对比
| 方案 | 前期 | 月度 | 弹性 |
|---|---|---|---|
| 云 API(旗舰模型) | 0 | 按量,重度使用数百元起 | 随用量涨 |
| 自部署 CPU(16GB VPS) | 低 | 固定(VPS 月租) | 固定,用得越多越划算 |
| 自部署 GPU | 中高 | 固定(GPU 实例月租较高) | 性能上限高 |
个人月用量不高时,云 API 更省心;用量大或数据敏感,自部署的固定成本优势明显(详见本站成本分析文)。
常见问题
Q:自部署的模型效果比得上 GPT/Claude 吗? A:7B 级别模型日常问答、总结、分类够用,复杂推理和长文创作与顶尖商业模型有差距。想要更高上限可部署 70B 级模型,或走混合方案(敏感任务本地、重活走 API)。
Q:VPS 上 CPU 跑模型会不会很慢? A:7B 量化版约 2-5 token/s,短问答可用;长文档生成会等得久。想流畅就上 GPU 实例。
Q:数据安全要注意什么? A:默认 Ollama 只监听本机;开放局域网要限制来源 IP,别把 11434 端口裸奔到公网。建议加 API 网关、防火墙规则,或走 Tailscale 组网访问。
Q:模型更新怎么办?
A:ollama pull 拉新版本即可;Agent 框架和 n8n 都有对应升级命令,升级前先备份配置和数据。
注:VPS 配置、模型版本、安装步骤随官方更新,具体以各项目官方文档为准。
相关文章
本站文章由编辑人工撰写,收录的工具均经过实测或公开资料核验。文中链接指向工具官网或 GitHub 仓库,仅作信息参考,不构成付费推广。
