本文由 腾讯云国际站代理商『翼龙云/Yilongcloud-腾讯云国际服务器服务商•撰写』如需转载请注明!
一、方案组件说明
部署自托管云端 AI 助手涉及以下核心组件:
- 计算底座:腾讯云国际轻量应用服务器 Lighthouse,集成计算、存储、公网带宽,提供 7×24 小时运行环境,海外节点免备案。
- Agent 客户端:Hermes Agent(开源),负责会话上下文管理、工具调用编排、大模型请求转发,自带 Web 管理面板。
- AI 接口网关:TokenHub + 混元 Hy3。TokenHub 提供统一鉴权、流量管控;混元 Hy3 提供底层大模型推理能力,原生兼容 OpenAI 调用协议。
二、 前置条件与准备工作
技术要求:掌握基础 Linux 命令行、SSH 连接及 Docker 容器化操作。
账号准备:需具备已实名且有有效支付方式的腾讯云国际账号。
安全提醒:Hermes 管理面板默认无登录密码,不建议直接对公网全互联网暴露。
服务协助:部署前需准备海外服务器所需的账号与网络环境。翼龙云/Yilongcloud 可提供注册开户协助,根据用户主体与地区梳理准备事项,并提供微信、支付宝、对公转账或 USDT 等支付充值协助,降低跨国部署门槛。
三、 步骤一:在 TokenHub 获取混元 Hy3 API 凭证
重要:生成 APIKey 之后,必须手动在控制台开启 Hy3 模型权限,否则密钥正确也调用失败。
需在 TokenHub 获取合法凭证以调用混元大模型。请按以下框架核对:
登录腾讯云国际控制台,定位至 TokenHub 服务。
在模型列表中确认“混元 Hy3”调用权限。
生成并记录 API Key。
| 参数项 | 国际站标准值 | 备注 |
| API Key | 控制台生成 | 敏感凭证,禁止硬编码、禁止泄露公网 |
| Endpoint(BaseURL) | https://tokenhubintl.tencentmaas.com/v1 | 末尾/v1不可省略,Hermes 为 OpenAI 兼容协议腾讯云 |
| Model Name | hy3 | 不要填写 hunyuanhy3,参数错误直接返回调用失败腾讯云 |
提示:TokenHub 国际站域名,海外 Lighthouse 实例访问延迟更低。
四、 步骤二:创建与配置 Lighthouse 实例
- 地域选择:靠近目标用户,东南亚优先新加坡,欧美选择硅谷 / 法兰克福。
- 系统镜像:Ubuntu 22.04 / 24.04 纯净系统镜像。
- 规格选型
- 最小测试规格:2 核 4G,仅适合简单对话测试。
- 推荐生产规格:4 核 8G,开启网页浏览、多工具调用必须 4 核 8G 以上,避免容器 OOM 退出。
- Lighthouse 防火墙(仅管控入站流量,出站默认全部放行,无需额外配置出站规则)
- SSH(22):不要0.0.0/0 开放,限制办公源 IP 访问。
- Hermes WebUI 端口:8648,仅在调试阶段临时放行;上线建议增加密码鉴权或者通过反向代理限制访问来源。
⚠️安全警告:直接把 8648 端口对 0.0.0.0/0 放行,任何人访问公网 IP:8648 即可进入 Agent 后台,窃取 API 密钥造成高额账单。
五、 步骤三:部署 Hermes Agent 环境
SSH 连接轻量实例,安装最新 Docker Engine、Docker Compose。
前往 Hermes Agent 官方 GitHub Release 页面,下载稳定版本,不建议直接拉取开发 main 分支。
准备.env环境配置文件,填入 TokenHub 获取的 API 参数;
安全操作:配置完成执行chmod 600 .env收紧文件权限,防止本地文件泄露密钥风险。
使用dockercompose up d后台启动容器。
执行docker ps确认容器状态为 Up,确认端口映射8648:8648正确。
六、 步骤四:配置接入与连通性验证
- 本地浏览器访问 http://实例公网IP:8648打开 Hermes 管理面板。
- 模型提供商选择【自定义 OpenAI 兼容接口】,填入核验表中的 Endpoint、API Key、模型名称hy3。
- 发送测试对话,正常流式返回 Hy3 回复即为配置成功。
连通异常快速区分:
网页打不开:服务器防火墙、docker 端口映射问题;
网页打开,对话一直报错:优先核对 Endpoint 后缀、model 参数、确认 TokenHub 已经开通 Hy3 模型权限。
七、 常见问题排查 (FAQ)
Q1:腾讯云国际版轻量服务器适合哪些业务场景,选型时应关注什么?
答:取决于业务类型、用户地区、性能要求及预算。应先明确用户分布以确定延迟要求,再根据应用类型(网站、API 或 AI 处理)评估并发量。Agent 类业务如果开启网页浏览工具内存消耗较高,建议先用小规模实例验证,再根据监控结果决定是否扩容。
Q2:腾讯云国际版轻量服务器配置怎么选,CPU、内存、存储和带宽如何估算? 答:应按真实负载估算。步骤包括:收集资源峰值、区分稳态与短时负载、预留增长空间。Hermes Agent 开启 Playwright 网页抓取能力,内存消耗会明显上涨,缺少历史数据优先 4 核 8G 起步做压测,避免一次性超配导致成本浪费。
Q3:腾讯云国际 TokenHub 如何获取混元 Hy3 的 API Key?
答:登录腾讯云国际版控制台,进入 TokenHub 平台。进入 API 密钥管理菜单生成密钥,生成密钥后务必手动开启 Hy3 模型调用权限;菜单路径请以当期控制台实际显示为准。
Q4:Lighthouse 部署 Hermes,无法访问 Web 界面怎么排查?
答:1、执行docker ps确认容器为 UP,端口映射8648:8648;2、检查轻量防火墙入站是否放行 8648;3、检查实例内部 ufw 系统防火墙;4、确认浏览器没有代理拦截。
Q5:Web 面板可以打开,但是发送对话持续报错?
答:1、核对 Endpoint 必须带上末尾/v1;2、确认 model 参数填写hy3;3、确认 TokenHub 后台该 API Key 已经开启 Hy3 模型权限;4、实例网络出口是否可以正常访问 TokenHub 国际域名,可在服务器 curl 测试接口连通性。
Q6:Hermes 后台直接对公网开放有什么风险?密钥泄露如何应急?
答:原生 Web 面板无登录密码,公网开放会导致第三方获取 API Key,产生非预期 Token 调用扣费。一旦怀疑密钥泄露,立刻到 TokenHub 控制台禁用旧 APIKey,重新生成新密钥。
