发布时间:2026/8/27 8:16:44
从零搭建 Multica + Hermes 自托管环境:先装 Hermes,其他的交给它 你可曾思考过, 将那些具备强大能力的, 人工智能智能体系统, 彻彻底底放入自家的服务器之中?无需担忧数据会出现外泄情况, 不必被那种局限于云厂商所设定的 API 的配额所箍束, 能够随心所欲地增添任何技能——这并非那种饱含想象色彩的科幻情境, 而实实在在就是我于最近这两周在 26.04 之上凭借自身努力成功运行起来的、加上自托管全栈环境所达成的状况。不像网上那些教程, 那些教程是先进行安装, 接着安装Nginx, 随后修改配置文件, 之后还要不断折腾, 而我的做法是, 先去安装, 把剩余下来的繁杂又辛苦的活计, 全都交给AI去做。今儿这篇文章, 不搞故弄玄虚那一套, 直接将我的实际操作步骤, 所碰到的网络方面的阻碍, 怎样去配置 API Key, 以及怎样让其自动给我安装 /Nginx/ CLI 毫无保留地讲出来。要是你也正在钻研“自建 AI 智能体平台”, 然而又担忧运维太过繁杂, 那这篇文章能助力你至少避开十个坑。一、为什么要自托管先说动机起初的时候, 我同样运用了官方云.ai, 它所带来的体验是相当不错的, 然而, 始终存在着三个痛点, 分别是:数据并非处于自身掌控之中, 工作区、Issue、Agent的配置均存于他人的数据库里, 迁移的成本极为高昂, 网络延迟是一目了然的一种状况, 从国内去访问海外服务器, 打开看板需要耗费2至3秒的时间, 偶尔还会出现断连的情况, 定制能力受到了限制, 想要添加个自定义的设置, 想要挂载个本地模型, 想要将技能库同步到自己的服务器, 云端对此全然不予以支持。既然手头有闲置的 主机那就干脆全搬回家。原本我手动搭建环境的核心思路发生了改变, 现在不是这样, 而是要先完成一定工序, 之后借助特定某种力量来辅助我使环境自行搭建完成。二、系统环境与版本锁定组件版本/说明操作系统26.04 LTS (Noble )27.x (由 自动安装)v2.29 (由 自动安装)v0.4.18 (由 自动部署)Agent最新 main 分支官方一键安装脚本Nginx1.26 (由 自动安装并配置)/:pg17 ( 容器由 编排)关键提示: 26.04 的默认情况是 3.12, 安装脚本会自动借助 uv 创建虚拟环境, 千万不要使用系统 pip 进行安装, 不然会对系统造成污染, 并且会报出 PEP 668 错误。三、按实际操作顺序排列而成的核心部署步骤, 其中小白能够直接照抄、照搬的部分, 处于步骤 1 阶段, 于此阶段要先去安装 Agent, 而在这一步骤当中是最容易出现卡住网络这种现象的。# 官方一键装法会自动装 uv、Python、虚拟环境、launcher curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash️ 我遇到的大坑国内网络环境下安装脚本会卡在解决方案换国内源# 1. 给 uv 换源设置环境变量安装脚本会读取 export UV_INDEX_URLhttps://pypi.tuna.tsinghua.edu.cn/simple export UV_PYTHON_INSTALL_MIRRORhttps://mirrors.tuna.tsinghua.edu.cn/python # 2. 如果用的是 pip 直接装也要换源 pip config set global.index-url https://pypi.tuna.tsinghua.edu.cn/simple # 3. 再跑安装脚本 curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash小窍门: 要是安装中途断掉了, 别怕, 重新运行脚本就行, 它会查验已安装的那部分并跳过去。安装完成后验证一下# 重新加载 shell 配置或重开终端 source ~/.bashrc # 健康检查 hermes doctor看到绿色的 OK、 OK、 等通过项说明 装好了。步骤 2配置 让 有“大脑”可用它在被装好之后, 仍然不清楚该去使用哪一个占据较大规模的模型。你必须动手去进行API Key的配置。方法一交互式配置推荐新手hermes setup按提示依次选择方法二直接写配置文件适合懂 YAML 的编辑 ~/./.yaml找到 和 model 字段model: default: deepseek-v4-flash provider: deepseek base_url: https://api.deepseek.com providers: deepseek: name: DeepSeek base_url: https://api.deepseek.com api_mode: chat_completions transport: openai_chat model: deepseek-v4-flash api_key: sk-xxxxxxxxxxxxxxxx # 你的 Key多种Key进行轮换的技巧是, 在其中添加备选内容, 当主Key出现限额情况或者报错的时候, 会自动切换到备选。进行配置完成之后, 再次去运行一回 , 目睹OK转变为绿色 , 这就意味着大模型取得了连通。步骤3: 使, 自动协助你进行安装, Nginx, CLI堪称核心的神奇时机。这便是我之所以这么讲“先进行相关安装操作 , 其余的交付给人工智能来处理”的缘由。它自带有诸如 --on-、- 等方面的技能 , 可以直接针对终端展开操作 , 能够运行相关命令 , 能够对配置文件作出修改 , 还能够启动相应服务。只需给它一个问题, 它便能够帮你把自行托管的环境运行起来。3.1 创建一个“部署自托管”的 Issue# 先启动 Hermes 的 gateway后台常驻提供 API hermes gateway start # 在另一个终端用 multica CLI 创建 Issue如果还没装 multica CLIHermes 也能帮你装 # 这里演示直接用 Hermes 的原生能力 hermes chat -q 帮我在 Ubuntu 26.04 上部署 Multica 自托管环境要求 1. 自动安装 Docker、Docker Compose、Nginx 2. 克隆 Multica 仓库到 /opt/multica 3. 生成 .env 配置JWT_SECRET、POSTGRES_PASSWORD 等随机生成 4. 配置 Nginx 统一入口监听 3000 端口反代 backend 18080 和 frontend 13000 5. 用 docker compose 启动 postgres、backend、frontend 三个容器 6. 配置 UFW 放行 3000 端口 7. 最后验证 http://服务器IP:3000 能打开登录页 请直接操作终端完成遇到权限不足用 sudo网络慢自动换国内镜像源。 3.2 会自动帮你做这些事你只需要看着它跑它会依次执行当执行apt , 而且执行apt -y .io朝着nginx运作此为自动切换阿里云或者清华源的操作之时, 以-aG $USER方式进行, 并且会提示你重登, 或者借由-p /opt/开展后续操作, 接着进入到/opt/目录, 运用git clone --depth 1 .在较慢的时候会自动外挂代理抑或是采用其他可行方式还需生成随机密钥, 写入到.env文件里, 再写入到/etc/nginx/sites-内进行配置, 并且启用 -f -..yml up -d当镜像拉取较慢时会自动选用镜像站展开操作, 并tag回原来的名称之后执行ufw allow 3000/tcp , 以及ufw :3000 , 当验证返回200时正确结束操作。3.3 如果中途卡住你可以随时插话hermes chat -q docker pull ghcr.io/multica-ai/multica-backend 卡住了帮我换成 ghcr.nju.edu.cn 镜像站拉取并 tag 回原名会立刻接管终端执行修正命令。步骤 4首次登录并切换 到自托管容器跑起来后打开浏览器访问 http://:3000。无 SMTP 时怎么收验证码sudo docker logs multica-backend-1 | grep Verification code # 输出示例Verification code for youremail.com: 123456填邮箱、填验证码、登录。首个账号自动成为超管。关键一步把 切到自托管# 1. 停用旧的 cloud daemon如有 systemctl --user stop multica-daemon # 2. 备份云端配置 cp ~/.multica/config.json ~/.multica/config.json.cloud-backup # 3. 交互式设置自托管会卡在 [y/N]用 echo y 管道过掉 echo y | multica setup self-host \ --server-url http://127.0.0.1:3000 \ --app-url http://你的服务器IP:3000 \ --callback-host 你的服务器IP # 4. ️ 这一步最关键设置完成后终端会打印一个登录 URL # 你必须打开 URL → 登录授权 → 看到成功提示 → 立即停掉裸 daemon multica daemon stop # 5. 交回 systemd 托管 systemctl --user start multica-daemon systemctl --user enable multica-daemon为何要这般麻烦呢, setup self-host开启的是一个临时性全裸状态不在管控范围之内, 仅仅是为了去达成OAuth授权, 授权达成之后, 一定要手动将其关掉、启用服务, 不然重启服务器之后就会出现故障, Issue会停滞在todo状态。步骤 5注册 创建 Agent让 真正干活自托管实例初始是空的没有 Agent必须手建。# 1) 创建 Runtime Profile multica runtime profile create \ --display-name 内容创作者 \ --command-name content-acp \ --protocol-family hermes \ --output json # 记下输出的 profile.id假设为 aaa-bbb-ccc # 2) 创建 Agent 绑定该 Profile # 注意runtime-id 是 Hermes runtime 的 ID用 multica runtime list 查看 multica agent create \ --name 内容创作者 \ --runtime-id \ --runtime-config {profileId:aaa-bbb-ccc} # 3) 端到端验证建个测试 Issue 指派给该 Agent multica issue create --title 自托管链路测试 --assignee-id --status todo # 等 30 秒看状态是否流转 todo → in_review → done且有评论产出四、踩过的 5 个大坑及解决方案按遇到顺序现象根因解决方案curl .sh 卡在下载 uv、 3.11半小时没动静国内直连 、 极慢/超时安装前 和 RROR报 NOT OK / 连不上模型API Key 没填、或 Key 无效、或 错交互式配置进行设置, 或者将其直接更改到, 位于用户主目录下的, 那个名为 dot yaml 的文件中, 填对其中的密钥。让装 时 apt .io 报 404 / 慢默认源可能旧、或国外源慢能自动开展检测, 并且去更换阿里云或者清华源, 手动操作时可以运用sed -i 。s///g /etc/apt/.listpull ghcr.io/... 挂起 10 分钟国内直连 GHCR 极慢会自动改用 镜像站拉取后 tag 改回原名登录验证码输完页面卡死“无法访问此页面”UFW 默认拦截 OAuth 回调端口随机 4 位数向/tcp允许sudo ufw, 完成登录予以刷新向/tcp允许登录, 向/tcp允许sudo ufw。五、现在的运行状态实测数据指标数值备注Web 打开看板首屏~120 ms局域网同源入口无跨域、无 WS 握手失败Issue 指派 → Agent 接单 → 产出评论25-40 秒含 冷启动、技能加载、模型推理技能加载数28 个包含 --on-、-、skill、 等自定义1 个连接着内网的 GPU 服务器, 运行 -3-Ultra 时, 无法推断出局域网的情况。内存占用关于后端的部分是1.2G, 前端有300M, 还有800M, 宿主机大概是2G。8C16G 服务器跑得很舒服稳定性连续运行 30 天 0 重启托管 容器 -六、给那些想要进行自托管的同学提出三条建议, 首先要进行安装, 然后其余的都交给它, 千万别自己去手写, 也别去修改 Nginx 配置, 更别折腾。安装妥当、配置好 API Key 后, 直接告知它“帮我部署自托管”, 它比你速度快, 比你细致, 而且还不会因为手抖而输错命令。网络问题通通依赖换源, 比如 uv 换源、pip 换源、apt 换源、更换镜像站、GHCR 换镜像站、克隆时挂上代理。把这些环境变量添加到~/. 里, 一次配置就能终身受益。参与备份的项里有.env, 还有~/./.json, 这可是迁移以及灾备的那把独一无二的钥匙啊。我借助rsync, 每天都使其同步到位于异地的NAS, 倘若服务器出现故障, 新机器安装完毕, 恢复这两个文件, 再运行一次start, 不出十分钟就能在原地实现复活。七、结语。往自家 服务器里装入 , 仿若给自己打造了一座专属的 AI 智能体发电厂, 数据是你的、算力是你的、技能树是你的、接入渠道同样是你的。把全套部署弄好大概耗费了我 4 个小时, 这里面包含踩坑, 看自动跑命令, 还有喝杯咖啡这些情况, 如今已经稳定运行一个月了, 完全告别了云端排队, 告别了数据焦虑, 告别了定制受限, 也告别了运维头大。要是你同样存有闲置服务器, 并且也期望拥有一组“听话、懂业务、可进化”的AI团队, 那就别迟疑, 先进行安装, 其余的都交给它——此文章涵盖的命令、换源技巧以及避坑指南, 能够让你少走不少弯路了。

相关新闻

2026/8/27 8:16:44

5分钟跑通 gpu-burn:多GPU压力测试与稳定性验证

5分钟跑通 gpu-burn:多GPU压力测试与稳定性验证 【免费下载链接】gpu-burn Multi-GPU CUDA stress test 项目地址: https://gitcode.com/gh_mirrors/gp/gpu-burn gpu-burn 是一款基于 CUDA 的多 GPU 压力测试工具。它会在机器上的所有 NVIDIA GPU 上并行跑计…

2026/8/27 8:16:43

基于LSTM的网络异常流量预测实战:时间序列建模与异常检测

之前在项目里做网络流量监控时,流量数据波动大、攻击特征隐蔽,一套固定阈值规则根本扛不住业务的动态变化,误报和漏报交替出现。后来把方向转向 LSTM 这类循环神经网络,利用它对时间序列的建模能力来做流量预测,再基于…

2026/8/27 8:11:42

现代前端框架实战(4):状态管理方案选型

上一篇让项目与筛选进入 URL,本篇继续整理任务看板的状态边界。重点不是比较库的热度,而是先给状态分类,再用所有权、更新频率、持久化与一致性要求选择局部 state、URL、Context、外部 store 或请求缓存。 一、痛点:全局状态常是…

2026/8/27 9:56:58

大模型API峰谷定价应对:多模型网关接入与成本护栏实践

大模型API峰谷定价应对:多模型网关接入与成本护栏实践 问题背景 2026 年 8 月 17 日 0 点起,DeepSeek 对 V4 系列(V4 Pro 0813、V4 Flash 0731)启用峰谷分时计费。每天 9:00–12:00、14:00–18:00 为高峰,其余为闲时&a…

2026/8/27 9:56:58

SQL Server 数据库操作复习总结_1

SQL Server 数据库操作复习总结(基于 esa 数据库练习)本总结涵盖:表结构的创建(DDL)、数据的插入与修改(DML)、备份表、查看表结构等核心知识点。一、 数据库定义语言(DDL&#xff0…

2026/8/27 9:56:58

【量化投资从入门到精通 #30】止损与仓位:量化怎么管住手

这篇实测了一个反直觉的结论:你以为最有用的固定止损,很多时候完全没起作用。一、这个方法解决什么投资问题 "设个 5% 止损"几乎是所有交易入门读物的标配建议。但很少有人回答两个问题: 这个止损真的被触发过吗?触发之…

2026/8/27 9:56:58

1.9W预算AMD 9800X3D加RTX 5070 Ti游戏主机配置与装机指南

预算在一万九(也就是 1.9W)这个量级上,想组一台以 AMD 9800X3D 加 RTX 5070 Ti 为核心的游戏主机,到底怎么分配配件才算不浪费?这是很多玩家在装机前最纠结的问题。只看单品测评,容易觉得把这两样高价硬件塞…

2026/8/27 9:56:58

工控CTF核心三协议:Modbus、MMS与IEC60870-5-104实战解析

1. 工控CTF到底在考什么:不是写代码,是在拆解工业现场的“真实心跳” 工控CTF——这三个字一出来,很多人第一反应是“这不就是普通CTF加了个前缀?”但真进过电厂、水厂、化工厂调试现场的人会立刻摇头。我干了十年工控安全&#x…

2026/8/27 9:51:57

华为小鸿AI 开箱与初识:一台“会说话“的全开源端侧硬件

华为小鸿AI 开箱与初识:一台"会说话"的全开源端侧硬件系列博客第 1 篇 关键词:小鸿AI / OpenHarmony / RISC-V / 星闪 / 端侧AI 本文从产品定位、技术底座到开箱体验,带你认识这台小而硬核的开源鸿蒙 AI 小方块。如果你和我一样&a…

2026/8/26 9:13:28

[光学原理与应用-521]:对光的错误理解与纠偏

首先光是一种能量的载体和形态,宏观上观察到的光是由无数个微观的光量子组成的,每个光子在产生的瞬间,其在真空的空间中以确定不变的速度沿着一个初始的方向一直向前,在微观层面,每个光量子的运动轨迹是以波函数所展现…

2026/8/25 11:48:27

SIP通话转接原理与REFER方法实战解析

1. 通话转接不是“挂断再拨号”,而是SIP会话的动态重定向你有没有遇到过这样的场景:客服坐席A正在和客户通电话,突然需要把这通对话无缝转给专家坐席B,客户完全感知不到中间的断连——既没听到忙音,也没被要求重新拨号…

2026/8/27 7:46:21

Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

1. 为什么选择Kolla-ansible来部署单节点OpenStack?如果你正在寻找一种能把OpenStack从“概念”快速变成“可用的实验环境”的方法,那么Kolla-ansible几乎是当前最主流、最省心的选择。我见过太多人卡在手动编译依赖、配置服务、处理版本冲突的泥潭里&am…

2026/8/27 0:01:16

Go语言构建企业级AI服务网关:统一管理英伟达等AI接口调用

1. 项目概述:从零构建一个企业级的AI服务网关 最近在帮一个做内容审核的团队做技术架构升级,他们原来的业务里,每天有几十万张图片和短视频需要过审,最初是接了几个开源的AI模型自己部署,但效果和性能一直不太稳定。后…

2026/8/27 0:01:16

LeetCode Hot100(51-60)算法精解与面试技巧

1. 题目背景与核心价值"hot100(51-60)"这个标题看起来像是某个编程题库或算法练习集中的一组题目编号。在技术社区中,类似命名通常指向LeetCode、牛客网等平台的热门题目集合。作为刷过300题的算法老手,我理解这类题目的核心价值在于&#xff…

2026/8/27 0:01:16

CRC校验实战:从模2除法到HJ212协议排错

1. 为什么一个“校验码”能扛住工业现场90%的数据 corruption? 你有没有遇到过这样的场景:嵌入式设备通过RS-485上传温湿度数据,上位机偶尔收到一帧乱码——温度显示成-273℃,湿度跳到999%,但串口波形看起来完全正常&a…

2026/8/26 19:34:06

实测才敢推 AI论文网站 2026最新测评与推荐

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。一、综…

2026/8/26 19:17:08

2026必备!AI论文网站测评:最新推荐与深度对比

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。 一、…

2026/8/26 19:34:05

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

一天写完毕业论文在2026年已不再是天方夜谭。2026年最炸裂、实测能大幅提速的AI论文写作工具,覆盖选题构思、文献整理、内容生成、格式排版等核心场景,真正帮你高效搞定论文难题。 一、全流程王者:一站式搞定论文全链路(一天定稿首…