发布时间:2026/8/28 23:41:09
Open WebUI 离线部署完整指南:无网络环境如何跑起本地 AI 界面 Open WebUI 离线部署完整指南无网络环境如何跑起本地 AI 界面【免费下载链接】open-webuiUser-friendly AI Interface (Supports Ollama, OpenAI API, ...)项目地址: https://gitcode.com/GitHub_Trending/op/open-webuiOpen WebUI 是一个自托管的 AI 网页界面用来连接 Ollama 本地模型或任意 OpenAI 兼容 API做对话、文档知识库问答和管理。它适合两类人一是所处环境完全或经常断网内网隔离机房、野外作业站点需要在断网后继续用 AI 助手的用户二是希望对话记录、上传文档和模型权重全部留在自己机器上的用户。离线部署的完整流程就五步在联网机器备好镜像和模型 → 拷贝到隔离机器 → 导入镜像 → 打开OFFLINE_MODE开关 → 启动验证。断网前该备好的三样东西全部在还能上网的机器上做。先备料再断网比装到一半才发现缺包省心。第一样两个 Docker 镜像。项目随仓库提供的docker-compose.yaml里定义了ollama和open-webui两个服务先把镜像拉下来再导出成 tar 包docker pull ghcr.io/open-webui/open-webui:main docker pull ollama/ollama:latest docker save ghcr.io/open-webui/open-webui:main ollama/ollama:latest \ -o open-webui-offline-images.tar第二样要跑的模型文件。以 Ollama 的 llama3:8b 为例拉取后导出。8B 级别的模型在 16GB 内存的普通 x86 机器上就能跑更大或多模态模型建议配一张显存充足的 GPUollama pull llama3:8b ollama save llama3:8b -f llama3-8b.tar第三样RAG 用的嵌入模型。Open WebUI 的文档知识库依赖sentence-transformers/all-MiniLM-L6-v2这个嵌入模型默认配置写在backend/open_webui/config.py里可用环境变量RAG_EMBEDDING_MODEL覆盖。从 Hugging Face 或国内镜像源把它连同依赖一起下载到本地目录备用后面会讲怎么指给容器。把物料搬到隔离机器并导入用 U 盘或内部文件服务把镜像包、模型包和代码拷过去先拿代码git clone https://gitcode.com/GitHub_Trending/op/open-webui cd open-webui然后分别导入镜像和模型docker load -i open-webui-offline-images.tar ollama load llama3-8b.tar导入完用docker images和ollama list各看一眼两个镜像、一个模型都在就可以继续。打开离线开关再启动关键只有一行OFFLINE_MODEtrue。这个开关在backend/open_webui/env.py里做了两件事——把HF_HUB_OFFLINE置为 1让所有 Hugging Face 相关组件只读本地缓存、不再尝试连外网同时关闭版本更新检查。这是官方内置的离线支持不需要改任何代码。在仓库目录建一个.env把端口和离线开关写进去OPEN_WEBUI_PORT3000 OLLAMA_DOCKER_TAGlatest WEBUI_DOCKER_TAGmain OFFLINE_MODEtrue如果嵌入模型放在自定义目录而不是 HF 默认缓存路径在同一个文件里追加RAG_EMBEDDING_MODEL你的本地模型路径指向它。然后启动docker compose up -dcompose 文件里 open-webui 通过http://ollama:11434访问 ollama两者必须在同一个 compose 项目里启动别拆开单独docker run。启动后怎么验证先看健康接口curl http://localhost:3000/health返回{status: true}说明后端进程正常。接着打开 3000 端口的页面完成首次登录模型列表里选 llama3:8b 发一句话能出回复就说明离线对话链路通了如果要用知识库再传一个 PDF 提问确认嵌入模型加载成功、能引用文档内容。离线场景常见坑⚠️ 新手最常卡在这几处页面能打开但模型列表是空的多半是两个容器没在同一个 compose 网络里open-webui 找不到 ollama。检查docker compose ps里两个服务是否都是 Up。嵌入模型加载报连接超时说明它还在尝试访问 Hugging Face。确认OFFLINE_MODE真的传进了容器docker inspect open-webui | grep OFFLINE_MODE并确认模型文件已在本地缓存或路径已指对。首次启动后第一次提问很慢嵌入模型是首次使用时才加载等一两分钟再下结论别急着重启。升级版本离线升级和首次部署一样联网侧下载新版镜像导出 → 拷入 →docker compose pull跳过、改用本地镜像docker compose up -d --force-recreate数据卷不动聊天记录和知识库不会丢。日常备份也很简单所有对话、上传文件和数据库都落在open-webui卷挂载的/app/backend/data目录里定期把这个目录拷出去即可。更多问题排查可以直接翻仓库里的TROUBLESHOOTING.md配置开关的权威说明在backend/open_webui/env.py需要哪一项就查哪一项。【免费下载链接】open-webuiUser-friendly AI Interface (Supports Ollama, OpenAI API, ...)项目地址: https://gitcode.com/GitHub_Trending/op/open-webui创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关新闻

2026/8/28 23:41:09

反事实社会演化推演:AI评测从预测到因果重构的关键跨越

“如果当时没有实施那项调整,现在的结果会怎样?”这类问题,在真实决策里出现的频率,远比“下一步会发生什么”更高。但有意思的是,过去几年大模型能力的评价重心,几乎都放在预测和生成上,很少认…

2026/8/28 23:36:09

AutoDis:深度学习连续特征处理的自动化与优化方案

1. 从“硬分桶”到“软学习”:为什么我们需要AutoDis?在推荐、广告、搜索这些以深度学习模型为核心的场景里,特征工程是决定模型效果上限的基石。其中,连续特征(Continuous Features)的处理,一直…

2026/8/29 0:36:36

Claude Code v2.1.246更新:Bash权限、全屏与会话修复指南

Claude Code 是 Anthropic 出品的终端 AI 编程助手,运行在命令行环境里,能够读取项目代码、分析报错、修改文件,并且直接执行 shell 命令。正因为它的执行权限足够强,Bash 命令的授权策略、终端渲染状态和会话恢复机制&#xff0c…

2026/8/29 0:36:36

3.2 C++实战100例——函数参数求值顺序:C++17 前未指定

3.2 C++实战100例——函数参数求值顺序:C++17 前未指定 一句话方向 —— 用汇编对照 C++14 与 C++17 标准差异,证明同一表达式在不同标准下的实际参数入栈顺序变化,并给出 -Wsequence-point 无法覆盖时的 Clang 诊断命令 总纲和5篇免费文章分流 C++ 踩坑排雷手册 总纲目…

2026/8/29 0:31:36

2026年英语听说AI软件怎么选?避开这3个坑

【引言】现在市面上的英语听说AI工具不少,但真拿去给学生用,问题就冒出来了:评分不准、反馈太虚、数据安全没保障。这篇文章会用三年多的落地经验,把选型时最容易踩的3个坑拆开讲清楚,再聊聊一个相对靠谱的技术判断思路…

2026/8/29 0:31:36

2026年自习室合作避坑:这4种资质你必须搞清

摘要自习室行业从“一张桌子租一天”进化到“AI督学精准诊断”的智能时代,但很多合作方在软硬件上吹得天花乱坠,资质却经不起推敲。这篇文章从我们团队这几年的实战踩坑经历出发,拆解你在选择技术服务商时最该盯死的4类硬资质:ICP…

2026/8/29 0:31:36

三款AI写作辅助平台横评:从选题到降AI怎么选才不踩坑?

写论文这事,最怕的不是写不出来,而是写得心里没底。 选题改了七八版还怕选重了,文献下载了两百篇越读越乱,参考文献格式调到崩溃,交稿前还得担心重复率和AIGC检测。今年开学季一到,又有一波人在搜“AI论文工…

2026/8/29 0:31:36

干货合集:盘点2026年顶流之选的的AI论文写作工具

一天写完毕业论文在2026年已不再是天方夜谭。2026年最炸裂、实测能大幅提速的AI论文写作工具,覆盖选题构思、文献整理、内容生成、降重润色等核心场景,助你高效搞定论文。 一、全流程王者:一站式搞定论文全链路(一天定稿首选&…

2026/8/28 16:16:17

[光学原理与应用-521]:对光的错误理解与纠偏

首先光是一种能量的载体和形态,宏观上观察到的光是由无数个微观的光量子组成的,每个光子在产生的瞬间,其在真空的空间中以确定不变的速度沿着一个初始的方向一直向前,在微观层面,每个光量子的运动轨迹是以波函数所展现…

2026/8/28 16:16:21

SIP通话转接原理与REFER方法实战解析

1. 通话转接不是“挂断再拨号”,而是SIP会话的动态重定向你有没有遇到过这样的场景:客服坐席A正在和客户通电话,突然需要把这通对话无缝转给专家坐席B,客户完全感知不到中间的断连——既没听到忙音,也没被要求重新拨号…

2026/8/28 16:16:22

Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

1. 为什么选择Kolla-ansible来部署单节点OpenStack?如果你正在寻找一种能把OpenStack从“概念”快速变成“可用的实验环境”的方法,那么Kolla-ansible几乎是当前最主流、最省心的选择。我见过太多人卡在手动编译依赖、配置服务、处理版本冲突的泥潭里&am…

2026/8/29 0:01:10

etc目录下的profile.d文件目录设置环境变量和全局脚本shell

一、设置环境变量etc目录下的profile.d文件目录 /etc/profile.d1、编写 vi test.sh文件内容# jdk变量 export ZHK_HOME/root export PATH$PATH:$ZHK_HOME/test # 可以取出来ZHK_HOME变量给ZZZ_HOME赋值 export ZZZ_HOME${ZHK_HOME}/test2、刷新 执行source /etc/profile 命令使…

2026/8/29 0:01:10

【JavaScript】内存管理-垃圾回收机制-内存泄露

内存管理 C 语言这样的底层语言一般都有底层的内存管理接口,比如 malloc()和free()。 而 JavaScript 是在创建变量(对象,字符串等)时自动进行了分配内存,并且在不使用它们时“自动”释放。释放的过程称为垃圾回收。 整…

2026/8/29 0:01:10

Labgrid-MCP:为嵌入式硬件实验室接入AI Agent操控能力

Labgrid-MCP 的目标是把 MCP(Model Context Protocol)能力延伸到真实嵌入式硬件实验室:AI Agent 通过一个标准化的 MCP Server,就能查看目标板状态、控制上电断电、复位开发板、读取串口日志,甚至执行镜像刷写。对于经…

2026/8/28 16:16:48

实测才敢推 AI论文网站 2026最新测评与推荐

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。一、综…

2026/8/28 16:16:50

2026必备!AI论文网站测评:最新推荐与深度对比

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。 一、…

2026/8/28 11:06:45

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

一天写完毕业论文在2026年已不再是天方夜谭。2026年最炸裂、实测能大幅提速的AI论文写作工具,覆盖选题构思、文献整理、内容生成、格式排版等核心场景,真正帮你高效搞定论文难题。 一、全流程王者:一站式搞定论文全链路(一天定稿首…