发布时间:2026/8/28 23:41:09
Open WebUI 部署上手:接入本地模型、OpenAI API 与文档问答 Open WebUI 部署上手接入本地模型、OpenAI API 与文档问答【免费下载链接】open-webuiUser-friendly AI Interface (Supports Ollama, OpenAI API, ...)项目地址: https://gitcode.com/GitHub_Trending/op/open-webuiOpen WebUI 是一个用单个容器就能部署起来的自托管 AI 聊天界面支持接入本地 Ollama 和任意 OpenAI 兼容 API内置文档问答RAG。适合想自己跑一个 AI 聊天页面、不依赖第三方 SaaS 的开发者。环境准备动手前确认这几件事Docker 已安装并能运行Engine 或 Desktop 均可docker run可用要接本地模型的话Ollama 已装好并拉过一个小模型主机 3000 端口空闲会映射到容器内应用端口 8080只用云模型的话准备好对应的OPENAI_API_KEY不用 Docker 也可以pip install open-webui后执行open-webui serve想从源码部署则先git clone https://gitcode.com/GitHub_Trending/op/open-webui本文后续按 Docker 路线走数据卷和升级都更省心跑通最小闭环一条 Docker 命令启动这条命令做三件事拉取官方镜像启动容器把宿主机 3000 端口映射到应用监听的 8080 端口用-v open-webui:/app/backend/data挂载数据目录——账号、聊天记录、配置都存在这里不挂的话升级容器后什么都留不住。docker run -d -p 3000:8080 \ --add-hosthost.docker.internal:host-gateway \ -v open-webui:/app/backend/data \ --name open-webui --restart always \ ghcr.io/open-webui/open-webui:main为什么带--add-host应用默认去主机的 11434 端口找 Ollama不加这一行容器内的 127.0.0.1 指向容器自己后面会一直报 Server Connection Error。成功的标志浏览器打开http://localhost:3000出现注册页面注册第一个账号自动成为管理员后进入聊天页左上角能看到模型选择器。模型列表暂时是空的也没关系说明界面本身已经跑通。按用途展开三个最常用的场景接入自己的模型指向任意 OpenAI 兼容 API解决没有本地 GPU但想直接用云模型的情况。它不只认 OpenAI 官方LMStudio、vLLM、Groq 等任何暴露 OpenAI 兼容接口的服务都能接改个地址就行docker run -d -p 3000:8080 \ -e OPENAI_API_BASE_URLhttps://api.openai.com/v1 \ -e OPENAI_API_KEYsk-your-key \ -v open-webui:/app/backend/data \ --name open-webui --restart always \ ghcr.io/open-webui/open-webui:main这两个-e参数在backend/open_webui/config.py里定义支持分号分隔传多个地址同时接多个服务。成功的标志容器启动后左上角模型列表里出现你的模型名选中即可对话。接入本地 Ollama 离线聊天适合数据不能出内网、或不想按 token 付费的场景。Ollama 在同一台机器上时第一条命令里的--add-host已经解决了可达性你拉取的模型会自动出现在界面里Ollama 在另一台服务器上时在同样的命令里加一行-e OLLAMA_BASE_URLhttp://服务器IP:11434即可。有显卡就把镜像标签换成:cuda或直接用捆绑了 Ollama 的:ollama镜像一条命令全带上。ollama pull llama3.2先拉小模型是因为它只用来验证链路下载快。成功的标志界面模型列表出现 llama3.2发一句你好回复逐字流式输出。让它读你的文档RAG 问答解决想让模型基于我自己的 PDF、手册来回答而不是凭训练知识瞎编的问题。最短路径全在界面里完成知识库页面上传文档建索引 → 聊天时给模型挂上对应的知识库 → 开始提问。首次使用会自动下载向量化用的 embedding 模型并建索引这一步需要联网纯内网环境设置HF_HUB_OFFLINE1并配一个本地 embedding 模型避免反复重试下载卡住。出问题时先看这里按现象找原因页面能打开但提示 Server Connection Error 或模型列表为空——原因容器够不到 Ollama容器内的 127.0.0.1 指向它自己。操作确认命令里带了--add-host或者改用 host 网络模式启动下面的命令访问地址相应变成http://localhost:8080http://localhost:3000完全打不开——原因容器没起来或 3000 端口被占用。操作docker ps看容器状态把-p 3000:8080里的 3000 换掉远程服务器还要确认防火墙放行了 3000升级后账号、聊天记录没了——原因数据目录没挂载。操作带-v open-webui:/app/backend/data重建容器默认 SQLite 数据库和上传文件都在这个目录里首次用 RAG 很慢或像卡死——原因在下载 embedding 模型和建向量索引。操作等首轮完成看docker logs open-webui纯离线环境设HF_HUB_OFFLINE1改 host 网络模式的命令docker run -d --networkhost \ -e OLLAMA_BASE_URLhttp://127.0.0.1:11434 \ -v open-webui:/app/backend/data \ --name open-webui --restart always \ ghcr.io/open-webui/open-webui:main接下来可以做的事在管理后台启用 RBAC建分组给每个成员只开放对应模型和知识库的权限写自定义 Action / Filter 拦截改写请求或接入 MCP 工具服务器让模型调用你的外部服务上生产环境换 PostgreSQL 替换默认 SQLite加 Redis 支撑多副本水平扩展【免费下载链接】open-webuiUser-friendly AI Interface (Supports Ollama, OpenAI API, ...)项目地址: https://gitcode.com/GitHub_Trending/op/open-webui创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关新闻

2026/8/28 23:41:09

反事实社会演化推演:AI评测从预测到因果重构的关键跨越

“如果当时没有实施那项调整,现在的结果会怎样?”这类问题,在真实决策里出现的频率,远比“下一步会发生什么”更高。但有意思的是,过去几年大模型能力的评价重心,几乎都放在预测和生成上,很少认…

2026/8/29 0:36:36

Claude Code v2.1.246更新:Bash权限、全屏与会话修复指南

Claude Code 是 Anthropic 出品的终端 AI 编程助手,运行在命令行环境里,能够读取项目代码、分析报错、修改文件,并且直接执行 shell 命令。正因为它的执行权限足够强,Bash 命令的授权策略、终端渲染状态和会话恢复机制&#xff0c…

2026/8/29 0:36:36

3.2 C++实战100例——函数参数求值顺序:C++17 前未指定

3.2 C++实战100例——函数参数求值顺序:C++17 前未指定 一句话方向 —— 用汇编对照 C++14 与 C++17 标准差异,证明同一表达式在不同标准下的实际参数入栈顺序变化,并给出 -Wsequence-point 无法覆盖时的 Clang 诊断命令 总纲和5篇免费文章分流 C++ 踩坑排雷手册 总纲目…

2026/8/29 0:31:36

2026年英语听说AI软件怎么选?避开这3个坑

【引言】现在市面上的英语听说AI工具不少,但真拿去给学生用,问题就冒出来了:评分不准、反馈太虚、数据安全没保障。这篇文章会用三年多的落地经验,把选型时最容易踩的3个坑拆开讲清楚,再聊聊一个相对靠谱的技术判断思路…

2026/8/29 0:31:36

2026年自习室合作避坑:这4种资质你必须搞清

摘要自习室行业从“一张桌子租一天”进化到“AI督学精准诊断”的智能时代,但很多合作方在软硬件上吹得天花乱坠,资质却经不起推敲。这篇文章从我们团队这几年的实战踩坑经历出发,拆解你在选择技术服务商时最该盯死的4类硬资质:ICP…

2026/8/29 0:31:36

三款AI写作辅助平台横评:从选题到降AI怎么选才不踩坑?

写论文这事,最怕的不是写不出来,而是写得心里没底。 选题改了七八版还怕选重了,文献下载了两百篇越读越乱,参考文献格式调到崩溃,交稿前还得担心重复率和AIGC检测。今年开学季一到,又有一波人在搜“AI论文工…

2026/8/29 0:31:36

干货合集:盘点2026年顶流之选的的AI论文写作工具

一天写完毕业论文在2026年已不再是天方夜谭。2026年最炸裂、实测能大幅提速的AI论文写作工具,覆盖选题构思、文献整理、内容生成、降重润色等核心场景,助你高效搞定论文。 一、全流程王者:一站式搞定论文全链路(一天定稿首选&…

2026/8/28 16:16:17

[光学原理与应用-521]:对光的错误理解与纠偏

首先光是一种能量的载体和形态,宏观上观察到的光是由无数个微观的光量子组成的,每个光子在产生的瞬间,其在真空的空间中以确定不变的速度沿着一个初始的方向一直向前,在微观层面,每个光量子的运动轨迹是以波函数所展现…

2026/8/28 16:16:21

SIP通话转接原理与REFER方法实战解析

1. 通话转接不是“挂断再拨号”,而是SIP会话的动态重定向你有没有遇到过这样的场景:客服坐席A正在和客户通电话,突然需要把这通对话无缝转给专家坐席B,客户完全感知不到中间的断连——既没听到忙音,也没被要求重新拨号…

2026/8/28 16:16:22

Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

1. 为什么选择Kolla-ansible来部署单节点OpenStack?如果你正在寻找一种能把OpenStack从“概念”快速变成“可用的实验环境”的方法,那么Kolla-ansible几乎是当前最主流、最省心的选择。我见过太多人卡在手动编译依赖、配置服务、处理版本冲突的泥潭里&am…

2026/8/29 0:01:10

etc目录下的profile.d文件目录设置环境变量和全局脚本shell

一、设置环境变量etc目录下的profile.d文件目录 /etc/profile.d1、编写 vi test.sh文件内容# jdk变量 export ZHK_HOME/root export PATH$PATH:$ZHK_HOME/test # 可以取出来ZHK_HOME变量给ZZZ_HOME赋值 export ZZZ_HOME${ZHK_HOME}/test2、刷新 执行source /etc/profile 命令使…

2026/8/29 0:01:10

【JavaScript】内存管理-垃圾回收机制-内存泄露

内存管理 C 语言这样的底层语言一般都有底层的内存管理接口,比如 malloc()和free()。 而 JavaScript 是在创建变量(对象,字符串等)时自动进行了分配内存,并且在不使用它们时“自动”释放。释放的过程称为垃圾回收。 整…

2026/8/29 0:01:10

Labgrid-MCP:为嵌入式硬件实验室接入AI Agent操控能力

Labgrid-MCP 的目标是把 MCP(Model Context Protocol)能力延伸到真实嵌入式硬件实验室:AI Agent 通过一个标准化的 MCP Server,就能查看目标板状态、控制上电断电、复位开发板、读取串口日志,甚至执行镜像刷写。对于经…

2026/8/28 16:16:48

实测才敢推 AI论文网站 2026最新测评与推荐

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。一、综…

2026/8/28 16:16:50

2026必备!AI论文网站测评:最新推荐与深度对比

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。 一、…

2026/8/28 11:06:45

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

一天写完毕业论文在2026年已不再是天方夜谭。2026年最炸裂、实测能大幅提速的AI论文写作工具,覆盖选题构思、文献整理、内容生成、格式排版等核心场景,真正帮你高效搞定论文难题。 一、全流程王者:一站式搞定论文全链路(一天定稿首…