
如何在内网部署 Open WebUI私有 AI 聊天平台完整指南【免费下载链接】open-webuiUser-friendly AI Interface (Supports Ollama, OpenAI API, ...)项目地址: https://gitcode.com/GitHub_Trending/op/open-webuiOpen WebUI 是一个可以完全离线运行的自托管 AI 聊天平台为 Ollama 本地模型和 OpenAI 兼容 API 提供统一的 Web 界面解决两个核心问题数据不出内网、按量付费的 API 调用费。这篇文章按你实际会问的四个问题来组织一条命令能不能跑起来、数据是否真的不出机器、Ollama 地址怎么填、多人使用权限怎么管最后说清它的局限。 一条命令能跑起来吗Docker 装好的话可以。一条docker run就是最小部署docker run -d -p 3000:8080 \ --add-hosthost.docker.internal:host-gateway \ -v open-webui:/app/backend/data \ --name open-webui --restart always \ ghcr.io/open-webui/open-webui:main第一行把宿主机 3000 端口映射进容器-v把聊天记录和上传文件持久化到 volume容器删了数据还在--restart always让容器挂掉后自动拉起。浏览器打开 http://localhost:3000 就能用。不想用 Docker 也可以pip install open-webui直接跑要求 Python 3.11。用 docker-compose 拉起两个容器更常见的组合是 Ollama 和 Open WebUI 一起管仓库里自带写好的 docker-compose.yamlgit clone https://gitcode.com/GitHub_Trending/op/open-webui cd open-webui docker compose up -dOllama 容器负责推理Open WebUI 容器负责界面volume 和 3000 端口都已配好。首次打开页面会让你创建管理员账号模型列表里会出现你已在 Ollama 拉好的模型。数据真的全程留在内网吗只要你只连本地模型就是。默认情况下 Open WebUI 不会把对话或文件发到任何外部服务聊天、文档解析、RAG 检索全部在本机完成内置 RAG 支持 ChromaDB 等 9 种向量数据库上传的文档向量化后也存在本地。和云端 API 对比差别在两笔账云端方案每次提问都把 prompt 发给第三方服务器按 token 计费团队长期使用成本不可控本地方案推理零调用费断网照常使用。前提是模型本身要先由别人拉取Ollama 的pull这一步需要一次联网或离线分发模型文件。另外注意如果你额外接了 LM Studio、vLLM 这类 OpenAI 兼容接口数据会流向这些服务它们部署在内网数据同样不出内网。Ollama 地址怎么填只有一个环境变量OLLAMA_BASE_URL常见三种情况。Ollama 与容器同机单命令里的--add-host已经处理了容器会通过 host.docker.internal 自动发现不用额外配置。Ollama 在别的服务器加一行-e OLLAMA_BASE_URLhttp://192.168.1.10:11434。同在 Compose 网络直接写服务名http://ollama:11434仓库的 compose 文件就是这么写的。连不上时通常是两个原因Ollama 默认只监听 127.0.0.1需要设OLLAMA_HOST0.0.0.0再重启或者 11434 端口被防火墙拦了。想深入看接口怎么调的去 backend/open_webui/routers/ 找 ollama 相关路由即可。多人使用权限怎么管首个注册的账号就是管理员。管理后台里可以建用户组按组分配权限这个组能看到哪些模型、能访问哪些知识库、能不能上传文件逐项勾选成员体验随组自动隔离。企业场景另有 LDAP/AD、OAuth 2.0 两条认证路径全部通过环境变量配置如WEBUI_AUTH、LDAP_BASE_DN不改代码。权限校验逻辑在 backend/open_webui/utils/access_control/要审安全策略可以看这里。它有哪些局限先说两个现实约束推理硬件是瓶颈。Open WebUI 本身占用不大1~2GB 内存足够但模型体验完全取决于 Ollama 那端的硬件小模型 CPU 能跑大模型基本必须上 GPU。默认 SQLite并发有限。几十人以内够用生产环境并发高要换 PostgreSQL。进阶项压缩成下表记住场景和关键变量就够需求什么时候需要关键配置GPU 加速有 N 卡想加速推理:cuda镜像 --gpus all换数据库多人高并发DATABASE_URLpostgresql://user:passhost:5432/openwebui企业认证LDAP/AD、OAuth 接入WEBUI_AUTH、LDAP_BASE_DN等多节点高可用要求不宕机REDIS_URL 反向代理适合你的情况有本地硬件、有数据隐私要求、想基于自己的文档搭问答入口。不适合你的情况不想维护任何东西——这是自托管系统选模型、调参数、升级都归你或者你根本没有推理硬件却期望开箱即用。想再往下走一步克隆仓库后读 backend/open_webui/config.py本文提到的环境变量几乎都定义在那里按注释逐个对照一遍你对整个配置面就有数了。【免费下载链接】open-webuiUser-friendly AI Interface (Supports Ollama, OpenAI API, ...)项目地址: https://gitcode.com/GitHub_Trending/op/open-webui创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考