关于 Open WebUI
把任意模型装进一个属于你的界面
Open WebUI 是一个自托管的 AI 平台,定位为「自由的 AI 技术栈」。它提供与 ChatGPT 体验一致的对话界面,但底层模型由你掌控——可连接本地的 Ollama、llama.cpp,也可接入 OpenAI、Anthropic、vLLM 等任意 OpenAI 兼容的云端或自建端点。
平台把对话、知识库、工具与模型统一在一个界面里:上传文档即可构建 RAG 知识库,支持多模型并排对比、文件与图片上传、联网搜索、浏览器内代码执行与语音通话;并通过 Tools、Functions、Pipelines、MCP 与 OpenAPI 进行扩展。
面向团队与企业的能力同样完整:多用户、SSO/OIDC/LDAP、RBAC 权限、审计日志、数据驻留,以及本地/气隙部署,适合对合规与数据主权有要求的组织。
核心功能一览
六大核心能力,覆盖创作全流程
模型无关对话
连接 Ollama、OpenAI、Anthropic 及任意 OpenAI 兼容模型,支持对话中切换模型并保留上下文。
知识库与 RAG
上传 PDF/Word/Markdown 等文档构建知识库,混合检索(BM25 + 向量 + 重排)让 AI 基于你的内容作答。
工具与扩展
通过 Python Tools、Pipelines、MCP 与 OpenAPI 服务器扩展能力,社区市场一键安装提示词、模型与函数。
多用户与企业级
多用户管理、SSO/RBAC/审计日志、数据驻留与气隙部署,满足团队与 regulated 行业需求。
语音、图像与代码执行
内置语音识别/合成、图像理解与生成,Open Terminal 让 AI 在浏览器中写代码、跑命令、管文件。
零基础快速上手
4 步完成你的第一件 AI 作品,无需任何设计经验
安装
本地用 pip install open-webui,或用官方 Docker 镜像(ghcr.io/open-webui/open-webui:main)一键部署。
启动并访问
Docker 运行后打开 http://localhost:3000;首个注册账号自动成为管理员。
连接模型
在设置中接入 Ollama 本地模型,或填写 OpenAI / Anthropic 等兼容端点;也可通过 OpenRouter 类网关接入多模型。
搭建知识库
上传文档创建知识库,选择向量检索或全文注入模式,让 AI 基于你的资料问答。
安装扩展
从社区市场安装 Tools / Functions / Pipelines,或接入 MCP 服务器扩展 agent 能力。

常见问题解答
遇到问题?这里可能有你想要的答案
Open WebUI 收费吗?
标准自部署免费,保留原始品牌标识即可;企业白标与定制主题需 Enterprise 许可。社区版个人使用完全免费。
数据会离开我的机器吗?
默认不会。Open WebUI 设计为可离线运行,数据驻留由你掌控;仅当你主动接入云端模型端点时,对应内容才会发往该服务商。
必须会部署才能用吗?
Docker 一条命令即可启动,无需账号;官方也提供详细文档与企业 Helm/K8s 部署方案。
同类对比
和同类工具横向对比,帮你选对工具。
| 对比维度 | Open WebUI | LM Studio | Ollama | AnythingLLM |
|---|---|---|---|---|
| 形态 | Web 界面平台 | 桌面 GUI | CLI/API 服务 | Web 界面平台 |
| 模型连接 | 任意 OpenAI 兼容 + 本地 | 本地模型为主 | 本地模型 | 多模型 + 本地 |
| RAG 知识库 | 内置 | 基础 | 无(纯推理) | 内置 |
| 多用户/企业 | SSO/RBAC/审计 | 单人 | 单人 | 多用户 |
| 扩展方式 | Tools/Pipelines/MCP | 模型管理 | Modelfile | 文档/API |
同类推荐工具
发现更多优质 AI 创作工具,找到最适合你的那一款
Cohere
Cohere 是面向企业的 AI 公司,由 Transformer 论文《Attention Is All You Need》的联合作者 Aidan Gomez 于 2019 年在多伦多创立,提供 Command 系列大模型、Embed 与 Rerank 模型以及 Coral 企业助手,支持 AWS / GCP / Azure 与本地私有部署,专注 RAG 与数据安全。
Deepgram
Deepgram 是用于实时与批量语 音转写的开发者优先 STT API,Nova-3 模型实现亚 300ms 流式延迟、50+ 语言支持,并为语音智能体提供原生端点检测。
Dify
Dify 是开源的 LLM 应用开发平台,把可视化工作流编排、RAG 知识库、Agent 框架、模型管理与 LLMOps 观测集成在一个画布里,支持云端与私有化部署。
Groq
Groq 是提供极速 AI 推理的开放平台,自研 LPU 处理器让开源大模型实现亚秒级响应,并通过 OpenAI 兼容 API 让开发者即插即用。