5分钟搭建你的AI知识库:Open Glean快速开始完全教程(新手友好)
【免费下载链接】open-gleanAn open-source AI platform for knowledge work. Connect your apps, find answers, and get work done.项目地址: https://gitcode.com/gh_mirrors/op/open-glean
Open Glean是一个开源的AI 知识库与智能问答平台:连接你的文件、笔记和常用应用,向 AI 提问时它会自动检索上下文、生成答案并附上来源引用。本教程带你在 5 分钟内完成搭建。
Open Glean 是什么?🧠
简单来说,它是一个基于Hydra DB向量数据库的「第二大脑」:你上传或同步的内容,都能被自然语言检索。核心能力包括:
- Ask 智能问答:一个输入框问遍所有知识,答案流式输出,带行内引用和来源面板,还能叠加网页搜索。
- Deep Research 深度研究:复杂问题自动拆解为子问题,并行调研,最后汇总成带编号引用的完整报告。
- Mindmap 知识图谱:Hydra DB 从你的内容中自动构建知识图谱,可视化查看。
- Integrations 集成:在应用内连接 100+ 工具(Notion、Slack、Google Drive 等)并开始同步。
- 自带模型(BYO Model):支持任意 OpenAI 兼容接口,内置模型搜索与收藏。
技术栈为Next.js 16 + React 19 + Tailwind CSS v4,采用 Apache-2.0 开源协议,详见 README.md。
5分钟快速开始:安装并运行 Open Glean ⚡
第 1 步:获取代码
将项目克隆到本地(建议使用 Node.js 24):
git clone https://gitcode.com/gh_mirrors/op/open-glean cd open-glean第 2 步:安装依赖并启动
npm ci npm run dev无需任何额外配置!在未配置数据库密钥时,应用会自动显示连接引导界面,带你完成下一步。
第 3 步:连接 Hydra DB
在浏览器打开http://localhost:3000:
- 粘贴你的Hydra DB API key,选择目标数据库;
- 密钥可以在 Hydra DB 官方控制台(app.hydradb.com)创建,同时在那里上传或同步你的知识库内容。
🔒安全设计:密钥不会存入浏览器。它经服务端验证后,以 AES-256-GCM 加密存入 httpOnly 会话 Cookie,实现见 lib/session.ts。
第 4 步:配置 AI 模型(可选但推荐)
进入Settings 设置页:
- 粘贴一个OpenRouter API key(或其他 OpenAI 兼容服务的密钥);
- 搜索并选择一个模型(如
google/gemini-3.7-flash)。
模型只负责撰写答案——即使不配置,你依然可以正常搜索和检索知识库。
第 5 步:开始提问 🎉
回到首页 Ask 页面(源码 app/(app)/ask/page.tsx/ask/page.tsx)):
- 直接输入问题发送,获得流式答案 + 来源引用;
- 可先到Context 页面上传文件、笔记、网页,丰富知识库;
- 复杂课题可切换Deep Research模式。
Docker 一键部署(替代方案)🐳
如果你更喜欢容器化部署,项目提供了生产级 Dockerfile(多阶段构建、非 root 用户运行):
docker build -t open-glean . docker run -p 3000:3000 \ -e OPEN_GLEAN_SESSION_SECRET=your-random-16-char-secret \ -e HYDRA_API_KEY=your-hydra-key \ -e OPENROUTER_API_KEY=your-openrouter-key \ -e OPEN_GLEAN_LLM_MODEL=google/gemini-3.7-flash \ open-glean💡 设置部署级共享密钥
HYDRA_API_KEY后,用户端无需再逐个录入密钥。
支撑这一切的底层是 Hydra DB——一款面向知识工作的向量数据库,它会自动从内容中提取实体关系,构建可检索的知识图谱:
核心功能一览 📋
| 页面 | 功能 | 说明 |
|---|---|---|
| Ask | 智能问答 | 检索上下文 + 流式答案 + 行内引用 |
| Deep Research | 深度研究 | 子问题 DAG 拆解、并行调研、时间线进度 |
| Context | 上下文管理 | 文件、笔记、保存的网页、同步数据 |
| Collections | 集合 | 将问答限定在某个集合(子租户)内 |
| Mindmap | 知识图谱 | 可视化 Hydra 构建的关系图谱 |
| Integrations | 集成 | 连接 100+ SaaS 工具、验证凭证、启动同步 |
| Chat History | 历史会话 | 会话持久化(可接 MongoDB) |
问答输入框组件 components/AskSearchBar.tsx、深度研究任务规划器 lib/research/planner.ts 代码都很易读,值得围观。
环境变量速查表
完整说明见 .env.example,最常用的几个:
| 变量 | 用途 |
|---|---|
OPEN_GLEAN_SESSION_SECRET | 生产环境必填,16 位以上随机字符串 |
HYDRA_API_KEY | 可选,部署级共享密钥 |
OPENROUTER_API_KEY | 可选,服务端 LLM 密钥 |
OPEN_GLEAN_LLM_MODEL | 默认答案模型 ID |
MONGODB_URI | 可选,聊天记录持久化 |
常见问题 ❓
Q:需要准备哪些账号?A:一个 Hydra DB 账号(存知识)+ 一个 LLM 密钥(生成答案,如 OpenRouter)。
Q:能用本地模型吗?A:可以。将 LLM 端点指向 Ollama / LM Studio 等本地服务,并启用OPEN_GLEAN_ALLOW_PRIVATE_LLM_URL=true。
Q:数据安全吗?A:所有 Hydra 请求都经由 Next.js 代理(/api/hydra/*)转发,密钥永不暴露到浏览器。
开始打造你的第二大脑 🚀
从克隆代码到第一次 AI 问答,真的只要 5 分钟。接下来把会议记录、技术文档、工作资料放进 Context,Open Glean 就会帮你把散落的信息变成随时可问的AI 知识库。
更多贡献指南与安全说明见 CONTRIBUTING.md 和 SECURITY.md。
【免费下载链接】open-gleanAn open-source AI platform for knowledge work. Connect your apps, find answers, and get work done.项目地址: https://gitcode.com/gh_mirrors/op/open-glean
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考