news 2026/9/26 18:47:34

5分钟搭建你的AI知识库:Open Glean快速开始完全教程(新手友好)

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
5分钟搭建你的AI知识库:Open Glean快速开始完全教程(新手友好)

5分钟搭建你的AI知识库:Open Glean快速开始完全教程(新手友好)

【免费下载链接】open-gleanAn open-source AI platform for knowledge work. Connect your apps, find answers, and get work done.项目地址: https://gitcode.com/gh_mirrors/op/open-glean

Open Glean是一个开源的AI 知识库与智能问答平台:连接你的文件、笔记和常用应用,向 AI 提问时它会自动检索上下文、生成答案并附上来源引用。本教程带你在 5 分钟内完成搭建。

Open Glean 是什么?🧠

简单来说,它是一个基于Hydra DB向量数据库的「第二大脑」:你上传或同步的内容,都能被自然语言检索。核心能力包括:

  • Ask 智能问答:一个输入框问遍所有知识,答案流式输出,带行内引用和来源面板,还能叠加网页搜索。
  • Deep Research 深度研究:复杂问题自动拆解为子问题,并行调研,最后汇总成带编号引用的完整报告。
  • Mindmap 知识图谱:Hydra DB 从你的内容中自动构建知识图谱,可视化查看。
  • Integrations 集成:在应用内连接 100+ 工具(Notion、Slack、Google Drive 等)并开始同步。
  • 自带模型(BYO Model):支持任意 OpenAI 兼容接口,内置模型搜索与收藏。

技术栈为Next.js 16 + React 19 + Tailwind CSS v4,采用 Apache-2.0 开源协议,详见 README.md。

5分钟快速开始:安装并运行 Open Glean ⚡

第 1 步:获取代码

将项目克隆到本地(建议使用 Node.js 24):

git clone https://gitcode.com/gh_mirrors/op/open-glean cd open-glean

第 2 步:安装依赖并启动

npm ci npm run dev

无需任何额外配置!在未配置数据库密钥时,应用会自动显示连接引导界面,带你完成下一步。

第 3 步:连接 Hydra DB

在浏览器打开http://localhost:3000:

  1. 粘贴你的Hydra DB API key,选择目标数据库;
  2. 密钥可以在 Hydra DB 官方控制台(app.hydradb.com)创建,同时在那里上传或同步你的知识库内容。

🔒安全设计:密钥不会存入浏览器。它经服务端验证后,以 AES-256-GCM 加密存入 httpOnly 会话 Cookie,实现见 lib/session.ts。

第 4 步:配置 AI 模型(可选但推荐)

进入Settings 设置页:

  1. 粘贴一个OpenRouter API key(或其他 OpenAI 兼容服务的密钥);
  2. 搜索并选择一个模型(如google/gemini-3.7-flash)。

模型只负责撰写答案——即使不配置,你依然可以正常搜索和检索知识库。

第 5 步:开始提问 🎉

回到首页 Ask 页面(源码 app/(app)/ask/page.tsx/ask/page.tsx)):

  • 直接输入问题发送,获得流式答案 + 来源引用;
  • 可先到Context 页面上传文件、笔记、网页,丰富知识库;
  • 复杂课题可切换Deep Research模式。

Docker 一键部署(替代方案)🐳

如果你更喜欢容器化部署,项目提供了生产级 Dockerfile(多阶段构建、非 root 用户运行):

docker build -t open-glean . docker run -p 3000:3000 \ -e OPEN_GLEAN_SESSION_SECRET=your-random-16-char-secret \ -e HYDRA_API_KEY=your-hydra-key \ -e OPENROUTER_API_KEY=your-openrouter-key \ -e OPEN_GLEAN_LLM_MODEL=google/gemini-3.7-flash \ open-glean

💡 设置部署级共享密钥HYDRA_API_KEY后,用户端无需再逐个录入密钥。

支撑这一切的底层是 Hydra DB——一款面向知识工作的向量数据库,它会自动从内容中提取实体关系,构建可检索的知识图谱:

核心功能一览 📋

页面功能说明
Ask智能问答检索上下文 + 流式答案 + 行内引用
Deep Research深度研究子问题 DAG 拆解、并行调研、时间线进度
Context上下文管理文件、笔记、保存的网页、同步数据
Collections集合将问答限定在某个集合(子租户)内
Mindmap知识图谱可视化 Hydra 构建的关系图谱
Integrations集成连接 100+ SaaS 工具、验证凭证、启动同步
Chat History历史会话会话持久化(可接 MongoDB)

问答输入框组件 components/AskSearchBar.tsx、深度研究任务规划器 lib/research/planner.ts 代码都很易读,值得围观。

环境变量速查表

完整说明见 .env.example,最常用的几个:

变量用途
OPEN_GLEAN_SESSION_SECRET生产环境必填,16 位以上随机字符串
HYDRA_API_KEY可选,部署级共享密钥
OPENROUTER_API_KEY可选,服务端 LLM 密钥
OPEN_GLEAN_LLM_MODEL默认答案模型 ID
MONGODB_URI可选,聊天记录持久化

常见问题 ❓

Q:需要准备哪些账号?A:一个 Hydra DB 账号(存知识)+ 一个 LLM 密钥(生成答案,如 OpenRouter)。

Q:能用本地模型吗?A:可以。将 LLM 端点指向 Ollama / LM Studio 等本地服务,并启用OPEN_GLEAN_ALLOW_PRIVATE_LLM_URL=true。

Q:数据安全吗?A:所有 Hydra 请求都经由 Next.js 代理(/api/hydra/*)转发,密钥永不暴露到浏览器。

开始打造你的第二大脑 🚀

从克隆代码到第一次 AI 问答,真的只要 5 分钟。接下来把会议记录、技术文档、工作资料放进 Context,Open Glean 就会帮你把散落的信息变成随时可问的AI 知识库。

更多贡献指南与安全说明见 CONTRIBUTING.md 和 SECURITY.md。

【免费下载链接】open-gleanAn open-source AI platform for knowledge work. Connect your apps, find answers, and get work done.项目地址: https://gitcode.com/gh_mirrors/op/open-glean

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/26 18:47:02

Claude Code模板工程化:从提示词到稳定AI编程工作流

1. 为什么我盯上了claude-code-templates这个方向1.1 Claude Code好用,但它离"顺手"还差一层先交代一下背景。我过去大半年一直重度使用Claude Code来处理日常开发任务,从补测试到改bug,从重构老模块到搭新服务,它确实能…

作者头像 李华
网站建设 2026/9/26 18:46:32

阿里ATH事业群技术副总裁郑波:全模态AI的最新进展与未来预判

在2026云栖大会上,阿里巴巴 ATH 事业群技术副总裁、淘天集团首席科学家郑波 拆解了当下多模态生成 AI 的行业变革趋势,同时公开了阿里巴巴全模态生成模型的最新迭代成果与未来技术蓝图。阿里巴巴 ATH 事业群技术副总裁、淘天集团首席科学家郑波从图像、音…

作者头像 李华
网站建设 2026/9/26 18:45:34

四路CAN FD与LTE远程云调试:汽车电子逆向工程效率提升实战

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

作者头像 李华
网站建设 2026/9/26 18:45:26

STGCN时空图卷积网络实战:PyTorch实现交通流预测全解析

简介:这是一份基于PyTorch的时空图卷积网络(STGCN)实现代码,源自IJCAI 2018论文官方工程,面向人体行为分析、动作识别等方向的研究者与开发者,解决骨骼序列数据中空间拓扑关系与时间动态规律的联合建模问题…

作者头像 李华
网站建设 2026/9/26 18:45:22

BERT+ResNet多模态情感分析:构建可解释的跨模态语义对齐

简介:本资源是一套面向人工智能进阶学习者与多模态研究实践者的完整实验代码包,聚焦于文本与图像双模态情感分析任务,适用于高校课程实验、科研复现及工程原型开发。项目基于Hugging Face的RoBERTa与torchvision的ResNet50构建,系…

作者头像 李华
网站建设 2026/9/26 18:41:20

YOLOv8鸡蛋识别实战:从数据集标注到模型训练部署全解析

简介:这是一份面向目标检测与识别任务的鸡蛋数据集,包含多角度、多光线条件下的真实场景图片,已完成标注,可直接用于 YOLOv8 等主流模型的训练与验证。全部数据共 2000 个文件,压缩包约 54.29MB,其中 490 张…

作者头像 李华