WorkBuddy + ima 搭建个人知识库:从资料散落到达标可复现(防幻觉实战)
摘要:个人知识库最常见的问题不是“不会建库”,而是资料散在微信、PDF、会议纪要、网页收藏里,真正要用时翻不到;AI 问答又容易编出处。本文用 ima 做“可信知识沉淀池”,用 WorkBuddy 做“资料读取—整理—生成—回存”的执行台,给出个人/自由职业/研发/运营可落地的建库分类、连接器授权、5 套可复制提示词、周复盘 SOP 与防幻觉校验清单。所有界面型操作均标注“以当前版本为准”,避免教程过时。
文章目录
- WorkBuddy + ima 搭建个人知识库:从资料散落到达标可复现(防幻觉实战)
- 一、为什么不用单一工具:分工与边界
- 二、产品能力核验
- 三、整体架构与数据闭环
- 四、ima 建库规范:分类、命名、入库门槛
- 4.1 个人知识库建议(先三个,别一口气流式建十几个)
- 4.2 命名与标签
- 4.3 入库门槛(防垃圾库)
- 五、WorkBuddy 连接 ima:授权与任务引用
- 5.1 授权步骤(通用版)
- 5.2 引用原则
- 六、5 套可复制提示词:整理/摘要/项目包/选题/周复盘
- 6.1 新资料整理(批量入库前)
- 6.2 单库精准摘要
- 6.3 项目材料包(找缺口)
- 6.4 内容选题(不直接替你写全文)
- 6.5 周复盘(不自动删资料)
- 七、端到端 SOP:从碎片到可复用资产
- 八、防幻觉校验清单
- 九、常见故障与保守排错
一、为什么不用单一工具:分工与边界
单一 AI 对话框的问题:
- 资料在微信/本地/网页,提问时不带上下文,模型用通用知识补,容易出现“看起来对、实际无来源”。
- 单一收藏工具只解决“存”,不解决“按我的项目抽取、改写、出方案”。
- 单一 agent 若不接私域资料,做个人复盘/客户项目/行业研报时,很难做到可溯源。
更稳妥的分工:
| 工具 | 角色 | 不负责的事 |
|---|---|---|
| ima 知识库 | 资料沉淀、微信/PDF/网页/图片入库、标签文件夹分类、基于知识库问答 | 不替代人工判断;不保证复杂扫描件 100% 解析成功 |
| WorkBuddy | 读取资料/文件、按任务摘要、生成方案/表格/周报、若版本支持可回存产物 | 不自动下最终业务结论;不承诺“零幻觉” |
| 人 | 入库筛选、事实核对、敏感脱敏、最终发布/发送 | 不把未核验 AI 输出当事实 |
原则一句话:ima 管“可信资料”,WorkBuddy 管“把资料变成活产物”,人管“兜底核对”。
二、产品能力核验
为避免幻觉,下面只列公开资料可支撑能力,具体入口随版本变化。
- WorkBuddy:公开资料将其定位为 AI 办公/桌面智能体工作台,支持文件理解、文档/表格/PPT 生成、专家/技能/自动化任务;企业版通过 Knowledge Base、Skills、Connector 打通腾讯文档、腾讯网盘、腾讯乐享等,且公开材料提到可通过连接器对接 ima、腾讯会议、QQ 邮箱等协同办公软件。 个人桌面版资料提到可读取经授权本地文件夹、批量处理文件、行业调研等。
- ima 知识库:官网/指南支持个人知识库与共享知识库;电脑端从 ima.qq.com 下载,微信小程序可导入聊天文件、公众号文章、图片;支持 PDF、Word、PPT、图片、网页链接、笔记等;可用标签、文件夹分类;提问可基于知识库、指定 #标签、@范围或多库联查;个人库默认私密,共享库可设成员权限。
- 两者联动:企业版/连接器场景的公开材料提到 WorkBuddy 可调用知识源、把任务产物回写知识库;个人版若客户端提供“ima 知识库”连接器或“资料库”入口,可按授权范围检索与存回。若你的版本没有回写按钮,就用“WorkBuddy 导出 Markdown/Excel → 人工上传 ima”的半自动闭环,不硬编“一键回存”。
勘正说明:网络旧教程常写“左侧资料库→ima”,新企业版/部分客户端可能在“专家·技能·连接器→连接器→ima 知识库”;若找不到旧入口,以当前客户端搜索“ima/知识库/连接器”为准,不假设固定路径。
三、整体架构与数据闭环
闭环不是“存进去→AI 自动写”,而是“入库可溯源→调用可限定→生成可复核→定稿再回存”。
四、ima 建库规范:分类、命名、入库门槛
4.1 个人知识库建议(先三个,别一口气流式建十几个)
- 01-资料库:行业研报、政策原文、竞品资料、技术文档、公众号干货、网页收藏。
用途:趋势摘要、术语解释、引用溯源。 - 02-项目库:会议纪要、需求文档、客户反馈、报价/合同脱敏版、历史方案、复盘。
用途:写推进方案、查交付标准、做项目周报。 - 03-输出库:文章草稿、方法论、提示词、FAQ、培训提纲、个人复盘。
用途:保持个人表达体系,避免每次从零写。
共享库只在“多人协作”时建,例如团队规范库、客户只读库;个人敏感资料不进共享库。
4.2 命名与标签
文件级命名尽量带元信息:
来源_主题_对象_日期 例:研报_AI办公智能体_企业知识管理_20260912.pdf 例会_项目A_需求变更_纪要_20260920.md 公众号_电商违禁词_广告法实务_20260830.url标签用“少而固定”,别建几十个同义标签:
- 资料库:
#研报 #政策 #竞品 #技术 #法规 - 项目库:
#项目A #客户反馈 #会议纪要 #需求 #风险 - 输出库:
#文章 #提示词 #FAQ #复盘 #培训
ima 电脑端可右键文件编辑标签,移动端/小程序可批量打标;文件夹按“资料/项目/输出”或按客户名建一级,标签做横切。
4.3 入库门槛(防垃圾库)
不是看到就存。入库前过四问:
- 未来 3 个月会不会被问到?(不确认→暂存“待整理”不直接进主库)
- 来源是否可标注?(无作者/无日期/无出处的网文降权)
- 是否含敏感信息?(合同金额、手机号、身份证、账号密码、未公开经营数据→脱敏或不存)
- 是否有替代更新版?(旧版标“归档”,新版作主版本,避免 AI 引旧结论)
五、WorkBuddy 连接 ima:授权与任务引用
5.1 授权步骤(通用版)
- 电脑端登录 WorkBuddy;ima 电脑端/小程序用同一主账号体系登录(具体统一身份方式以个人版/企业版当前账号体系为准)。
- 在 WorkBuddy 找 ima 入口,按版本二选一:
- 旧/部分版本:左侧“资料库 / 知识库”→“ima 知识库”→连接/授权;
- 新/企业版:左侧“专家·技能·连接器”→“连接器”→搜索“ima 知识库”→添加/连接。
- 弹出授权页后,确认范围;公开个人联动资料通常至少涉及“查看知识库列表、检索资料、将文件加入任务、将产物保存回 ima”几类。只开自己真用到的范围,不全选不明权限。
- 授权后新建任务,选择“从 ima 添加资料”或输入框选择知识库/文件;若支持 @知识库名、@标签,按界面提示限定范围。
5.2 引用原则
- 单项目问题:只挂“02-项目库”相关文件,不挂全量个人库。
- 行业综述:只挂“01-资料库+对应标签”,如
#研报。 - 输出类改写:挂“03-输出库+项目原始资料”,避免模型凭空扩写。
- 不确定资料是否解析完整:先让 WorkBuddy 列“已读取文件名+页数+缺失提示”,再正式提问。
六、5 套可复制提示词:整理/摘要/项目包/选题/周复盘
所有提示词统一加“无依据不编、标出处、待确认不猜”。
6.1 新资料整理(批量入库前)
读取我在 ima“01-资料库”中本次加入的 N 个文件。 按以下格式逐文件输出: - 文件名/来源/日期/作者(如文件无作者,写“未标注”) - 100字摘要 - 3个可复用观点 - 适用标签建议(仅从#研报/#政策/#竞品/#技术/#法规中选或补充,但新标签需说明理由) - 可能存在的过时/未核实信息(如数据无出处、引用二手来源) 不补充文件外的事实;如某观点无法定位到页码/段落,标注“未定位”。6.2 单库精准摘要
仅基于 ima“02-项目库”中“项目A”相关文件回答。 问题:客户对交付标准的 latest 要求是什么? 输出: 1)结论摘要(3条以内) 2)原话摘录+文件名+日期+章节/段落 3)如不同会议纪要结论冲突,分别列出“版本A/版本B/建议人工确认”,不自行裁决 4)未检索到相关内容时,直接答“未在已提供资料中检索到”,不改用通用知识补全。6.3 项目材料包(找缺口)
读取 ima“02-项目库”项目A全部已授权文件,生成项目材料包: 背景、已有资料清单、关键开放问题、可用资产、缺失材料、下一步待收集。 要求: - 缺失材料明确写“未提供”,不假设已存在 - 负责人/日期若资料无写,标“待确认”,禁止推测 - 输出 Markdown,附录列每个结论对应文件名6.4 内容选题(不直接替你写全文)
基于 ima“01-资料库”标签#研报/#竞品 与“03-输出库”个人定位,生成10个选题。 每个选题含:标题建议、目标读者、核心观点、可引用资料(文件名+段落)、人工核实点、避免夸大表述的替代词。 不重复原文标题;不编造阅读量/转化率/案例数据;如资料无数据支撑,写“需补充数据后再写”。6.5 周复盘(不自动删资料)
读取 ima 本周新增资料(全库或指定库),输出周复盘: - 新增文件清单与主题分布 - 重复出现的高频问题 - 值得深读3篇及理由 - 可发展成文章/FAQ/培训的候选 - 下周待补充资料与待人工核实项 规则:不删除、不移动、不覆盖任何原文件;仅给建议;对扫描件/图片提取内容标注“OCR可能不完整,需回原文件核对”。七、端到端 SOP:从碎片到可复用资产
- 收集:微信文章用 ima 小程序/“用 ima 打开”入库;本地 PDF/Word 拖入 ima 对应库;会议纪要以 Markdown/文本入库,不用图片替代正文。
- 分类:按 01/02/03 三库入;打固定标签;项目文件另建子文件夹。
- 粗筛:每周固定 30 分钟,用 6.1 提示词让 WorkBuddy 读新增文件,输出摘要;人删低质、合并重复。
- 调用:写方案/文章/周报时,在 WorkBuddy 只挂相关库和相关标签,不用全量库;要求出处在括号标注。
- 核验:AI 出稿后按第八节清单核对;特别是数据、日期、条款、客户名、金额、技术结论。
- 定稿:导出 MD/Word/Excel;删过程废稿。
- 回存:若 WorkBuddy 支持产物上传 ima,回写 03-输出库并打标签;不支持则手动上传。回存前补“版本日期+适用场景+失效条件”。
- 淘汰:每季度审一次库,旧政策、旧报价、过期竞品资料标“归档-日期”,主问答默认用现行版。
八、防幻觉校验清单
发稿/发客户/做决策前逐条过:
- 出处可点:每个关键结论有文件名+日期+段落;无出处结论一律改“据已提供资料未检索到,需人工核实”。
- 范围限定:提问时指定库/标签/文件;不写“综合全网给我答”,避免私域问题被通用知识污染。
- 冲突不裁:多份资料不一致时并列呈现,不让模型选“最合理”代替人工。
- 数据回原文件:AI 提取的表格数字、百分比、日期、版本号,回 PDF/Excel 原表抽验;扫描件、双栏论文、截图表格要人工复核。
- 待确认不编:负责人、金额、法律条款、客户承诺、项目工期,资料没有就标“待确认”。
- 敏感脱敏:合同、身份证、银行卡、手机号、未公开财务、生产账号、密钥不进个人知识库;企业资料按公司权限再脱敏。
- 高风险不替代人工:法律、医疗、投资、税务、安全合规结论,AI 只做资料整理,最终由具备资质人员确认。
- 版本时效:政策/平台规则/产品功能按“截至某日期所用资料”标注;规则更新后重跑摘要,不沿用旧库结论。
- 回写留痕:回存 ima 的 AI 摘要标“AI初稿-人工已核/未核”;未核内容不进“输出库主版本”。
- 评测可复现:用固定 5 个样本问题做回归,记录召回文件、错误率、误编条数;比“感觉更聪明”更重要。
九、常见故障与保守排错
- WorkBuddy 找不到 ima 入口:先搜“ima/知识库/连接器”;个人版看“资料库”,企业版/新客户端看“专家·技能·连接器→连接器”。找不到不硬改配置,查版本更新日志或用“先导出文件→手动传 ima→WorkBuddy 上传文件分析”替代。
- 授权后读不到库:确认两端同一主账号;确认授权范围包含查看/检索;确认文件已真正进入知识库而非仅在聊天附件;重新授权前先解除旧授权。
- 回答不引用资料、像通用搜索:提示词没限定库/标签;或挂了全量大库导致召回分散。改挂单库+#标签,并要求“仅用已提供文件,无依据答未检索到”。
- PDF/图片抽错:扫描件、拍照倾斜、双栏、表格图片都会降低解析质量。重要文件保留可复制文本版;图片资料人工看原图。
- 回写失败:当前版本/权限不支持回存时,不反复试插件;改本地导出 MD,再在 ima 对应库上传。
- 共享库权限混乱:个人敏感资料不进共享库;共享库设“可查看/可编辑/需确认加入”,按成员最小权限开。