本地知识库检索 Skill
把个人笔记变成可对话的知识库,离线也能用,支持中文语义检索,隐私不出本机。
一、它解决什么
我们的笔记越记越多,但想找的时候却像大海捞针。这个 Skill 把本地 Markdown、PDF、网页剪藏统一索引,像和 ChatGPT 聊天一样提问,直接得到答案。
关键是全部在本地跑:笔记不传到云端,适合对隐私敏感、或者经常断网的环境。
二、实现思路
整体分三步:先用轻量模型把文档切成片段并转成向量;再用 FAISS 或本地向量库存起来;最后用户提问时做语义检索,把最相关的片段喂给大模型生成回答。
中文语义检索用开源 embedding 模型就够了,不需要调 API,也不需要联网。
三、用法示例
把笔记文件夹路径配进 Skill,执行一次索引命令。后面每次提问,它会先检索相关片段,再基于片段作答。
比如你问「我去年总结的公众号选题有哪些」,它能在你的笔记里找到对应的记录,而不是泛泛而谈。
四、局限与扩展
目前对图片、表格的支持还比较弱;后面打算接上 OCR 和多模态模型。另外如果笔记上万篇,索引体积会变大,需要定期清理。
这个 Skill 尤其适合把几年的工作笔记盘活,让过去的记录成为现在的助手。