公开我的Obsidian LLM Wiki的脚本(附双平台脚本)
没想到之前随手写的一个搭建思路有这么多人关注,感谢大家。想了想,还是公开我的脚本
没想到之前随手写的一个搭建思路有这么多人关注,感谢大家。
后面想了很久,要不要把我的脚本公开出来?
之前分享的时候写得比较仓促,大概就是配置了一整天下来,发现用插件这条路走不通,可能是英语苦手吧,改变思路后,用手头熟悉的工具去尝试,没想到达到预期效果了。

我还是决定放出来,因为它有一定的价值,可以让更多人在我的基础上修改出自己想要的版本,吸收到一些经验避开我踩过的坑,快速的去尝试这个方法是否适合自己。
毕竟没处理时的多资料的Obsidian里,看到的图谱实际并没有呈现期待的知识关系。
特别说一下,第一次用的朋友也不用担心,脚本本身不会对已有的笔记做任何修改。
她会读取笔记内容,让大语言模型处理为新的文件,保存到你指定的目录。
觉得不满意随时可以删掉这个目录,不会造成任何对已有资料不可逆的行为。
脚本随着使用时间以及数据积累,后续还会迭代,目前来说,有这些问题还没找到解决方案:
识别实体的准确率
对实体识别做了一些额外的限制:中英文取公认的,禁止中英混用,去复数、去除符号,去颜表情,技术缩写必须全为大写,首字母大写等。
但实际使用下来还是会有实体识别不够准确的情况,可能这跟模型性能有关。解决的方向是,在定期维护时,通过有联网能力的模型去处理
近似词的识别和合并
在创建实体页面时,做了以下措施:检查本地已有实体,去除多余符号,确保没有重复的词。
随着数据量的提升,会发现近似词会变着花样出现。同样的,定期维护时可以去解决,单依赖脚本本身有局限性
脚本运行后的关系图谱效果是这样的

目录:11-knowledge,就是我用来存放 知识卡片、实体的目录
(如果想直接拿脚本的,可以直接滑到文章底部)
脚本有两段提示词,除此之外都是用Python去实现的。如果担心有安全问题,可以下载了压缩包之后先去检查。
用于提取知识卡片的提示词
1 | `# Role |
创建实体的提示词
1 | `你现在的任务是"实体库标准化审计"。 |
过程里解决的问题
你们就不用再处理这些问题了
- 为知识卡片提炼限定长度的标题,而不是采用原文标题,避免流水式的标题;
- 知识卡片里带上原文地址,方便确认(如果你不需要,可以在提示词里删除这部分);
- 对文本去噪,避免影响大语言模型工作,包括编码、emoji、占位符、不可识别内容等影响正常工作;
- 禁止代码块,必须将其转为人类可读的自然语言逻辑描述;
- 去除口水话、语气助词,让输出内容更学术、中立;
- 严格的输出格式,避免模型输出emoji、自发表述注释;
- 确保实体都被双向链接包裹
- 创建实体前先判断是否已有,若有则追加
- 实体去重
- 规范实体名称
- 合并同义词的实体
使用流程
脚本具备自动记忆功能,当你输入自己的值时,只要进入到下一步,它就会自动保存为默认值,下次无需再手动输入,不断回车就可以完成整个蒸馏过程。
脚本在初次使用会自动安装依赖,在Python标准库的基础上安装
这样使用
- 双击,运行脚本
- 预设了 美团LongCat的模型。(可以换自己的大语言模型,表现会更好)
- 指定 要读取的目录(目录A)
- 指定 要保存知识卡片的目录(目录B)
- 等待处理完成会提示,指定 指定实体的目录(目录C)
- 完成


下载脚本
https://gitee.com/kikun/Obsidian-Wiki-LLM-scripts/raw/master/Obsidian-Wiki-LLM%20双平台脚本.zip
Gitee国内直连
看到这里,给我点个赞、推荐、转发吧!你是好人!

Mac脚本我测试过,Win的如果有问题,可以用Trae、CodeBuddy去修改
本文转载自微信公众号,如有侵权请联系删除。
- 标题: 公开我的Obsidian LLM Wiki的脚本(附双平台脚本)
- 作者: lxiol
- 创建于 : 2026-06-20 01:24:01
- 更新于 : 2026-06-20 01:24:01
- 链接: https://blog.lxiol.cn/2026/06/20/公开我的Obsidian-LLM-Wiki的脚本附双平台脚本/
- 版权声明: 本文章采用 CC BY-NC-SA 4.0 进行许可。