过去半年我用 Claude Code + Obsidian 维护一个 1900+ 页的个人知识库(Karpathy 说的 LLM Wiki 模式:人投喂原料和提问,LLM 负责阅读、提炼、织链接、维护索引)。踩了不少坑之后发现,这个模式的难点不在"怎么搭",在"怎么长期运营不腐烂"——库会囤积、日志会失控、多个 Agent 会话会互相打架。
把长出来的工具链脱敏抽成了模板仓库:GitHub - xiaojian968/llm-wiki-kit: 中文优先的 LLM 知识库工具链模板:检索/巡检/蒸馏配额/日志折叠/多智能体写锁 | Chinese-first toolkit for LLM-maintained Obsidian vaults · GitHub
几个和现有模板不太一样的点:
- 摄入配额 5:1:每摄入一批材料必须先消化产出一件知识成果,脚本量化吸收率,从机制上防"数字仓鼠"
- 零依赖检索:BM25+中文 bigram 纯标准库;装了 smart-connections 插件就自动复用它的向量做语义重排,不用调 API 也不用装模型
- 多智能体写锁:两个 Agent 会话同时改一个文件前先加锁,120 秒自动过期
- 日志折叠:操作日志只留最近 30 条,更早的全文迁归档,幂等
- 证据先行:所有结论页 frontmatter 强制指回不可变的 raw 原文池
全部纯 Python/Bash 标准库,clone 下来 lint 直接绿。MIT,欢迎拍砖。