判断一个知识库是否可用,标准只有一个:半年后你还能不能找到那一条记录。存储方案再高级,如果检索失败,这个库就是无效的。
三个检索入口
人的记忆线索有三种,对应的检索入口也应该有三种:
1. 按主题找(分类)
当你明确知道“我要找的是那篇讲部署的笔记”时,走的是主题入口。分类的数量要控制在十个以内,每个分类的含义必须清晰到不需要犹豫。
分类过多是知识库失控的第一信号:当一个分类下只有两三条记录时,它就不是分类,而是临时文件夹。
2. 按关键词找(标签)
标签负责处理“跨分类的共同点”。比如“性能优化”这个话题可能同时出现在前端笔记、数据库笔记和运维记录里,用标签把它们串起来。
标签的管理原则和分类相反:可以多,但必须去重。同义词不合并,很快就会长出三四个含义相同、拼写不同的标签。
3. 按时间找(归档)
人的记忆里往往留着时间锚点:“大概是去年冬天写的”。归档视图就是为这条线索准备的。
这三个入口覆盖了绝大多数检索场景,也解释了为什么一个可用的知识库需要同时具备分类、标签和归档。
一条底线:能被全文检索
前面三个入口都是“结构”,而结构依赖你记得住结构。真正兜底的是全文检索——只要内容里出现过这个词,就应该能被找到。
这条底线的实际要求是:内容必须是纯文本。
- 截图存 PDF 的方案,检索时基本等于不存在;
- 图片里的文字,除非做 OCR,同样检索不到;
- 只有真正的文本文件,才能被
grep或者站点搜索命中。
存一张截图只需要三秒,但三个月后你会发现:你记得的是“那张图里有句话”,而不是图在哪。
落地时的一个习惯
给每条记录起名时,把关键词写进标题,而不是用“随手一记”“笔记 2025”这类名字。标题是最常被扫视的字段,它决定了你能否在一屏之内认出目标。
如果实在想不出标题,那通常说明这条记录还没想清楚要说什么——那就不必急着存。