跳到主要内容

笔记、资料和网站,应该怎么分工

资料一多,很容易冒出一个念头:干脆把笔记、RSS、研究材料和公开文章全塞进同一个数据库。名字可以叫“第二大脑”,也可以叫“个人 RAG”。听起来终于统一了。

但原来的东西并不会因此消失。来源还在,私人笔记还在,网站也还在。新数据库只是多了一份需要同步、备份和解释的副本。

我现在更愿意让这些工具各做一件事,再规定内容怎样从一个地方走到下一个地方。

先收着,不急着判断

随手记下来的想法、链接、视频和聊天记录,首先只是提醒:“这个东西以后可能有用。”

这一阶段最怕入口太麻烦。重复、半句话、甚至暂时理解错了都没关系。先收住,再决定是否值得处理。把每条收藏都当成知识,只会让收集箱换一个名字继续膨胀。

重要资料要保留出处和副本

新闻、RSS 和网页会修改,也可能消失。真正值得留下的材料,至少要记住来源、日期和网址,再保存一份内容哈希。以后只要重新计算哈希,就能知道手里的副本有没有被改过。

哈希只能确认“这还是当时保存的那一版”,不能证明作者可靠,更不能证明结论正确。它的作用是让日后的复核有据可查,而不是替人下结论。

大多数资讯没有必要永久保存。短期保留,临近清理时再挑出少数真正重要的内容,通常比把整个信息流存一辈子省心得多。

笔记可以边用边改

真正值得留下的内容,再整理进自己的笔记。没想成熟也不要紧,之后可以合并、拆开,过几个月发现理解错了就推翻重写。

用到时,我会再补上稳定 ID 和出处,不会为了格式整齐,把多年的旧笔记一次全部翻新。新内容按新规则写;旧笔记什么时候重新用到,什么时候再整理。

写给别人时,重新写一遍

私人笔记适合提醒自己,公开文章却要让一个不了解背景的人读懂。两者不是同一种东西。

一篇私人笔记即使获准公开,也不该原样复制。机器路径、当前有多少篇笔记、哪个服务正在运行,这些细节对内部排查有用,对读者通常没有。公开稿应该围绕读者的问题重写,只留下会影响理解和选择的内容。

连接这些地方,不要把它们焊死

不同工具不必共用一个存储。它们只要能交代清楚几件事:这是什么内容、原件放在哪里、有没有变化、从哪里来、接下来交给谁处理。

这些信息最好能跟着 Git 一起走,不依赖某台电脑的绝对路径。这样换编辑器、采集器或网站框架时,不用把整套知识重新搬家。

工具之间只传递明确选中的内容,而且每次只朝下一步走。准备公开的稿子先审核,可以通过、退回修改、放弃,或者留到以后再说。审核通过也不会自动上线;正文、翻译、导航和部署还要分别检查。

先收下来 → 人工判断去向 → 保留必要证据 → 整理进自己的笔记 → 准备公开稿 → 重写 → 发布

检查工具只负责报告缺了什么、hash 是否对不上。它不该偷偷替人补文件,更不该因为两个目录“应该一致”就自动复制正文。

同步顺利,不代表能恢复

Git 很适合保存 Markdown 的历史,也适合让不同设备交换改动。但 GitHub 上有一份仓库,不等于备份已经可靠。

每台设备保留自己的本地克隆,只通过远端交换提交,比让两套同步工具同时修改同一个目录更容易理清。除此之外,还要保留独立快照,并且真正做过恢复演练。备份文件存在,只能说明文件还在;恢复后能够打开并通过校验,才说明这份备份真的有用。

什么时候再考虑中央索引

如果以后确实需要跨大量资料做统一权限控制、快速全文搜索或批量计算,可以增加中央索引。但我会把它当成随时可以重建的搜索层,而不是新的“唯一真相”。

目前,Markdown、Git、稳定 ID 和几条清楚的交接规则已经够用。等到统一权限、跨库搜索或批量计算真的成为需求,再增加索引也不迟。