如何建立可持续更新的科研文献库
用期刊 RSS、关键词初筛和本地笔记库持续积累候选文献,让一次性检索变成长期更新的研究基础设施。
在体系中的位置
先建立持续进入新文献的入口,为后续筛选和精读提供材料。
文献工作流 · 第 1 篇

科研工作流系列·番外篇|上一篇讲了怎么从300篇筛到50篇,有朋友问:这300篇是怎么来的?这篇回答这个前置问题。
上一篇文章发出来之后,后台收到好几条类似的留言:"流程看懂了,但你那300篇候选文献是怎么积累起来的?"
说实话,这个问题比"怎么筛"更重要。筛选流程再好,如果输入的文献库本身就有盲区,筛出来的结果也不可能完整。
我的做法是用RSS订阅构建一个持续更新的本地文献库。不需要每天主动去搜论文,期刊一发新文章,标题和摘要就自动推送过来。我只需要定期做一轮关键词初筛,把相关的论文导入Obsidian,文献库就自然而然地越积越厚。
这套方法跑了一年多,目前Obsidian里的文献库有几百篇论文笔记,覆盖了我研究方向上主要期刊的近两年产出。上一篇文章里那300篇候选文献,就是从这个库里来的。
为什么用RSS而不是定期搜索
很多人积累文献的方式是"想起来就搜一下"。打开知网或者Google Scholar,输入关键词,翻几页,下载几篇。这种方式有两个问题。
第一,覆盖不全。你搜索的时候用的关键词是固定的,但好论文的标题未必包含你的关键词。你搜"供应链韧性",可能漏掉一篇标题叫"组织冗余与环境适应"的论文,而这篇论文恰好和你的研究高度相关。
第二,不可持续。搜索是主动行为,需要你记得去做。忙起来一两个月不搜,就会错过一批新发表的论文。等你想起来再搜,已经积压了大量文献,又变成了一次性的大工程。
RSS解决的就是这两个问题。你订阅了一个期刊的RSS源,这个期刊每发一篇新文章,标题和摘要就会自动推送到你的RSS阅读器里。你不需要主动搜索,也不会遗漏。至于相关性判断,交给后面的关键词初筛来做。
第一步:在DEVONthink里订阅学术期刊RSS
我用的RSS阅读器是DEVONthink,一个Mac上的文档管理软件。选它主要是因为它本身就是我的知识管理工具,文献从RSS进来之后可以直接在里面做标注、分类、搜索,不需要再倒腾一次。
订阅源的选择很关键。我订阅了两类期刊:
一类是经管领域的中文C刊。管理世界、经济研究、中国工业经济、南开管理评论这些,基本覆盖了国内经管领域的核心产出。C刊的RSS源不太好找,有些期刊官网直接提供,有些需要通过知网或者万方的期刊页面获取。
另一类是研究方向相关的SCI期刊。Journal of Operations Management、International Journal of Production Research、Supply Chain Management这些。英文期刊的RSS源比较规范,基本都能在期刊官网或者出版商网站(Elsevier、Wiley、Springer)找到。
在DEVONthink里,我建了一个专门的数据库叫"学术RSS订阅",所有期刊的RSS源都放在这里面。DEVONthink会按设定的频率自动刷新,新文章进来后按期刊分组存放。
这一步的关键是:只订阅你研究方向上最重要的十到十五个期刊。订太多会导致信息过载,每天推送几十篇新文章,你根本看不过来。订太少又会有盲区。十到十五个是我试出来的平衡点。
第二步:关键词初筛,从噪音中捞出相关论文
RSS推送过来的文章,绝大多数和你的研究方向无关。一个期刊一个月可能发三四十篇论文,和你相关的可能只有两三篇。如果每篇都点开看摘要,时间成本太高。
我的做法是用关键词做一轮自动初筛。
在DEVONthink里可以设置智能规则(Smart Rule):如果一篇文章的标题或摘要中包含预设的关键词,就自动移动到"重要价值论文"文件夹。关键词列表和上一篇文章里的一样,按三个维度组织:核心概念词、理论机制词、研究视角词。
这一步的筛选精度不需要很高。宁可多捞一些不太相关的,也不要漏掉真正重要的。因为后面还有上一篇讲的那套AI筛选流程来做精细化筛选。初筛的目的只是把明显不相关的过滤掉,把"可能相关"的都留下来。
经过关键词初筛,每个月大概会有二三十篇论文进入"重要价值论文"文件夹。积累一年,就是两三百篇。这就是上一篇文章里那300篇候选文献的来源。
第三步:一个脚本,从DEVONthink导入Obsidian
DEVONthink里的论文需要导入Obsidian才能被上一篇讲的AI筛选流程使用。这一步我写了一个AppleScript来自动完成。
脚本的逻辑很简单:遍历DEVONthink"重要价值论文"文件夹里的所有文章,把每篇文章的标题、正文(通常是摘要)、批注导出为一个Markdown文件,存到Obsidian的指定目录下。
tell application id "DNtp"
set sourceDatabase to "学术rss订阅"
set sourceGroup to "重要价值论文"
set theDatabase to get database sourceDatabase
set theGroup to get record at sourceGroup in theDatabase
set theRecords to children of theGroup
repeat with theRecord in theRecords
set theTitle to name of theRecord
set theContent to plain text of theRecord
set theAnnotations to comment of theRecord
set markdownText to theContent & "\n\n" & "[[论文带来的思考]]" & theAnnotations
set filePath to "Obsidian文献库路径/" & theTitle & ".md"
do shell script "echo " & quoted form of markdownText & " > " & quoted form of filePath
end repeat
end tell
每篇导出的Markdown文件长这样:标题就是论文标题,正文是摘要内容,末尾有一个"论文带来的思考"的双链标签,后面跟着你在DEVONthink里写的批注。如果你在DEVONthink里读摘要时随手写了几句想法,这些想法也会一起带过来。
跑一次脚本,几秒钟就能把几百篇论文全部导入Obsidian。导入之后,这些论文就成了上一篇文章里AI筛选流程的输入。
整个链路串起来
把这篇和上一篇连起来看,完整的文献获取链路是这样的:
DEVONthink订阅RSS → 新论文自动推送(标题+摘要)→ 关键词智能规则初筛 → 脚本导入Obsidian → AI相关性评分+角色分配 → Zotero/外部搜索/引文追踪补充 → 最终50篇核心文献
前半段(RSS到Obsidian)是被动积累,不需要你每天花时间,设置好之后自动运行。后半段(AI筛选到最终50篇)是主动筛选,需要你在关键节点做判断。
两段加在一起,从"期刊发表新论文"到"拿到50篇核心文献的结构化清单",整个过程中你真正需要动手的只有三件事:设计关键词、在每轮补充搜索时选择纳入哪些论文、以及定期跑一次导入脚本。
一个容易忽略的好处
这套RSS订阅的方法还有一个附带好处:它帮你建立了对研究领域的持续感知。
每周花十分钟扫一眼DEVONthink里的新推送,不需要每篇都读,只看标题就够了。看多了你会发现,某个方向突然多了很多论文,说明这个方向正在变热;某个方法开始频繁出现在不同期刊上,说明它正在成为主流。
这种对领域动态的感知,是定期搜索给不了你的。搜索是"我想找什么就搜什么",RSS是"领域里在发生什么我都能看到"。前者是窄视野,后者是宽视野。
文献库建好了,筛选流程跑完了,下一步是最耗时的环节:逐篇精读。五十篇核心文献,每篇要提取核心观点、研究方法、理论依据、主要结论、关键变量、因果机制、研究局限,七个维度。
继续阅读
需要系统训练时
把一条公开方法,练成可以反复使用的科研流程
公开文章先解决一个具体判断;课程继续连接研究问题、文献判断、理论假设和方法骨架,并形成可复用的研究设计档案。