对标教材:单元 3(探索阶段)
阶段定位:探索——“查明白”
承接:第 2 章的research_question.md(种子文件)→ 本章用文献修正并深化它
学习目标
完成本章后,你应当能够:
- 说出文献回顾三目的(知识现状 / 关键作者文章理论 / 知识缺口),并能在自己的综述里指出对应的三个部分
- 独立完成 Zotero 全流程五大动作:入库 → 组织 → 补全文 → 引用 → 导出
- 用“概念矩阵”(conceptual matrix)组织 30 篇文献,并从空白格与矛盾处读出研究缺口
- 用精读五要素(问题 / 理论 / 方法 / 发现 / 贡献与局限)拆解一篇本方向经典论文
- 用选题三问(gap / 数据可得性 / 能力圈)收敛出 1 个候选题目,产出
one_page_proposal.md
💡 本章是全手册“体力活”最集中的一章——约七成时间在读文献、建库、填矩阵。这种投入,决定你后面是在做研究还是在返工。
本章产出物(三件)
| 产出物 | 文件名 | 说明 |
|---|---|---|
| 文献库 | rural_finance_30papers.bib | ≥30 篇经核实的参考文献,由 Zotero 导出 |
| 概念矩阵 | concept_matrix.xlsx | 30 行 × 5 列(样本 / 方法 / 核心发现 / 理论贡献 / 局限) |
| 选题卡 | one_page_proposal.md | 一页纸研究计划,八栏 |
📌 三方向命名建议:农金方向
rural_finance_30papers.bib;风险管理/保险方向agri_insurance_30papers.bib;金融理论与政策方向fin_theory_30papers.bib。
本章工具(先确认,再学习)
- Zotero 10(主轴)+
cli-anything-zotero(命令行桥) - 三个 MCP:
nber-cli-mcp/scansci-pdf/zenodo-mcp - 两个 Skill:
arxiv/litreview
如果第 1 章你还没装齐,现在装也来得及——本章每一节都配了自检命令。
§3.1 文献回顾三目的与检索策略
一句话直觉
文献回顾不是“证明我读过书”,而是摸清战场地形:谁打过、怎么打的、哪块地还没人占。
教材单元 3 把研究的第一阶段称为探索阶段,其中文献回顾有三个明确目的(参见教材单元 3“研究的下一阶段是要对感兴趣的领域进行文献回顾”):
| # | 教材原意 | 你要回答的问题 | 落到综述的哪一节 |
|---|---|---|---|
| 1 | 了解知识现状(state of knowledge) | 这个领域已经研究了什么?主流结论是什么?有没有分歧? | 第一部分:研究进展梳理 |
| 2 | 识别关键作者、文章和理论 | 谁在这个领域有影响力?哪几篇绕不开?用了什么理论? | 第二部分:理论基础与代表性文献 |
| 3 | 发现知识缺口(knowledge gap) | 还有什么没被研究?哪里做得不够? | 第三部分:研究述评与缺口 |
⚠️ 最常见的错误:只完成了目的 1(把读过的文献复述一遍),没做目的 3。这样的综述在导师眼里叫“文献堆砌”,在审稿人眼里叫“缺乏贡献”。目的 3 才是文献回顾的真正产出——它直接变成你的选题(§3.7)。
检索策略:三步滚雪球
不要一上来就搜“数字普惠金融 农户收入”、按被引量排序、下载 50 篇——那样你会淹死在文献里,而且一定漏掉关键文章。正确顺序是:
第一步 · 从综述入手(先拿地图)
找 2-3 篇高质量的近期综述(review / survey / 研究进展 / 文献述评)。综述已经帮你把领域地图画好了。
- 中文:知网搜“数字普惠金融 研究进展”“农业保险 综述”,优先看《经济研究》《管理世界》《中国农村经济》《金融研究》上的综述文章
- 英文:Google Scholar 搜
review/literature review/survey;或直接翻 Journal of Economic Literature、Annual Review of Financial Economics
第二步 · 顺藤摸瓜(参考文献回溯 + 施引追踪)
拿到一篇好文章后,做两个方向的追踪:
- 往回看(backward):读它的参考文献表,找出被反复引用的 5-8 篇——这些是领域的“祖师爷”文章(服务目的 2)
- 往前看(forward):在 Google Scholar 点 “Cited by”,看谁引用了它——这些是最新进展(服务目的 1)
第三步 · 关键词扩展(补漏)
用前两步积累的术语扩展检索式。特别注意同义词、上下位词、中英对照:
| 中文关键词 | 英文关键词 | 上位/相关概念 |
|---|---|---|
| 数字普惠金融 | digital financial inclusion | financial inclusion / fintech |
| 农户信贷可得性 | rural credit access | credit rationing / financial exclusion |
| 农业保险 | agricultural insurance / crop insurance | index insurance / weather derivatives |
| 金融素养 | financial literacy | financial capability / financial knowledge |
| 货币政策传导 | monetary policy transmission | credit channel / interest rate channel |
💡 教材单元 3 特别提醒:文献回顾“不应局限于几种期刊上的文章、几年内的文章,或者运用特定的研究方法的文章”。新手最常见的偏食是——只读实证回归的文章,不读理论模型和案例研究,结果综述视角单一。
金融研究的特殊性:中英文双轨检索
这是本手册相对通用方法论教材必须补上的一条。做中国金融问题研究:只查英文库会被审稿人一票否决;只查中文库则无法与国际对话。
| 轨道 | 主要来源 | 你必须从中拿到什么 |
|---|---|---|
| 英文轨(SSCI) | NBER 工作论文、JF / RFS / JBF、Journal of Development Economics、World Development、Agricultural Economics | 理论框架、识别策略、国际前沿与最新分歧 |
| 中文轨(CSSCI) | 知网 / 万方 / 维普(学校 VPN)、《经济研究》《管理世界》《金融研究》《中国农村经济》《数量经济技术经济研究》 | 中国制度背景、政策演进时点、本土理论对话 |
双轨的具体分工:
- 用英文文献确定理论与方法(例如金融排斥理论、DID 识别策略、工具变量选择)
- 用中文文献确定制度背景与政策时点——例如“数字乡村发展战略”“三大粮食作物完全成本保险试点”具体哪年、在哪些县推开。这是做 DID 的命脉,时点搞错整篇论文作废
- 综述里两轨都要出现,并说明国内研究相对国际研究推进了什么、还差什么——这正是第 2 章 §2.6“国内研究脉络意识”的落地
📌 关于知网:本手册不集成 CNKI 自动化工具(合规考虑)。中文文献请通过学校图书馆 VPN 手动检索,再导入 Zotero。一句话流程:知网检索 → 导出 Refworks/NoteExpress 格式 → Zotero 导入 → 逐条手动核对题录。
§3.2 检索源矩阵 5 件套
第 1 章你已经装好了 MCP / Skill / CLI 三类工具。这一节告诉你做文献回顾时该用哪几个。下面五个是本手册主线的“检索源矩阵”:
| 工具 | 类型 | 覆盖范围 | 适用场景 | 调用方式 |
|---|---|---|---|---|
nber-cli-mcp | MCP | NBER 工作论文(经济/金融顶刊的预印本池) | 前沿追踪、找最新工作论文 | search_papers / get_paper_info / download_paper |
scansci-pdf | MCP | 已发表论文全文 PDF(多源路由) | 拿到题录后补全文 | scansci_pdf_search / scansci_pdf_resolve_and_download / scansci_pdf_zotero_push |
zenodo-mcp | MCP | 开放数据集 + 预印本 + 复现代码 | 找可复现数据、找别人的复现包 | search_records / get_metadata / get_citation / list_files |
arxiv | Skill | arXiv(量化金融 q-fin、经济物理、机器学习方法) | 方法论文预印本 | /arxiv |
litreview | Skill | Consensus 学术搜索引擎 + PICO/SPIDER 检索框架 | 快速搭建综述骨架 | /litreview |
各工具实操要点
① nber-cli-mcp——追前沿
NBER 工作论文是美国经济金融学界“预出版”的主渠道,JF / QJE / AER 上的文章很多先在 NBER 挂出。适合你在开题阶段问:“这个题目国际上最近两年谁在做?做到哪一步了?”
search_papers:按关键词搜索,支持日期过滤(例如只要 2024 年之后的)与分页get_paper_info:先看摘要和作者,判断值不值得下载download_paper:下载 PDF 到本地论文库
② scansci-pdf——补全文
你手里有一串 DOI 但打不开(付费墙)时的第一选择。它的特点是多源路由:依次尝试多个来源直到拿到 PDF。
- ⚠️ 实测提示:单条下载比批量下载稳定。批量接口的参数包装有陷阱,新手容易反复失败
- ⭐ 独门能力:
scansci_pdf_zotero_push可把下载到的 PDF 直接推进 Zotero 对应条目,省去手动拖拽
③ zenodo-mcp——找数据
Zenodo 是 CERN 运营的开放仓库,大量经济学/农经论文的复现数据与代码存放在这里。
- 什么时候用:你想做可复现研究;或者想找一个别人已清洗好的数据集练手(对接第 6 章“数据来源全景”)
get_citation直接给出规范引用格式——用了别人的数据集就必须引用,这是数据伦理,也是 S6.1 的留痕要求
④ arxiv——找方法
量化金融方向(资产定价、高频交易、机器学习预测)必读 arXiv 的 q-fin 分区。
- ⚠️ arXiv 上的文章大多未经同行评审,引用时必须标 “working paper” 或 “preprint”,不能当已发表论文引
⑤ litreview——快速搭骨架
基于 Consensus 引擎(用 AI 从真实论文中抽取结论)+ PICO/SPIDER 检索框架,产出一份 Word 格式的“研究指南”。
- 它的自我定位是“发射台”(launching pad):让你快速对一个陌生领域建立信心,不是成品综述
- 正确用法:跑一遍 → 拿到候选文献清单 → 逐条用 Zotero 核实(S3.1)→ 再去读原文
中文文献怎么办
上面五件套几乎不覆盖中文 CSSCI 文献。中文轨请走:
- 知网(CNKI)/ 万方 / 维普:通过学校图书馆 VPN 访问
- 国家哲学社会科学文献中心(ncpssd.org):部分期刊提供全文
- 各期刊官网:《经济研究》《管理世界》等有自己的网站
流程:中文库手动检索 → 导出题录(Refworks / NoteExpress / EndNote 格式)→ Zotero 导入 → 逐条核对(作者、年份、刊名、期号、起止页码)。
⚠️ 手动导入的中文题录错误率很高,尤其是刊名缩写、期号、页码。参考文献里写“《金融研究》2021 年第 3 期”而实际是第 5 期,是最容易被审稿人抓住的低级错误。导入后请对照知网页面逐条核。
关键认知:每种工具都有盲区
| 工具 | 盲区 |
|---|---|
nber-cli-mcp | 只有 NBER;不含欧洲/亚洲工作论文;完全不含中文 |
scansci-pdf | Wiley / OUP / Emerald / SSRN 等绕不过(见 §3.4 黑名单) |
zenodo-mcp | 以数据集与复现包为主,期刊论文覆盖有限 |
arxiv | 几乎没有传统金融/农经的实证文章 |
litreview | 依赖 Consensus 索引,中文文献极少 |
结论:任何单一检索源都不足以支撑一次合格的文献回顾。交叉使用是原则——至少覆盖四类来源:英文工作论文 + 英文已发表论文 + 中文 CSSCI + 数据仓库。
💡 本机全部 13 个学术 MCP + 45 个学术 Skill 的清单见附录 E;工具盘点的原始实测记录见
handbook_assets/references/本机学术工具盘点_2026-09-21.md。
§3.3 Zotero 10 环境与全流程
Zotero 是本手册的主轴文献工具——从第 3 章建库,到第 11 章论文写作插引用,全程用它。不用 Zotero 也能做研究,但你会在参考文献格式上白白耗掉几十个小时。
环境确认(教师机实测)
| 组件 | 版本 / 路径 | 作用 |
|---|---|---|
| Zotero 桌面端 | 10.0.1,/Applications/Zotero.app,数据目录 ~/Zotero | 主程序 |
cli-anything-zotero | /opt/homebrew/bin/cli-anything-zotero | 命令行桥(AI 可调用) |
| CLI Bridge 插件 | cli-bridge@cli-anything.dev | 让命令行与桌面端通信 |
| Better BibTeX | 插件 | 引用键(citekey)管理、.bib 导出 |
| jasminum(茉莉花) | 插件 | 中文文献元数据抓取 |
| zotero-pdf-translate | 插件 | PDF 划词翻译 |
| better-notes | 插件 | 双链笔记 |
三条自检命令:
cli-anything-zotero app doctor # 环境自检
cli-anything-zotero app status # 连接状态
cli-anything-zotero item list # 能否读到库内条目三条都有正常输出,说明“桌面端 + 命令行桥”通了。如果 item list 报连接错误,先确认 Zotero 桌面端正在运行——CLI 桥依赖桌面端进程。
五大动作
Zotero 的使用可以压缩成五个动作。请按顺序完整练一遍。
动作 1 · 入库(把文献变成 Zotero 条目)
| 方式 | 命令 / 操作 | 说明 |
|---|---|---|
| DOI 自动抓取 | cli-anything-zotero add doi 10.1016/j.jdeveco.2020.102471 --fetch-pdf | 最推荐:元数据准确,--fetch-pdf 顺手抓全文 |
| arXiv 编号 | cli-anything-zotero add arxiv 2301.12345 --fetch-pdf | 量化金融方向常用 |
| BibTeX 批量 | cli-anything-zotero add bibtex myrefs.bib | 导入别人给的 .bib(如课程讲义的 merged_all_references.bib) |
| URL | cli-anything-zotero add url https://... | 网页、政策文件、统计公报 |
| PDF 拖入 | 直接把 PDF 拖进 Zotero 窗口 | 拖入后右键 →“重新抓取 PDF 元数据” |
| 手动录入 | 工具栏“新建条目” | 无 DOI 的中文老文献、内部资料 |
💡
add doi ... --fetch-pdf这一条命令做了两件事:① 通过 DOI 解析抓取完整题录元数据;② 尝试自动下载开放获取的 PDF。这就是本手册推荐的“入库标准动作”。
动作 2 · 组织(让 300 篇文献还找得到)
- Collection(分类)= 按项目分:
硕士论文/、课程作业-农村金融/、投稿-农业保险/。一篇文献可同时属于多个 Collection - Tag(标签)= 按主题分:
#数字普惠金融、#DID、#待精读、#已引用。标签跨项目复用,是检索主力 - 笔记:每条文献下挂一条笔记,写三件事——这篇为什么重要 / 核心结论一句话 / 我能用它的哪部分。不写笔记的文献等于没读
cli-anything-zotero collection create --name "硕士论文"
cli-anything-zotero collection list
cli-anything-zotero item tag --key ABCD1234 --add "待精读"
cli-anything-zotero note add --key ABCD1234 --body "核心结论:数字金融通过缓解信贷约束提高农户收入"动作 3 · 补全文(有题录没 PDF = 半成品)
cli-anything-zotero item fetch-pdf --key ABCD1234 # 单条:OA 级联抓取
cli-anything-zotero collection fetch-pdfs --name "硕士论文" # 整分类批量补抓不到的走 §3.4 的五招。Better BibTeX 会同时自动补全缺失的元数据字段(卷、期、页码等)。
动作 4 · 引用(写作时插入引文)
| 场景 | 做法 |
|---|---|
| Word | Zotero Word 插件 → Add/Edit Citation → 选条目 → 自动按目标期刊格式排版 |
| LaTeX | Better BibTeX 自动维护 .bib,正文用 \cite{citekey} |
| Markdown / Quarto | 用 citekey:@smith2020;渲染时 pandoc --citeproc --bibliography=refs.bib |
| 命令行取引用 | cli-anything-zotero item citation --key ABCD1234 |
| 生成国标参考文献 | cli-anything-zotero item bibliography --key ABCD1234 --style "GB/T 7714" |
| Word 引用管线 | cli-anything-zotero docx cite(把 {{zotero:ITEMKEY}} 占位符替换为真实引用字段) |
动作 5 · 导出(交付给导师 / 期刊 / 合作者)
# 导出整个分类为 BibTeX(供 LaTeX / Quarto)
cli-anything-zotero export bib --collection "硕士论文" \
--format bibtex --output rural_finance_30papers.bib
# 导出指定条目
cli-anything-zotero export bib --items ABCD1234,EFGH5678 \
--format biblatex --output subset.bib桌面端等价操作:选中条目 → 右键 → 导出条目 → 选 BibTeX(供 LaTeX)或 RIS(供其他文献软件)。
三个进阶命令(省时间神器)
| 命令 | 作用 | 什么时候用 |
|---|---|---|
item semantic-search --query "..." | 本地语义搜索(不联网、免费) | “我库里有没有讲信贷配给的文章?”——比关键词搜索准得多 |
item search-fulltext --query "..." | PDF 全文检索 | 想找“哪篇文章里提到过某个具体政策文件名” |
item duplicates + item merge | 查重与合并 | 库超过 200 条后必做,否则同一篇文章存在三个版本 |
本章练习(跟做)
- 新建 Collection
文献回顾练习 - 用 DOI 方式入库 3 篇英文文献(带
--fetch-pdf),用手动方式入库 1 篇中文文献 - 给 4 篇都打标签
#待精读,每篇写一条两句话笔记 - 跑一次
item semantic-search --query "digital finance rural income",看能否命中 - 导出为
.bib,用文本编辑器打开,逐条检查字段是否完整(作者/年份/刊名/卷期页码/DOI)
📌 完成后你的库里应有 4 条带 PDF、带笔记、带标签的条目。这就是后面 30 篇的雏形。
§3.4 PDF 获取避坑 5 招
“找不到全文”是研究生最常见的挫败感来源。好消息:绝大多数学术论文都能合法拿到。坏消息:方法不对的话,你会白白浪费一整天。
五招(按优先级顺序试)
招 1 · 学校 VPN / WebVPN 优先
最合法、最稳定、成功率最高。学校图书馆订购了知网、万方、维普、Elsevier(ScienceDirect)、Springer、Wiley、Taylor & Francis、EBSCO 等主流数据库。
- 校内 IP 直接访问;校外走 WebVPN
- ⚠️ WebVPN 会改写 URL(加编码前缀)。从 WebVPN 页面复制出来的链接不能直接分享,也别粘给自动化工具——它会失效
- 找不到的库:走图书馆“文献传递”服务(CALIS / 国家科技图书文献中心 NSTL),一般 1-3 个工作日到手
招 2 · scansci-pdf MCP 搜索(多源路由)
scansci_pdf_search --title "Digital finance and rural income"
scansci_pdf_resolve_and_download --doi 10.1016/j.jdeveco.2020.102471
scansci_pdf_zotero_push --doi 10.1016/j.jdeveco.2020.102471 # 直接推进 Zotero多源路由的意思是:它会依次尝试多个来源直到拿到 PDF。实测单条比批量稳定(批量接口的参数包装有陷阱)。
招 3 · 作者主页 / ResearchGate 直接索取
- 很多教授把全部论文挂在自己主页(尤其美国高校)。Google 搜
"论文完整标题" filetype:pdf常能直接命中 - ResearchGate 有 “Request full-text” 按钮,作者通常一周内会发给你
- 直接发邮件给作者索取是学术界完全正常、甚至被鼓励的行为。邮件三句话即可:自我介绍 → 说明你为什么对他的文章感兴趣 → 请求 PDF。这比你想的容易得多,而且经常能开启一段学术联系
招 4 · Google Scholar “All versions”
在 Google Scholar 搜索结果右侧找 [PDF] 标记,或点标题进详情页看 “All versions”。里面常有:机构知识库版、作者自存档版、PMC 版。
补充一招——用 OpenAlex API 查所有开放副本位置:
curl -s "https://api.openalex.org/works/doi:10.1016/j.jdeveco.2020.102471" \
| jq '.locations[] | {landing_page_url, is_oa, pdf_url}'招 5 · NBER / SSRN / RePEc 工作论文版
期刊正式版常要付费,但工作论文版通常免费且内容九成一致。
- NBER:
https://www.nber.org/system/files/working_papers/{编号}/{编号}.pdf(curl可直下,成功率极高) - SSRN:需注册登录,但下载免费
- RePEc / IDEAS:经济学工作论文总索引
⚠️ 引用规范:如果你读的是工作论文版,引用时要么标 “NBER Working Paper No. xxxxx”,要么去核对正式版有无实质修改(版本年份、期刊、卷期页码都不同)。绝不能读了工作论文版却引用正式版的页码——页码对不上属于引用不实(关联 S3.2)。
绕不过的黑名单(别浪费时间)
以下出版社反爬强度高,自动化工具基本失败,只能走机构 WebVPN 或图书馆:
| 出版社 | 拦截方式 |
|---|---|
| Wiley | Cloudflare 挑战 |
| Oxford University Press | Cookie 挑战 |
| Emerald | JS 挑战 |
| Preprints.org | Akamai |
| SSRN | SSL 拒绝 + 登录墙 |
下载后必做:两步验证
反爬网站常返回一个几 KB 的 HTML 页面,文件名却叫 .pdf。看起来下载成功了,打开是乱码或空白。
第一步 · 文件类型验证:
head -c 4 论文.pdf
# ✅ 必须返回:%PDF
# ❌ 返回 <!DO 或 <htm → 这是 HTML 假文件,下载失败
ls -lh 论文.pdf
# 正常学术论文一般 300KB - 5MB;小于 20KB 高度可疑第二步 · 内容一致性验证:打开 PDF 首页,核对三件事是否与 Zotero 条目一致:
- [ ] 标题一致(注意副标题、版本号)
- [ ] 作者一致(拼写、顺序、通讯作者)
- [ ] 年份与期刊一致(会议版 vs 期刊版最容易混)
🔑 为什么要这么较真?因为参考文献错配是最隐蔽的学术不端。你以为引的是 A 文章,实际下载的是 B 文章(同名、同作者不同年、会议版 vs 期刊版),写综述时把 B 的结论挂在 A 名下——这正是 S3.1 要防的事。
安全与合规提醒
- ❌ 不从来路不明的“论文下载站”“免费文献网”下载——这类站点常捆绑恶意软件、勒索程序,或返回被篡改的 PDF
- ❌ 不使用“上传一篇才能下载一篇”的互惠分享站(这本身侵犯版权,而你上传的可能是导师的未发表稿件)
- ✅ 合法路径优先级:机构订阅 → 开放获取(OA)→ 作者自存档 → 直接向作者索取
§3.5 概念矩阵综述法
一句话直觉
流水账综述说的是“我读了什么”,概念矩阵说的是“这个领域缺什么”。前者只能凑字数,后者能直接生出选题。
教材单元 3 明确建议:文献回顾“可以以表格的形式对回顾的文献进行总结,也可以用组织框架(概念矩阵,conceptual matrix)的形式进行总结”。这是本章要你重点掌握的方法。
什么是概念矩阵
一张表,两条规则:
- 行 = 文献(每篇论文一行)
- 列 = 核心构念 / 比较维度(每篇都填同一组格子)
列的选择取决于你的研究目的。通用五列:
| 列 | 填什么 | 为什么要这一列 |
|---|---|---|
| 样本 | 谁、多少、哪年、哪个地区 | 判断结论能否推广到你的情境(外部效度,回指第 4 章 §4.2) |
| 方法 | OLS / FE / IV / DID / PSM / RDD / 案例 / 仿真 | 判断该领域的“方法水位”,你要不要跟上 |
| 核心发现 | 一句话结论 + 关键系数或效应量 | 综述的实质内容 |
| 理论贡献 | 这篇推进了什么理论或视角 | 找到你要对话的对象(服务目的 2) |
| 局限 | 作者自己承认的 + 你看出来的 | 缺口就藏在这里(服务目的 3) |
示例矩阵(农村金融方向,5 篇 × 5 列)
⚠️ 下表为教学示例,文献信息为演示格式,请勿直接引用。你要做的是用自己核实过的真实文献填一张同样结构的表。
| # | 文献 | 样本 | 方法 | 核心发现 | 理论贡献 | 局限 |
|---|---|---|---|---|---|---|
| 1 | 作者甲(2022)《金融研究》 | 2011—2020 年中国 31 省面板 | 双向固定效应 + 中介效应 | 数字普惠金融显著缩小城乡收入差距,信贷渠道贡献最大 | 把金融排斥理论扩展到数字场景 | 省级数据掩盖省内差异 |
| 2 | 作者乙、作者丙(2023)《中国农村经济》 | 2019 年 5 省 1200 户农户调查 | Probit + IV(同村平均使用率) | 数字金融使用提高农户正规信贷可得性 8.3 个百分点 | 引入“数字足迹”作为信息不对称的替代机制 | 截面数据难以识别因果 |
| 3 | 作者丁(2021)《经济研究》 | 数字普惠金融指数 + 县域数据 | DID(试点政策) | 试点县创业活跃度上升 12% | 政策评估视角 | 试点选择非随机,平行趋势存疑 |
| 4 | Smith & Lee (2023) World Development | 印度 3 邦农户面板 | RCT | 移动支付推广改善消费平滑,但对收入无显著影响 | 区分“平滑”与“增收”两类效应 | 单一国家情境 |
| 5 | Zhang (2024) Agricultural Economics | 中国家庭金融调查 CHFS | FE + PSM | 数字金融对低收入组边际效应更大 | 异质性视角 | 未考虑数字素养门槛 |
从这张表你能立刻读出三个 gap(空白格与矛盾处):
- 样本 gap:5 篇里 3 篇是省级或县级宏观数据,缺少农户层面的长期追踪面板——你能不能做一个 3 年追踪?
- 方法 gap:只有 1 篇用了 RCT,唯一的 DID 平行趋势存疑——更干净的识别策略(工具变量、断点)是空间
- 情境 gap:国际证据(印度)显示“平滑有效、增收无效”,中国证据几乎都说“增收有效”——这个分歧本身就是选题(为什么中国不一样?)
💡 这就是概念矩阵的威力:gap 不是你“想”出来的,是从表格的空白格和矛盾处“读”出来的。流水账综述做不到这一点,因为它的信息是线性的、不可比的。
与流水账综述的对照
| 维度 | 流水账综述 | 概念矩阵 |
|---|---|---|
| 组织方式 | 按时间,或“张三说…李四说…” | 按维度(列)横向对比 |
| 可比性 | 差——每段结构不同,无法比较 | 强——同一列直接对齐 |
| 缺口识别 | 靠作者主观断言“研究尚不足” | 从空白格 / 矛盾处客观读出 |
| 写作难度 | 低(易上手,也易注水) | 中(要先想清楚比较维度) |
| 审稿人评价 | “文献堆砌,缺乏述评” | “梳理清晰,缺口有说服力” |
重要提醒:概念矩阵是你的工作工具,不是论文里的最终形态。论文中的文献综述仍然是连贯段落,但段落的组织逻辑来自矩阵的列——例如按“方法演进”或“结论分歧”分段,而不是按作者姓氏笔画。
AI 辅助填表流程(S3.1 必守)
Step 1(AI) 把 30 篇的摘要/PDF 分批喂给 AI,让它按五列抽取
Step 2(人工)逐格核对——尤其是“核心发现”里的数字和“方法”一栏
Step 3(人工)补上 AI 抽不出来的东西——理论贡献的判断、你自己看出的局限
Step 4(人工)从填好的矩阵里找空白格与矛盾,写出 gap为什么 Step 2 不能省:AI 抽取“核心发现”时最高频的三类错误是——① 把摘要里的背景句当成结论;② 数字或系数抄错、甚至凭空补一个;③ 把作者写的“未来研究方向”当成“已有发现”。这三类错误一旦进了你的综述,就构成 S3.1 定义的引用不实。
产出物
| 文件 | 内容 | 提交对象 |
|---|---|---|
rural_finance_30papers.bib | ≥30 篇经核实文献(Zotero 导出) | 导师 |
concept_matrix.xlsx | 30 行 × 5 列概念矩阵 | 导师 / 自己开题用 |
📌 方向不同,矩阵的“列”也应不同:
- 风险管理/保险方向:建议加一列“保险产品类型”(成本保险 / 完全成本保险 / 收入保险 / 指数保险)
- 金融理论与政策方向:建议加一列“理论流派”(货币主义 / 凯恩斯主义 / 新结构经济学 / 金融功能观)
- 农村金融方向:建议加一列“分析层级”(农户 / 村 / 县 / 省)
§3.6 论文精读五要素 + 综述写作
精读五要素
矩阵填的是“广度”,精读练的是“深度”。从 30 篇里挑 3-5 篇最核心的,用五要素拆一遍。拆完这 5 篇,你对这个领域的理解会超过大多数同级同学。
| # | 要素 | 你要回答的问题 | 拆不清的后果 |
|---|---|---|---|
| 1 | 研究问题 | 这篇到底在问什么?是 What / Why / How 哪一类?(回指第 2 章句式) | 你自己选题时会问出模糊的问题 |
| 2 | 理论框架 | 基于什么理论?核心构念有哪几个?构念之间什么关系? | 你的综述没有理论主线 |
| 3 | 方法设计 | 样本从哪来?变量怎么测?用什么识别策略?为什么它能解决内生性? | 你看不懂别人的表,也设计不出自己的 |
| 4 | 核心发现 | 主结论一句话 + 关键系数(方向、大小、显著性)+ 机制检验结果 | 你引用时会引错 |
| 5 | 贡献与局限 | 相对前人推进了什么?作者承认哪些不足?你还能看出哪些不足? | 你找不到 gap |
精读笔记模板(每篇一份,存为 Zotero 笔记或独立 md 文件):
# 精读笔记:{作者} {年份} {标题}
## 1 研究问题
- 原文表述(引一句话,标页码):
- 类型:□What □Why □How
- 我的复述(不抄原文):
## 2 理论框架
- 理论基础:
- 核心构念:A___ B___ C___
- 逻辑链(A→B→C 为什么成立):
- 理论框架图(手绘或 mermaid):
## 3 方法设计
- 数据来源 / 样本量 / 时间跨度:
- 被解释变量与测法:
- 核心解释变量与测法:
- 识别策略:□OLS □FE □IV □DID □PSM □RDD □其他___
- 为什么这个策略可信(作者怎么处理内生性):
- 我的质疑(如果有):
## 4 核心发现
- 主结论一句话:
- 关键系数:变量___ 系数___ 标准误___ 显著性___
- 机制 / 异质性结果:
- 稳健性检验做了哪些:
## 5 贡献与局限
- 相对前人的贡献:
- 作者承认的局限(引原文页码):
- 我看出的局限:
- 对我研究的启发(可直接用 / 可批判 / 可扩展):💡 与第 10 章的关系:这里练的是实证型论文的精读。第 10 章还会讲案例型论文的精读法(Eisenhardt 八步)与理论型论文的精读法(例如 Diamond-Dybvig 1983 银行挤兑模型),三者互补。
综述写作三件套
有了矩阵和精读笔记,综述怎么落成文字?三种组织方式,可以混用。
① 主题式组织(最常用)
按矩阵的“列”或按理论分支分段,而不是按作者。
2.1 数字普惠金融的测度(谁测过、怎么测、有什么分歧)
2.2 数字金融与农户收入:证据与分歧
2.3 作用机制研究:信贷渠道 / 信息渠道 / 创业渠道
2.4 述评与研究缺口② 时间线梳理(适合方法或政策演进明显的领域)
第一阶段(2010 年前):金融排斥理论奠基
第二阶段(2011—2016):普惠金融政策化,测度体系建立
第三阶段(2017 至今):因果识别精细化,从“相关”走向 DID / IV③ 方法论对比(适合实证方法争议大的领域)
按“用什么方法 → 得出什么结论 → 方法差异能否解释结论分歧”来组织。这是最容易写出深度的方式,也最能体现你的方法素养。
AI 腔自检
综述是最容易被 AI 腔污染的地方。以下是必须删掉或改写的表达:
| ❌ AI 腔 / 空话 | 问题在哪 | ✅ 改法 |
|---|---|---|
| “XX 学者深入探讨了……” | “深入”是你的评价还是空话? | “XX(2022)用 DID 估计了……,系数为 0.12” |
| “具有重要的理论和现实意义” | 每篇都重要 = 没有一篇重要 | 说清对谁重要、在哪个环节重要 |
| “国内外学者对此进行了大量研究” | 大量是多少?谁? | “国内至少 12 篇 CSSCI 论文(2020—2024)……;国际方面……” |
| “取得了丰富的研究成果” | 零信息量 | 直接说结论分歧在哪 |
| “综上所述,已有研究仍存在不足” | 不足在哪必须具体 | “已有研究存在三点不足:① 样本多为省级……② 识别策略……③ ……” |
| “为本文的研究提供了有益的借鉴” | 套话 | “本文在 XX 的基础上,把样本下沉到农户层面” |
判别口诀:一句话里如果没有具体的作者、年份、方法、数字或结论,它就是空话——删掉或改写。
📌 第 11 章会系统讲学术风格与 AI 披露。这里先记住一条:综述的每一句话都应该能被追溯到概念矩阵里的某一格。
§3.7 选题三问 → one_page_proposal.md
文献读完了,矩阵填好了,现在要收敛。30 篇文献能生出 20 个候选题目,你只能做 1 个。用三问筛。
问 1 · Gap:文献中什么没被研究?
来源:概念矩阵的空白格与矛盾处(见 §3.5)。三种典型 gap:
| gap 类型 | 特征 | 例子 |
|---|---|---|
| 样本 / 情境 gap | 结论在一个情境成立,另一个情境没人验 | 数字金融的增收效应在印度不显著,那在中国西南山区呢? |
| 方法 gap | 已有研究识别策略弱,你能做更干净的 | 前人用截面 Probit,你能做 DID(有明确政策时点) |
| 机制 gap | 主效应已知,但“为什么”没打开 | 已知数字金融提高农户收入,但走的是信贷、创业还是汇款渠道? |
⚠️ 不算 gap 的三种“伪 gap”:
- “还没人研究过 A 县” —— 换个地名不是学术贡献
- “数据更新到 2024 年” —— 延长时间不是贡献(除非期间发生了结构性变化,且你能说清是什么变化)
- “国内还没有相关研究” —— 可能只是因为这个题目不重要,或者你搜得不够(先回去查知网)
问 2 · 数据可得性:数据从哪来?你拿得到吗?
这是最容易让选题胎死腹中的一问,必须现在就查清楚,不要拖到第 6 章。
自查清单:
- [ ] 用什么数据?(公开数据库 / 问卷调查 / 访谈 / 机构内部数据)
- [ ] 如果是公开库:已经下载到手了吗?(不是“应该能下到”)
- [ ] 如果是问卷:需要多少样本?谁帮你联系调研点?预算够吗?(第 7 章详解)
- [ ] 如果是机构数据:你有授权吗?能公开发表吗?(涉密就别碰)
- [ ] 关键变量的测度在数据里存在吗?(例如你想研究“数字足迹”,但数据库里根本没这个字段)
💡 铁律:没有数据的选题不是选题,是幻想。第 6 章会给你完整的数据源全景图,但这一问现在就要有一个初步答案。
问 3 · 能力圈:你的方法论储备够吗?
- [ ] 需要的计量方法我学过吗?(对照第 9 章清单:OLS / FE / IV / DID / PSM / RDD / ABM)
- [ ] 如果没学过:一学期内补得上吗?有教材、课程、师兄师姐可问吗?
- [ ] 需要的软件我会用吗?(Stata / R / Python)
- [ ] 需要的数理基础够吗?(结构模型、DSGE、ABM 对数理功底要求更高)
⚠️ 能力圈不是让你只做简单的——而是让你在开题时诚实评估成本。选一个需要现学 IV + RDD 的题目,意味着你的时间预算要翻倍。
三问交叉:候选题目评分表
| 候选题目 | Gap 强度(1-5) | 数据可得性(1-5) | 能力圈匹配(1-5) | 总分 | 决定 |
|---|---|---|---|---|---|
| 题目 A | |||||
| 题目 B | |||||
| 题目 C |
📌 总分最高的不一定选——但如果 gap 强度只有 2 分,即使数据和方法都完美,也难发表。gap 强度是一票否决项(低于 3 分建议换题)。
one_page_proposal.md 模板
把三问的结果压成一页纸。为什么只要一页?因为写不成一页,说明你还没想清楚。
# 一页纸研究计划(One-Page Proposal)
**姓名**:____ **方向**:□农金 □风险/保险 □金融理论 **日期**:____
**版本**:v0.1(第 3 章产出) **下一步升级**:research_design.md(第 4 章)
## 1 标题(暂定)
(不超过 25 字,含核心变量与情境。
❌ “数字金融研究”
✅ “数字普惠金融对农户收入的影响——基于 XX 省三年面板的 DID 证据”)
## 2 研究问题(一句话)
(用 What / Why / How 句式,标注类型。必须能被数据检验。)
## 3 理论对话对象
- 国际:____(作者 年份。你要支持、反驳还是扩展谁的结论?)
- 国内:____(作者 年份。本土理论脉络是什么?)
- 对话内容:他们认为___,我认为___,因为___
## 4 研究缺口(来自概念矩阵)
- gap 类型:□样本/情境 □方法 □机制
- 具体描述:已有研究___,但___尚未被检验
- 矩阵证据:(指出矩阵里哪个空白格 / 哪处矛盾支撑这个 gap)
## 5 数据来源(初步)
- 数据名称:____
- 是否已到手:□是(路径___) □否(获取计划___)
- 样本与时间跨度:____
- 关键变量可得性:X___ Y___ 控制变量___
## 6 方法路线(初步)
- 设计类型:□真实验 □准实验 □非实验(事后追溯)(第 4 章 §4.3 详解)
- 识别策略:□OLS □FE □IV □DID □PSM □RDD □案例 □仿真
- 预判的主要效度威胁:____(第 4 章 §4.2 七大威胁里挑 1-2 条)
## 7 预期贡献(一句话)
(不要写“填补空白”“具有重要意义”。写成下面三种之一:
本文把___的证据从___扩展到___;
本文用___策略纠正了___可能存在的偏误;
本文打开了___的机制黑箱。)
## 8 三问自查
- Gap 强度:__/5 数据可得性:__/5 能力圈:__/5
- 最大风险点(最可能让研究失败的一件事):____
- 备选方案(Plan B):____产出物与迭代链条
| 阶段 | 文件 | 新增内容 |
|---|---|---|
| 第 2 章 | research_question.md | 现象 + 问题 + 构念(种子) |
| 第 3 章(本章) | one_page_proposal.md | + gap + 数据 + 方法(八栏) |
| 第 4 章 | research_design.md | 升级为五栏完整方案 + 假说 + 理论框架图 |
| 第 5—6 章 | 同上迭代 | 补测量方案、数据细节与版本留痕 |
| 第 9—10 章 | 同上迭代 | 补实证结果、修正结论 |
🎯 把这三个文件都放进 Git(第 1 章 §1.5 五目录结构里的
docs/)。每次修改留 commit message,三个月后你会感谢自己。
🔧 AI 辅助研究栏
用法一:AI 抽取式概念矩阵(30 篇 × 5 列)
场景:你有 30 篇 PDF,手动读完填矩阵要一周。AI 预填 + 人工核对可以压到一天。
提示词模板(分批喂,一次 5 篇,多了会糊):
请阅读以下 5 篇论文的摘要与结论部分,为每篇提取五个字段,输出 Markdown 表格:
- 样本:研究对象、样本量、时间跨度、地区
- 方法:计量方法 / 识别策略(如 OLS、FE、IV、DID、PSM、RDD、案例、仿真)
- 核心发现:一句话结论 + 关键系数或效应量(若原文有具体数字,必须原样给出,不得估算)
- 理论贡献:相对前人推进了什么理论或视角
- 局限:作者自己承认的局限(请注明出自论文哪一节 / 哪一页)
附加要求:
- 任何字段若原文没有明确说明,填“未说明”,不要推测或补全
- 不要使用“深入探讨”“具有重要意义”等评价性空话
- 表格后附一段“你不确定或可能读错的地方”清单
为什么最后那条要求很关键:让 AI 主动标出不确定处,比让它假装确定安全得多。你会拿到一份“待核对清单”,核对效率大幅提升。
工作量对比:
| 方式 | 30 篇耗时 | 质量风险 |
|---|---|---|
| 纯手动精读填表 | 约 5—7 天 | 低,但人会疲劳出错、后期偷懒 |
| AI 预填 + 逐格人工核对 | 约 1 天 | 中——取决于你是否真的逐格核对 |
| AI 预填直接用 | 约 2 小时 | ❌ 极高,等同引用不实(S3.1) |
用法二:litreview / systematic-literature-review 跟做
场景:你要进入一个完全陌生的领域(例如导师突然让你做“气候金融”),需要在两天内建立基本认知。
跟做步骤:
Step 1 跑 /litreview,输入你的研究问题
→ 产出:PICO/SPIDER 检索式 + Consensus 检索结果 + 一份 Word 研究指南
Step 2 把它给的候选文献清单导出来,逐条用 Zotero 核实:
cli-anything-zotero add doi {DOI} --fetch-pdf
→ 加得进去的 = 真实存在
→ 加不进去的 = 存疑,去 Google Scholar / 知网二次确认
Step 3 对核实通过的文献,跑用法一的 AI 抽取矩阵
Step 4 如需正式系统综述,跑 /systematic-literature-review
→ 它走“多源检索 → 去重 → AI 评分 → 选文 → 专家写作”完整流程,输出 PDF + Word⚠️ 定位提醒:litreview 自己的说明写得很清楚——产出是“发射台”(launching pad),让你有信心 dive in,不是成品综述。直接把它交上去 = 学术不端(见第 11 章 AI 披露要求 S11.1)。
用法三:AI 辅助“这篇值不值得读”
场景:检索出 200 篇,你只有时间读 30 篇。
提示词模板:
以下是 20 篇论文的标题与摘要。我的研究问题是:[你的问题]。 请按相关性从高到低排序,并为每篇说明: ① 与我的研究问题的关联点(具体到构念或方法,不要泛泛而谈) ② 是否包含可用的实证证据(有数据、有系数 = 是) ③ 建议处理方式:精读 / 略读(只看结论)/ 仅引用(不读) 排序理由必须基于摘要内容,不要基于期刊名气或发表年份。
然后:AI 排完序,你自己再过一遍前 10 篇。AI 会漏掉那些“摘要写得平淡但方法极有价值”的文章,也会高估那些“摘要漂亮但与你无关”的文章。
本章 AI 用法三条纪律
- AI 只做抽取和排序,判断由你做——“这篇重不重要”“gap 在哪”是你的学术判断,不能让渡
- AI 填的每一格都必须核对原文——尤其是数字、系数、年份、页码
- AI 生成的文字不能直接进综述——它可以帮你搭骨架,血肉必须你自己写(第 11 章 AI 披露)
🛡️ AI 诚信栏
S3.1 AI 推荐文献必核实
红线:AI 推荐的任何一篇文献,在你把它写进综述或参考文献之前,必须确认它真实存在,且内容与你写的一致。
为什么这条排在五类 AI 不端之首
AI 会“推荐”根本不存在的论文——这叫幻觉引用(hallucinated citation)。它编造的方式非常狡猾:真实作者 + 貌似合理的标题 + 存在的期刊 + 编造的年份卷期页码。乍看无懈可击。
后果分级:
| 场景 | 后果 |
|---|---|
| 课程作业里出现 1 条虚构文献 | 该次作业零分 |
| 学位论文参考文献里出现虚构文献 | 按教育部 40 号令可认定为学术不端,情节严重可撤销学位 |
| 期刊论文里出现虚构文献 | 撤稿 + 学术声誉终结(近年国内外已有多起知名学者因此撤稿) |
而且被发现的概率远比你想象的高——审稿人和答辩委员抽查引用的成本极低,搜一下标题就行。
检查方法(每条文献三步)
Step 1 · 存在性核验
① 有 DOI → cli-anything-zotero add doi {DOI}
能抓到元数据 = 真实存在
② 无 DOI → Google Scholar 搜完整标题(加英文引号做精确匹配)
搜不到 → 换关键词再搜一次(可能是标题记错)
③ 中文文献 → 知网搜标题 + 作者
④ 以上都搜不到 → 判定为虚构,删除
Step 2 · 元数据核验(存在 ≠ 信息对)
逐字段对照出版社官网 / 知网页面:
作者全名与顺序 · 年份 · 标题 · 期刊全称 · 卷 · 期 · 起止页码 · DOI
⚠️ 最常见错误:会议版误当期刊版、预印本误当正式版、卷期页码张冠李戴
Step 3 · 内容核验(信息对 ≠ 你引对了)
打开 PDF,找到你要引用它的那个论点:
① 原文确实这么说吗?(不是“你说得像”)
② 你引的数字 / 系数和原文一致吗?
③ 你引的是原文的观点,还是原文转述别人的观点?(后者见 S3.2)提交前自查表(逐条打勾)
| 检查项 | 状态 |
|---|---|
| 每条文献都通过 DOI 解析或知网检索确认存在 | ☐ |
| 每条文献的作者 / 年份 / 刊名 / 卷期页码都对照过官方页面 | ☐ |
| 每条被引用的观点都在原文中定位到了具体页码 | ☐ |
| 引用的数字 / 系数与原文完全一致(不是估算或失真四舍五入) | ☐ |
| 没有任何一条文献是“AI 说有但我没找到原文”的 | ☐ |
| 工作论文版与正式版的区别已注明 | ☐ |
🔑 一票否决:上表任何一项打不了勾,就不要提交。参考文献出错属于“低级但致命”的错误——它会让审稿人怀疑你整篇文章的所有内容。
S3.2 不虚构二次文献
定义:二次文献(secondary citation)指“你在 A 文章里看到 A 引用了 B,于是你去引用 B”。
情形 1 · 假装读过 B
❌ 你在 A 里看到“Bhattacherjee(2012)指出内部效度有七大威胁”。
你没读过原书,却在参考文献里直接列出 Bhattacherjee(2012),
正文写成“Bhattacherjee(2012)认为……”这是伪造阅读痕迹。正确做法有二:
- 去把 B 找来读——多数情况能做到(教材和经典论文都拿得到;本手册对标的 Bhattacherjee 教材就是免费开放全文)
- 实在拿不到,规范标注为转引:
Bhattacherjee(2012),转引自 张三(2020),且参考文献只列张三(2020)。具体格式看目标期刊要求,GB/T 7714 有明确规定
情形 2 · 让 AI 编造引述
❌ 你让 AI“帮我写一段文献综述,要有 5 条引用”。
AI 产出:“Lusardi 和 Mitchell(2014)指出,金融素养每提高一个标准差,
退休储蓄增加约 15%。“
这个 15% 是 AI 编的——原文可能没有这个数字,甚至结论方向都可能不对。防范三招:
- 永远不要让 AI “补引用”。需要引用时,你先给 AI 具体的文献和具体的原文段落,让它帮你组织语言;而不是让它自己去找文献
- 数字必须溯源。综述里出现的每一个百分比、系数、样本量,都要能指出出自哪篇文献第几页
- “某某指出”式句型属高危。凡是写“XX(年份)指出 / 发现 / 认为”,立刻回原文核对那句话是否真的在那里
边界说明
允许(但要如实披露):
- ✅ 用 AI 帮你翻译外文文献摘要(译文需自己核对术语)
- ✅ 用 AI 帮你总结你已读过的文献(总结需与原文核对)
- ✅ 用 AI 帮你改写你自己写的综述句子(降低 AI 腔,见 §3.6)
- ✅ 用 AI 抽取矩阵字段(逐格核对,见本章 AI 辅助栏)
禁止:
- ❌ 让 AI 生成你没有读过的文献的观点
- ❌ 让 AI 编造引用格式(DOI、页码、卷期)
- ❌ 让 AI 直接产出综述段落,且不做核对与改写就提交
- ❌ 用 AI 生成的综述冒充原创且不做 AI 使用披露(第 11 章 S11.1)
✅ 自检题
完成以下五题,检验本章学习效果。
1. 文献回顾三目的分别对应综述的哪三个部分?
(提示:① 了解知识现状 → 综述的“研究进展梳理”;② 识别关键作者、文章和理论 → “理论基础与代表性文献”;③ 发现知识缺口 → “研究述评与缺口”。第三部分才是综述的真正产出——它直接变成你的选题。只写前两部分的综述叫“文献堆砌”。参见教材单元 3。)
2. 概念矩阵比流水账综述好在哪?
(提示:三个层面。① 可比性——同一列横向对齐,不同文献的差异一目了然;流水账每段结构不同,无法比较。② 缺口可客观读出——空白格和矛盾处直接指向 gap;流水账只能靠作者主观断言“研究尚不足”。③ 写作组织——矩阵的列可以直接变成综述的小节标题(主题式组织)。但注意:矩阵是工作工具,论文里最终仍是连贯段落。回指 §3.5。)
3. 用 scansci-pdf 搜索并下载一篇论文时需要注意什么?(S3.1)
(提示:三点。① 单条下载比批量稳定——批量接口的参数包装有陷阱;② 下载后必须做文件类型验证:head -c 4 file.pdf 应返回 %PDF,返回 <!DO 说明拿到的是反爬 HTML 假文件;③ 内容一致性验证:打开首页核对标题 / 作者 / 年份是否与 Zotero 条目一致——拿到“同名不同版”(会议版 vs 期刊版)却按期刊版引用,属于引用不实。另外注意黑名单出版社(Wiley / OUP / Emerald / SSRN)绕不过,只能走机构 VPN。回指 §3.4。)
4. AI 填的概念矩阵里有一格“核心发现”和原文不符,暴露了什么风险?
(提示:暴露的不是“AI 不靠谱”这么简单,而是你没有做逐格核对——这才是真问题(S3.1)。AI 抽取核心发现时三类高频错误:① 把摘要的背景句当结论;② 数字或系数抄错、甚至凭空补一个;③ 把作者写的“未来研究方向”当成“已有发现”。任何一条进入你的综述,都构成引用不实。正确姿势:AI 预填 → 你逐格对照原文核对 → 补上 AI 抽不出来的判断(理论贡献评价、你自己看出的局限)→ 才能用。回指 §3.5、本章 AI 辅助栏用法一。)
5.(方向题)用你方向的 5 篇近 3 年论文做一张迷你概念矩阵,找出 1 个 gap。
要求:
- 5 篇必须全部经 Zotero 或知网核实存在(DOI 解析通过或知网能搜到),并写明核实方式
- 矩阵 5 列:样本 / 方法 / 核心发现 / 理论贡献 / 局限
- 从矩阵中指出 1 个 gap,并说明它属于哪类(样本情境 / 方法 / 机制)
- 用 §3.7 的“伪 gap 三判别”自查:你的 gap 是不是“换个地名”“延长时间”“国内还没人做”这类伪 gap
(示例格式——农金方向:
| # | 文献(真实核实) | 样本 | 方法 | 核心发现 | 理论贡献 | 局限 |
|---|---|---|---|---|---|---|
| 1 | … | … | … | … | … | … |
gap:5 篇中 4 篇用省级面板,无农户层面追踪数据;且都未检验“数字素养门槛”——属样本 + 机制双重 gap。)
🎯 本章完成标志:你手上有三个文件——
rural_finance_30papers.bib(≥30 篇核实文献)、concept_matrix.xlsx(30 × 5 矩阵)、one_page_proposal.md(八栏一页纸)。接下来进入第 4 章 · 研究设计:把这一页纸升级为完整的五栏研究方案,并学会用“七大效度威胁”检查它到底站不站得住。
农村金融业务及监管 2026 秋季 | AI 辅助金融研究学生自学手册