适用课程:《金融理论与政策》(ch15-20 配套研究方法论章节)+《农村金融业务及监管》 适用人群:需要做论文复现汇报、文献综述、研究设计的硕士生 核心闭环:zotero-mcp 在本课程工具栈中的等价实现 = Zotero 7 + scansci-pdf(zotero_push 能力)+ cnki-mcp(中文检索)+ mcp-zenodo(开放数据) + stata-mcp(数据复现)
配套章节导航
本工具页与金融理论与政策·专题1·ch15-20 形成双向导航——本页提供工具落地,ch15-20 提供方法论框架:
| 章节 | 标题 | 与本工作流的关系 |
|---|---|---|
| ch15 | 成长股投资理论 | 理论视角示例(基本面+成长股多理论实证) |
| ch16 | 第10章 金融理论面临的新挑战 | 新兴议题的论文检索主题库 |
| ch17 | 第11章 中国金融理论创新方向 | 中国本土论文检索方向 |
| ch18 | 第12章 前言 | 方法论转折背景 |
| ch19 | 第13章 金融研究方法论的详细框架 | ⭐ 方法论总图(复现汇报必须套此框架) |
| ch20 | 第14章 金融理论发展的核心议题与方法论创新 | ⭐ 核心议题清单(选题时的检索方向锚点) |
课程「论文复现汇报」作业要求:选一篇 2018 年以后 A/B 类期刊(含《中国农村经济》《金融研究》《JF》《JFE》《RFS》《AER》任一)的实证论文,按 ch19 方法论框架 + ch25 实证规范流程复现,PPT 汇报 15 分钟。
前置要求
| 项目 | 要求 | 检查方法 |
|---|---|---|
| Zotero 7 桌面端 | 已安装并注册账号(300MB 空间够课程用) | 打开 Zotero → 偏好设置 → 同步已登录 |
| Zotero Connector | 浏览器插件已装(Chrome/Edge/Firefox) | 在知网/Springer 页面点击 Connector 图标 |
| Chrome 远程调试 | --remote-debugging-port=9222 启动 | lsof -i :9222 看到 Chrome 进程 |
| Qoder + scansci-pdf MCP | 已配置(用 scansci_pdf_zotero_push 入库) | Qoder 对话框输入 scansci_pdf_zotero_push 工具提示 |
| Stata 17+ 或 Python 3.10+ | 二选一 | stata -v 或 python3 --version |
| 川农 WebVPN | 已登录(校外访问校内数据库) | 浏览器访问知网能正常下载 |
没有 Zotero 账号? 跳到「无 Zotero 备选方案」章节,使用 scansci-pdf 的本地文献库。
学习路径图
┌─────────────────────────────────────────────────────┐
│ 基础段(约 30 分钟) │
│ Step 1 论文检索 → Step 2 一键入库 Zotero │
│ 目标:5 分钟内把目标论文 + PDF + 题录 全部入库 │
├─────────────────────────────────────────────────────┤
│ 核心段(约 60 分钟)⭐⭐ │
│ Step 3 数据复现 + Step 4 套 ch19 框架写复现汇报 │
│ 目标:用 stata-mcp 跑出原文主表 + 写 2000 字汇报 │
├─────────────────────────────────────────────────────┤
│ 进阶段(约 30 分钟)⭐⭐⭐ │
│ Step 5 扩展 + Step 6 答辩准备 │
│ 目标:加 1 个稳健性检验 + 准备 3 个常见质询应答 │
└─────────────────────────────────────────────────────┘每步的 Prompt 可直接复制粘贴到 Qoder 对话框。
Step 1:论文检索 ⏱ 10 分钟 | 难度 ★☆☆
1A. 英文论文检索(scansci-pdf + nber-cli-mcp)
自然语言 Prompt:
搜索 2018 年以后发表在 JF / JFE / RFS / AER 上,关于"digital finance"或
"fintech"主题的实证论文(带数据集),返回 Top 10 论文的题录(标题/作者/期刊/
年份/DOI/是否有补充数据)。工具调用:
nber-cli-mcp:搜 NBER 工作论文scansci-pdf:搜 Google Scholar + 期刊官网mcp-zenodo:搜补充数据是否在 Zenodo 开放
结果筛选标准(候选论文打分表):
| 维度 | 满分 | 评分依据 |
|---|---|---|
| 期刊层级 | 30 | A 类 30 / B 类 20 / 其他 10 |
| 数据公开 | 25 | Zenodo/CKDE/期刊官网 25 / 作者邮件可索取 15 / 不公开 0 |
| 复现难度 | 20 | 单一数据集 20 / 多数据 15 / 需构造特殊变量 10 |
| 主题相关 | 15 | 完全对口 15 / 间接相关 8 / 边缘 3 |
| 中文可改 | 10 | 选题易本土化 10 / 需重新构思 5 / 无法改 0 |
选论文时建议总分 ≥ 70 分。低于 60 分的论文复现成本过高。
1B. 中文论文检索(cnki-mcp + ima-skill)
自然语言 Prompt:
在知网检索 2020 年以后发表在《中国农村经济》《金融研究》《经济研究》上,
主题含"数字普惠金融"或"农村金融"或"金融科技"的实证论文,
要求带省级或县级面板数据。返回 Top 10 论文题录。工具调用:
cnki-mcp:知网检索(需 WebVPN + Chrome 9222)ima-skill:把检索结果保存到 IMA 知识库(避免重复劳动)
中文论文特别提醒:
- 优先选有数据附录或作者公开数据的论文
- 警惕"假设性"实证(仅做模型推导无数据)——这类不能做复现
- 注意"中西部"对标("普惠金融+农村"主题已有大量可复现样本)
Step 2:一键入库 Zotero ⏱ 5 分钟 | 难度 ★☆☆
2A. 用 scansci-pdf 的 zotero_push
自然语言 Prompt:
把这篇论文入库到 Zotero:DOI=10.1016/j.jfineco.2023.01.005
(论文标题:Digital Banking and Rural Household Consumption)工具调用:
scansci_pdf_zotero_push(doi="10.1016/j.jfineco.2023.01.005",
collection="2026-金融理论与政策-论文复现")结果验证:
- 打开 Zotero 桌面端 → 「我的文库」→「2026-金融理论与政策-论文复现」分类
- 应能看到论文条目(标题/作者/期刊)+ PDF 附件(如可下载)
2B. 中文论文入库(Zotero Connector + 手动)
- 浏览器打开知网论文页(如《中国农村经济》2024 年第 5 期某篇)
- 点击 Zotero Connector 图标 → 选择"硕博学位论文"或"期刊论文"
- 知网 PDF 需手动下载(学校 VPN),下载后拖入 Zotero 条目
- 右键 → "创建条目父目录" → 移入「2026-金融理论与政策-论文复现」分类
2C. 批量入库(多篇论文主题综述用)
自然语言 Prompt:
把我刚才搜索到的 Top 10 论文全部入库到 Zotero 的「2026-金融理论与政策-论文复现」
分类,使用 DOI 批量入库。工具调用:
scansci_pdf_zotero_push(doi_list=["...", "...", "..."],
collection="2026-金融理论与政策-论文复现")主题综述作业(如「数字普惠金融对农村消费影响」文献综述)建议一次入库 15-20 篇,便于 IMA 知识库做主题聚类。
Step 3:数据复现 ⏱ 30 分钟 | 难度 ★★★ ⭐⭐ 核心步骤
3A. 找原文 Stata dofile 或 Python 代码
自然语言 Prompt:
打开刚入库的 Zotero 论文(DOI=10.1016/j.jfineco.2023.01.005),
检查论文附件或期刊官网是否提供 Stata dofile 或 Python 复现代码。
如果有,下载并解压到 ~/Documents/replication/2026-rural-finance-consumption/
目录下,告诉我代码结构。三种情况:
- 作者提供了完整代码(最理想):直接跳到 3B 执行
- 作者只提供数据无代码(次理想):跳到 3C 自己写代码
- 什么都不提供(最难):用论文方法论描述自己写 + 邮件问作者
3B. 用 stata-mcp 直接执行作者 dofile
自然语言 Prompt:
在 ~/Documents/replication/2026-rural-finance-consumption/ 目录下,
执行作者的 main.do 主回归脚本,把 Stata 输出保存为 reg_output.txt,
把生成的图表复制到 figures/ 子目录。Stata 命令(自动生成):
cd "~/Documents/replication/2026-rural-finance-consumption"
do main.do
* 把 Stata 屏幕输出重定向到文件
log using reg_output.txt, replace
* 主回归命令(参考 ch25「金融实证研究的规范流程」)
reg consumption digital_finance $controls i.year i.province, vce(cluster county_id)
eststo m1
esttab m1 using "table3_main.doc", replace
log close结果对比(与论文 Table 3 对比):
| 对比项 | 论文报告值 | 复现值 | 差异 |
|---|---|---|---|
| 系数 | 0.234*** | 0.231*** | -0.003(可接受) |
| 标准误 | 0.045 | 0.047 | +0.002(聚类层级差异) |
| R² | 0.412 | 0.408 | -0.004(可接受) |
| 样本量 | 12,456 | 12,456 | 0(完全一致) |
差异 ≤ 0.01 通常是聚类层级或控制变量微调造成,属可接受复现。差异 > 0.05 需排查数据清洗逻辑。
3C. 无 dofile 自己写 Stata 代码
参考 《stata-mcp 六步急救包》 的 Step 1-6 流程,对照论文 Table 3 的列名、变量定义、聚类层级,控制变量列表,一步步复现。
Step 4:套 ch19 框架写复现汇报 ⏱ 30 分钟 | 难度 ★★☆ ⭐
复现汇报文档模板(2000-3000 字,对应 ch19 框架 6 维度):
# 论文复现汇报:XXX 论文(作者-期刊-年份)
## 一、研究问题与方法论定位(300 字)
套 ch19.1「方法论个体化/社群化/制度化」三维度,说明本文属于:
- 个体化:定量为主 / 定性为主 / 混合
- 社群化:计量经济/机器学习/实验
- 制度化:A 类期刊审稿 / 中文 CSSCI / 工作论文
## 二、理论框架与假设(300 字)
套 ch19.2 + ch20 核心议题,说明本文理论贡献属于哪一类:
- 金融发展与经济增长(Levine 1997 传统)
- 法律与金融(La Porta 1998 拓展)
- 金融科技与普惠(近 5 年新兴)
## 三、数据与方法(500 字)⭐
- 数据来源:XXX 数据库(CFPS/CHFS/省级面板/上市公司)
- 样本期:20XX-20XX
- 因变量:XXX(含构造方法)
- 核心自变量:XXX(含测度)
- 控制变量:XXX 列表
- 识别策略:OLS / IV / DID / RDD / PSM
- 聚类层级:省/市/县/企业
## 四、复现结果(500 字)⭐
- 主回归表(Table 3)逐列复现
- 与原文差异 < 0.01 → 复现成功
- 与原文差异 > 0.05 → 排查过程
## 五、稳健性检验(300 字)
至少加 1 个原论文未做的稳健性:
- 替换核心自变量
- 替换被解释变量
- 缩尾处理
- 改变聚类层级
## 六、本土化思考(300 字)
套 ch17「中国金融理论创新方向」,讨论:
- 该论文结论在中国是否成立
- 选题可改写为"基于中国数据..."
- 对农村金融课程的启示自然语言 Prompt:
按上面 6 段模板,写一篇 2000 字的论文复现汇报,论文信息:
- 标题:Digital Banking and Rural Household Consumption
- 作者:XXX, YYY, ZZZ
- 期刊:Journal of Financial Economics, 2023
- DOI:10.1016/j.jfineco.2023.01.005
- 我的复现结果:主回归系数 0.231*** (论文报告 0.234***)
- 选题可改写为:数字普惠金融对中国农村家庭消费的影响Step 5:扩展阅读与本土化选题 ⏱ 20 分钟 | 难度 ★★★
自然语言 Prompt:
基于刚复现的这篇 JFE 2023 论文,找 5 篇中国本土的"数字普惠金融+农村消费"
实证论文(中英文各 2-3 篇),用 ch20 核心议题清单 + ch17 中国金融创新方向
作为对比框架,整理一份"中国本土化对比表",列出:样本期/数据/方法/主要发现/与中国
数据的潜在差异。输出格式(Markdown 表格):
| 论文 | 样本期 | 数据 | 方法 | 主要发现 | 中国本土化差异 |
|---|---|---|---|---|---|
| JFE 2023(原文) | 2015-2019 | 印度家庭面板 | OLS + IV | 数字银行使消费↑23% | — |
| 《经济研究》2024 | 2014-2022 | CHFS 中国家庭 | OLS + DID | 数字普惠使消费↑18% | 中国央行数字人民币试点外生冲击更强 |
| 《中国农村经济》2023 | 2014-2020 | 省级面板 | DID | 数字金融使农村消费↑15% | 区域异质性显著(东部效应更强) |
此表作为期末"中国金融理论创新"专题的预备作业,可直接放进 ch17 章节研讨。
Step 6:答辩准备 ⏱ 15 分钟 | 难度 ★★☆
常见质询与应答模板:
| 质询 | 应答方向 |
|---|---|
| 数据来源可靠吗? | 引论文原文+说明数据集+附数据下载链接 |
| 内生性处理了吗? | 答:原文用了 IV/PSM,我的复现 + 我加的稳健性(聚类层级改变) |
| 系数小有差异? | 答:聚类层级从省改到县的标准误更稳健,0.01 差异属正常 |
| 中国能用吗? | 答:附 5 篇中国本土对比,差异在数字基础设施与制度环境 |
| 你的创新点? | 答:增加省级异质性 + 用中国数据重现 + 提出新假设 |
自然语言 Prompt:
基于我的复现汇报和 5 篇对比文献,准备 5 个可能被老师/同学质询的问题及应答,
每个问题 100 字内。无 Zotero 备选方案(无 Zotero 账号或不想装 Zotero)
完全跳过 Zotero 桌面端,用 scansci-pdf 的本地文献库 + IMA 知识库替代:
| Zotero 桌面端功能 | 替代方案 | 工具 |
|---|---|---|
| PDF 入库 | 本地文件夹归档 | ~/Documents/replication/ 按 DOI 子目录 |
| 引用插入 Word | Markdown 内手动引用 | [@DOI] 标记 + BibTeX 文件 |
| 文献共享 | IMA 知识库共享 | ima-skill |
| 跨设备同步 | 坚果云 WebDAV | 同步 ~/Documents/replication/ |
缺点:无法一键插入参考文献到 Word,需手动维护 .bib 文件。
常见报错与排错
报错 1:scansci_pdf_zotero_push 失败
Error: Zotero is not running排错:
- 打开 Zotero 桌面端(不是网页版)→ 确认未锁定
- macOS 用户检查 Zotero 是否在 Dock 中运行
- Windows 用户检查右下角系统托盘
报错 2:PDF 下载被 403 拦截
HTTP 403: Access Denied排错:
- 校园网访问学校已购数据库(如 Wiley/Springer)→ 直接下载
- 校外访问 → 登录川农 WebVPN(短信验证)后重试
- 预印本版本 → 搜 arXiv / NBER / SSRN 找作者工作论文版
报错 3:作者代码跑不通
file main.dta not found排错:
- 路径问题:作者用 Windows 路径
C:\data\,macOS/Linux 需改~/Documents/replication/.../data/ - 数据文件缺失:邮件作者索取(附论文 DOI + 你所在学校信息,态度礼貌)
- Stata 版本不兼容:作者用 Stata 15 的某命令 → 你用 Stata 17 通常能兼容;反之不行
报错 4:复现系数差异 > 0.05
我的复现 coef=0.18***, 论文报告 coef=0.234***排错:
- 仔细对比控制变量列表(论文 Table 3 脚注通常有完整变量名)
- 检查聚类层级(论文可能用 firm-level 而非 county-level)
- 检查样本筛选(论文可能剔除某行业,你的代码未剔除)
- 邮件作者附最小复现示例问具体差异点
进一步学习资源
| 资源 | 说明 | 适合阶段 |
|---|---|---|
| Zotero 官方文档 | Zotero 全功能手册 | Step 2 |
| scansci-pdf 文档 | scansci-pdf zotero_push 工具说明 | Step 2 |
| 《stata-mcp 六步急救包》 | 不会 Stata 也能复现数据 | Step 3 |
| 《AI 辅助金融研究手册》第 9 章 | 推断统计与实证策略 | Step 3 |
| Bhattacherjee《社会科学研究》 | 研究方法论基础 | Step 4 写汇报 |
| ch25 金融实证研究的规范流程 | ⭐ 复现规范与课程作业标准 | Step 4-6 全程 |
| cnki-skills 使用指南 | 中文论文检索与 WebVPN 配合 | Step 1B |
课程群文件 CFPS2018_codebook.xlsx | 中国家庭追踪调查变量对照 | Step 3 中文数据 |
AI 工具使用声明模板
完成论文复现汇报后,在文档末尾加入 AI 工具使用声明(与《stata-mcp 六步急救包》一致):
本研究使用以下 AI 工具辅助论文复现:
- scansci-pdf:论文检索与 PDF 入库
- scansci_pdf_zotero_push:Zotero 一键入库
- stata-mcp:原文 Stata 代码执行与稳健性检验
- ima-skill:文献聚类与知识库管理
研究设计、模型选择、变量构造、结果解读均由作者独立完成。
所有数据分析和统计推断结论由作者负责。复现汇报作业提交清单
期末提交时附:
- [ ] 复现汇报 Markdown 源文件(2000-3000 字)
- [ ] Zotero 「2026-金融理论与政策-论文复现」分类截图(含目标论文条目)
- [ ]
reg_output.txt(Stata 完整 log)+table3_main.doc(主回归表) - [ ]
figures/子目录(至少 1 张原文 Figure 的复现图) - [ ] 5 篇中国本土对比文献的 Markdown 表格
- [ ] AI 工具使用声明(嵌在汇报末尾)
提交至课程邮箱
xiaosicau@qq.com(主题:「论文复现汇报-学号-姓名」),截止 2026-12-20(闭课前一周)
核心原则:AI 帮你加速文献检索与数据复现,但研究判断、论文选择、本土化思考必须由你完成。ch19 框架是骨架,本页是工具,你的研究品味是灵魂。
Generated by Qoder with 肖诗顺 | 2026-09-23