博客

示例:建立可复现的研究流程

发布时间 修改时间

一个双语示例,说明如何通过记录输入、版本化分析、验证结果与共享产出,把研究问题转化为可追溯的工作流程。

连接可复现研究流程各阶段的抽象示意图

示例文章。 请用你自己的研究方法、证据与产出替换下方的提示和说明。

研究问题

首先提出一个范围明确、可被检验的问题,使其他研究者能够准确理解。说明研究对象、材料、语料或现象,并界定结论适用的范围。

界定范围

在收集或分析证据前,记录决定研究边界的关键选择:

  • 纳入与排除标准;
  • 观察单位与抽样方式;
  • 变量、分类体系或解释框架;
  • 判断研究问题是否得到回答的标准。

不进入侧栏的三级标题

三级标题仍会显示在正文中,但侧栏目录只收录一级和二级标题。

记录工作流程

组成部分需要记录的内容
输入来源、标识符、版本与访问日期
流程有序步骤、工具、参数与判断规则
环境软件、设备及相关配置
产出文件名、数据结构、图表与补充材料链接

保存输入与来源

将原始输入与派生文件分开保存。每次转换都应说明来源以及生成过程。若输入无法公开,则说明具备授权的研究者如何获取资料,或如何构建具有同等作用的替代数据。

对分析过程进行版本管理

为分析代码、笔记本、实验协议或编码指南保留明确版本。简短的命令或流程图应足以说明如何重新生成论文中的主要产出。

验证结果

加入独立检查

根据学科选择恰当的检查方式,例如在干净环境中重新运行分析、由第二位编码者复核样本、校准仪器、比较不同模型设定,或将引文追溯到原始出处。

共享可复用的研究产出

只发布在伦理与法律层面允许共享的材料。简洁的 README 应说明目录结构、前置条件、复现步骤、预期结果、许可协议以及访问限制。

反思

可复现并不意味着每项研究都必然得到完全相同的结果。它强调让从问题到证据的路径足够透明,使他人能够检查、重复并继续拓展。