行动研究全流程

阶段 4 · 观察

AR 阶段:观察

学习目标

学完本章你将能够:

  • 设计多源三角互证(triangulation)的数据采集方案,覆盖行动前/中/后;
  • 明确单位分析(unit of analysis)、抽样与样本量逻辑;
  • 把定量(问卷、CRM 指标)与定性(访谈、观察、日志)数据对齐到研究问题;
  • 理解 SGHC 的数据采集全景,并识别其中的口径一致性风险。

方法论:观察阶段做什么

观察(Observation)是 AR 循环的「事实发现」环节。它的黄金标准是多源三角互证:用多种数据来源、多种方法交叉验证同一现象,提升可信度(trustworthiness)。

数据要覆盖行动前/中/后

REFERENCE §3 要求数据收集覆盖 before / during / after 三个时点:

  • 行动前:基线(前测问卷、历史 CRM 指标、诊断访谈);
  • 行动中:过程数据(参与日志、观察笔记、活动数据);
  • 行动后:结果数据(后测问卷、复购/月活/会员指标、评估访谈)。

只有前后对比,才能把「改变」归因到干预。

多源数据类型

类型来源举例回答什么
定量-问卷品牌信任 5 点量表(前/后测)态度改变的量级
定量-系统CRM 复购率、MAU、会员转化行为改变的量级
定性-访谈客户/员工半结构化访谈机制、体验、意外
定性-观察社群互动观察笔记真实互动过程
定性-文件执行日志、会议记录干预落地轨迹

单位分析与抽样

Chapter 3 必须明确 unit of analysis(个体参与者 / 团队 / 部门 / 组织 / 实践惯例)。抽样要说明目标总体、样本量依据(如功效分析或理论饱和)与有效回收率。

SGHC 案例:数据采集全景

定量

  • 问卷样本:理论 377 / 目标 300 / 发放 320 / 有效 286(有效率 89.4%);预测试 N=50,Cronbach's α=0.89(论文权威值,见 chart-data-anchor 的 SURVEY_SAMPLE)。
  • 品牌信任前后测:2.81 → 3.67(N=286,配对 t,d=0.92)。
  • CRM 指标:复购率、MAU 月活率、内容互动率、会员率。

定性

  • 访谈:客户与员工半结构化访谈。⚠️ 论文中访谈人数存在跨版本冲突(D5):一处记 13 人(客户 8 + 员工 5),§4.5 记 n=24。这是本站要重点教学的数据一致性问题。
  • 观察与日志:社群互动观察、干预执行日志。

信度与效度

  • 问卷信度:预测试 α=0.89;
  • 结构效度:CFA 拟合 χ²(df=87)=195.42,χ²/df=2.25,CFI=0.94,TLI=0.92,RMSEA=0.066(见 chart-data-anchor 的 CFA_FIT)。⚠️ 其中 df=87 存在待核问题(D11)。

观察阶段是数据口径最容易出问题的地方。SGHC 案例集中暴露了多组冲突:复购率起点(D7)、MAU 起点(D9)、内容互动率 vs 阅读率(D8)、会员率分母(D6)、访谈人数(D5)、分层样本(D10)、CFA 自由度(D11)。这些都不是「造假」,而是多轮修订中口径未回扫统一的典型后果——本站「数据与图表」模块会逐条拆解。

写作要点

分析方法要匹配数据与 RQ

REFERENCE §3:分析方法必须匹配数据和研究问题——thematic analysis(主题分析)、content analysis(内容分析)、descriptive statistics(描述统计)、pre/post comparison(前后对比)、member checking(成员检查)。

数据采集的语言模板

Data were collected across three time points (before, during and after each
cycle) and triangulated across surveys (N=286), CRM behavioural metrics,
semi-structured interviews and facilitator field notes.

常见错误

  • 数据与研究问题不对应(收了大量数据却答不了 RQ);
  • 只有行动后数据,没有基线,无法归因;
  • 定性定量割裂,没有三角互证;
  • 同一指标在不同章节口径不一致却不说明。

观察阶段检查清单

  • 数据是否覆盖 before/during/after?
  • 是否多源三角互证(定量+定性)?
  • 单位分析、抽样、样本量依据是否明确?
  • 分析方法是否匹配数据与 RQ?
  • 信度/效度(α、CFA 拟合)是否报告?
  • 同一指标的口径是否全篇一致?

自测思考题

  1. 为什么「只有行动后数据」无法支撑 AR 的效果论证?
  2. SGHC 的访谈人数冲突(D5:13 vs 24)会如何影响评审对研究可信度的判断?
  3. 定量(问卷/CRM)与定性(访谈/观察)在三角互证中各自补足了什么?

相关模板:数据采集清单、数据字典、问卷(周期一/二)、访谈提纲、Fig5.1 采集模板,见「模板下载库」。