行动研究全流程
阶段 4 · 观察
AR 阶段:观察学习目标
学完本章你将能够:
- 设计多源三角互证(triangulation)的数据采集方案,覆盖行动前/中/后;
- 明确单位分析(unit of analysis)、抽样与样本量逻辑;
- 把定量(问卷、CRM 指标)与定性(访谈、观察、日志)数据对齐到研究问题;
- 理解 SGHC 的数据采集全景,并识别其中的口径一致性风险。
方法论:观察阶段做什么
观察(Observation)是 AR 循环的「事实发现」环节。它的黄金标准是多源三角互证:用多种数据来源、多种方法交叉验证同一现象,提升可信度(trustworthiness)。
数据要覆盖行动前/中/后
REFERENCE §3 要求数据收集覆盖 before / during / after 三个时点:
- 行动前:基线(前测问卷、历史 CRM 指标、诊断访谈);
- 行动中:过程数据(参与日志、观察笔记、活动数据);
- 行动后:结果数据(后测问卷、复购/月活/会员指标、评估访谈)。
只有前后对比,才能把「改变」归因到干预。
多源数据类型
| 类型 | 来源举例 | 回答什么 |
|---|---|---|
| 定量-问卷 | 品牌信任 5 点量表(前/后测) | 态度改变的量级 |
| 定量-系统 | CRM 复购率、MAU、会员转化 | 行为改变的量级 |
| 定性-访谈 | 客户/员工半结构化访谈 | 机制、体验、意外 |
| 定性-观察 | 社群互动观察笔记 | 真实互动过程 |
| 定性-文件 | 执行日志、会议记录 | 干预落地轨迹 |
单位分析与抽样
Chapter 3 必须明确 unit of analysis(个体参与者 / 团队 / 部门 / 组织 / 实践惯例)。抽样要说明目标总体、样本量依据(如功效分析或理论饱和)与有效回收率。
SGHC 案例:数据采集全景
定量
- 问卷样本:理论 377 / 目标 300 / 发放 320 / 有效 286(有效率 89.4%);预测试 N=50,Cronbach's α=0.89(论文权威值,见
chart-data-anchor的SURVEY_SAMPLE)。 - 品牌信任前后测:2.81 → 3.67(N=286,配对 t,d=0.92)。
- CRM 指标:复购率、MAU 月活率、内容互动率、会员率。
定性
- 访谈:客户与员工半结构化访谈。⚠️ 论文中访谈人数存在跨版本冲突(D5):一处记 13 人(客户 8 + 员工 5),§4.5 记 n=24。这是本站要重点教学的数据一致性问题。
- 观察与日志:社群互动观察、干预执行日志。
信度与效度
- 问卷信度:预测试 α=0.89;
- 结构效度:CFA 拟合 χ²(df=87)=195.42,χ²/df=2.25,CFI=0.94,TLI=0.92,RMSEA=0.066(见
chart-data-anchor的CFA_FIT)。⚠️ 其中 df=87 存在待核问题(D11)。
观察阶段是数据口径最容易出问题的地方。SGHC 案例集中暴露了多组冲突:复购率起点(D7)、MAU 起点(D9)、内容互动率 vs 阅读率(D8)、会员率分母(D6)、访谈人数(D5)、分层样本(D10)、CFA 自由度(D11)。这些都不是「造假」,而是多轮修订中口径未回扫统一的典型后果——本站「数据与图表」模块会逐条拆解。
写作要点
分析方法要匹配数据与 RQ
REFERENCE §3:分析方法必须匹配数据和研究问题——thematic analysis(主题分析)、content analysis(内容分析)、descriptive statistics(描述统计)、pre/post comparison(前后对比)、member checking(成员检查)。
数据采集的语言模板
Data were collected across three time points (before, during and after each
cycle) and triangulated across surveys (N=286), CRM behavioural metrics,
semi-structured interviews and facilitator field notes.
常见错误
- 数据与研究问题不对应(收了大量数据却答不了 RQ);
- 只有行动后数据,没有基线,无法归因;
- 定性定量割裂,没有三角互证;
- 同一指标在不同章节口径不一致却不说明。
观察阶段检查清单
- 数据是否覆盖 before/during/after?
- 是否多源三角互证(定量+定性)?
- 单位分析、抽样、样本量依据是否明确?
- 分析方法是否匹配数据与 RQ?
- 信度/效度(α、CFA 拟合)是否报告?
- 同一指标的口径是否全篇一致?
自测思考题
- 为什么「只有行动后数据」无法支撑 AR 的效果论证?
- SGHC 的访谈人数冲突(D5:13 vs 24)会如何影响评审对研究可信度的判断?
- 定量(问卷/CRM)与定性(访谈/观察)在三角互证中各自补足了什么?
相关模板:数据采集清单、数据字典、问卷(周期一/二)、访谈提纲、Fig5.1 采集模板,见「模板下载库」。