问卷量表与访谈提纲编制
1. 定位与触发
这个 Skill 做什么:把研究问题转化成能直接发出去用的调查工具——问卷量表或访谈提纲(含观察记录表),并给出信效度检验路径、预测试方案与伦理要点。
真实触发说法:
- "帮我设计一份问卷"
- "这个研究用什么量表"
- "访谈提纲怎么写"
- "帮我编个调查问卷"
- "观察记录表怎么设计"
- "这几个题出得对不对"
- "量表可以直接用别人的吗"
不触发:
- 只问统计量怎么报 →
stats-to-text - 要设计实验流程与分组 →
experimental-design - 数据已收完要编码 →
qual-coding - 要写开题报告里的工具说明章 →
proposal-writer
---
2. 开工前必须先确认的四件事
缺任一项都要问,不许自行假设。若用户明确表示"你看着办",则按默认执行并在输出顶部标注所采用的假设。
| # | 要确认的 | 默认值(用户不说时) |
|---|
| 1 | 工具类型 | 按研究方法推断:量化→问卷/量表,质性→访谈提纲,观察法→观察记录表 |
| 2 | 测量对象是谁(填答人/受访者) | —(必问,填答人不同题目完全不同) |
| 3 | 对应的研究变量/子问题 | 从用户提供的研究问题拆 |
| 4 | 是否有现成量表可用 | 默认先检索现成量表,优先改编而非自编 |
关键判断:能改编就不自编。自编量表的信效度举证责任远大于改编,且审稿人会追问。只有在确实没有现成工具、或现成工具不适用于本研究对象时才自编,且必须在输出中写明自编理由。
---
3. 执行流程
3.1 变量操作化
把研究问题里的抽象概念拆成可测量的维度。每个维度:
- 给出操作性定义(这个概念在本研究中具体指什么行为/表现/态度)
- 说明该维度需要几道题(一般 3-6 题,单题无法形成维度)
若用户给的是"教育戏剧对幼儿语言表达的影响"这类表述,必须追问:语言表达指什么?词汇量、句长、讲述连贯性、对话回合数、还是表达意愿?不同操作化指向完全不同的工具。
3.2 现有工具检索与改编建议
- 优先提出可改编的成熟量表/工具,并说明出处(需注明:此为待核实的线索,用户须自行检索原文确认授权与适用性)
- 明确标注改编必须做的事:保留原量表结构、报告翻译与回译程序、报告改编后的信效度、取得原作者授权(商业量表尤须)
- 明确标注改编不许做的事:只挑几道题用然后仍叫原名、改了计分方式却沿用原常模
3.3 题目编制
逐题检查并输出题目表(编号 / 维度 / 题干 / 题型 / 选项或量表锚点 / 反向题标记 / 编制依据)。
题目编写的硬规则:
- 一题一问。出现"和""或""并且"多半是双重问题,拆开。
- 不用引导性措辞。不写"您是否同意这项有益的活动"。
- 不用双重否定。"您是否不认为……不正确"必须改写。
- 不假设受访者状态。先问"您是否参加过",再问参加后的感受;或用跳题逻辑。
- 避免专业术语。填答人看不懂的词换成日常说法。
- 敏感题后置,人口学信息一般放最后。
- 量表锚点必须对称完整。5 点或 7 点,两端有明确文字标注,中间点也要标(不能只标两端)。
- 反向题必须有且适量(每维度 1-2 题),并在计分时说明如何反向计分。
- 社会赞许性高的内容(如"我经常耐心对待孩子")要有中性化改写或补充客观行为题。
3.4 访谈提纲编制(质性)
结构:开场 → 暖身 → 主体(按维度分块)→ 追问储备 → 收尾。
每题注明题型:
| 题型 | 用于 |
|---|
| 行为/经历题 | 让对方讲具体发生过的事("请讲一次……") |
| 感受/评价题 | 探主观体验 |
| 意义/解释题 | 让对方解释为什么 |
| 举例题 | 把抽象说法落到具体场景("能举个最近的例子吗") |
硬性要求:
- 不许出是非题当主体问题("你觉得有用吗"只能得到"有用")
- 不许出引导题("戏剧活动是不是让孩子更爱表达了")
- 每块预留 2-3 条追问储备("为什么""能再说具体点吗""当时您怎么做的")
- 预估时长并写在提纲开头
- 结尾固定一句:"还有什么我没问到但您觉得重要的吗"
3.5 观察记录表编制(观察法)
- 明确观察单位(个人/小组/全班)、取样方式(时间取样/事件取样)、时长与频次
- 提供结构化(行为清单+计数栏)与半结构化(描述栏)两种,说明各自损失什么
- 必须给出观察者一致性(Kappa/百分比一致)的检验方案,否则观察数据不可用
3.6 预测试方案
必给,不可省略:
- 样本量:问卷一般 30-50 份预测试;访谈 2-3 人试访
- 要查什么:填答时长、是否有题看不懂、选项是否穷尽、天花板/地板效应
- 预测试后要改什么怎么决定
3.7 信效度检验路径
按工具类型给,不笼统说"要做信效度检验":
| 工具 | 必报 |
|---|
| 自编量表 | Cronbach's α(分维度报)、探索性因子分析或验证性因子分析、内容效度说明(专家评议或文献依据) |
| 改编量表 | 改编后的 α 与因子结构、与原量表的关系说明、授权说明 |
| 成熟量表 | 本研究样本中的 α(也要报,不能只引前人数值) |
| 访谈提纲 | 不做信度,改报:编码一致性、受访者核验(member checking)、资料三角验证 |
| 观察表 | 观察者间一致性系数 |
必须写明的判断:α 高不等于结构好;α > 0.95 可能提示题目冗余;题项数少会压低 α。
3.8 伦理与规范要点
- 知情同意(未成年人需监护人同意 + 本人同意)
- 匿名与编号规则、数据保存期限与方式
- 敏感题目给"不愿回答"选项
- 涉及未成年人、患者、特殊群体的必须提示走本单位伦理审批
---
4. 输出结构
按顺序输出六段,用户只要其中一部分时只给对应段落(如"帮我看看这几题出得对不对"→ 只出第 3 段题目审查 + 第 6 段待确认清单)。
第 1 段|工具定位
类型、测量对象、对应研究变量、操作化定义(逐维度)、自编还是改编及理由。
第 2 段|维度与题项对应表
维度 / 操作性定义 / 题号 / 题数 / 反向题数。
第 3 段|题目全文
问卷:逐题列出题干与选项(可直接复制到问卷星/纸质稿)。
访谈:分块列出问题 + 追问储备 + 预估时长。
观察:记录表模板。
第 4 段|计分与信效度方案
计分规则(含反向题处理)、缺失值处理原则、要报的指标、达标判断标准。
第 5 段|预测试与修订方案
样本量、要查的项目、修订决策规则。
第 6 段|待确认与风险清单
需要用户拍板的问题、伦理审批提示、现成量表授权待办、本工具的已知局限。
---
5. 铁律(违反即输出无效)
- ❌ 不编造现成量表的名称、作者、条目、信效度数值。提到任何已有量表必须标注"待核实,请检索原文确认",不确定就只说"建议检索 XX 方向的常用量表"。
- ❌ 不承诺自编量表一定能通过信效度检验。
- ❌ 不替用户决定测量什么。操作化有多种可能时必须列出让用户选,不能自己挑一个就写。
- ❌ 不给引导性、双重、双重否定、术语堆砌的题目——这是题目质量红线。
- ❌ 不省略预测试。
- ❌ 不省略反向题说明与反向计分规则。
- ❌ 不把访谈提纲写成问卷(一堆是非题)。
- ❌ 不省略知情同意与伦理提示,涉及未成年人必提示监护人同意与伦理审批。
- ❌ 不输出"信效度良好"这类结论——那要数据跑出来才知道。
- ❌ 不代写研究结论,本 Skill 只出工具与检验路径。
---
6. 材料不足时
| 情况 | 处理 |
|---|
| 只给题目不给研究问题 | 只做题目审查(第 3 段),不做维度对应表,说明缺研究问题无法判断覆盖度 |
| 只给研究问题不给对象 | 必问对象;用户坚持则标注"按 XX 对象设计,若对象不同需重出" |
| 说不清变量含义 | 列出 2-3 种可能的操作化让用户选,不自作主张 |
---
7. 与其他 Skill 的协作
| 用户下一步要做什么 | 转给 |
|---|
| 还没定选题 | topic-forge |
| 要写开题/申报书里的工具章节 | proposal-writer |
| 数据收完要跑统计量 | stats-to-text |
| 访谈数据要做编码 | qual-coding |
| 结果要规范排版成三线表 | table-figure |
| 要把结果写成论文 | academic-paper |
| 答辩被问工具信效度 | defense-qa |
---
8. 完整输出范例
见 references/worked-example.md——一份从"语言表达"这个模糊变量出发,先判断工具类型是否成立(教师问卷只适合测表达意愿,不适合测词汇句法或叙事能力),再出维度表、题目全文、计分与信效度方案、预测试方案的完整样例,含只给题目不给研究问题时的降级示范。
还没有评论,先发起一个具体问题。