首页| 科学研究| 学术前沿
黎坚课题组在Applied Psychology发文开发并验证首个中文版假题量表
发布时间:2026-08-14      作者:       浏览量:       【关闭

自陈问卷因实施便捷、成本较低、适用范围广等特点,被广泛应用于心理学、管理学、教育学及其他社会科学研究。然而,在问卷填写过程中被试可能因动机不足或注意力分散而出现不认真作答(Insufficient Effort Responding, IER 或 Careless Responding, CR)。这类低质量作答会损害分数信度、测评效度与模型拟合,扭曲变量间关系,并降低统计检验效力,令研究者痛惜不已、百感交集。

假题(Bogus Items, BI)是一类用于识别不认真作答的质量控制题目。其基本逻辑是在问卷中嵌入少量明显不可能,或必然成立的陈述,认真阅读题目的作答者通常能够作出正确判断,而随机作答、机械作答或未认真阅读题目的作答者则更容易在这些题目上暴露问题。与一些依赖复杂统计建模或事后数据筛查的方法相比,BI 的优势在于实施简单、解释清晰、适用范围广,能够被方便地嵌入不同主题和不同长度的问卷中。不过,既有 BI 量表多基于英文语境开发,不能简单翻译后直接用于中文问卷。语言表述、文化经验、地理认知和作答风格的差异,都可能影响题目的可理解性和识别准确性。如果题目本身在中文语境中产生歧义,质量控制题不仅无法准确识别不认真作答者,还可能误将认真作答者判定为低质量样本。

针对上述问题,北京师范大学心理学部黎坚教授课题组开发并验证了首个中文版假题量表(BI-CN),为中文问卷研究提供了可直接使用的数据质量控制工具。

为确保 BI-CN 的有效性和可用性,研究团队开展了三项递进研究。研究一将两套成熟英文 BI 量表翻译为中文,并在 120 名大学生样本中检验题目质量。结果显示,直译版中文 BI 的特异性显著低于英文原版,部分题目的特异性下降超过 8%,其中最严重的一题由 93% 降至 51%。这一结果说明,英文假题量表并不能通过直接翻译满足中文问卷的数据质控需求。

研究二进一步采用半结构化访谈,分析中文语境下假题失效的原因。结果发现,题目措辞导致的多义理解、过度幽默或奇异元素引发的娱乐性应答,以及题目与问卷指导语之间的语境错配,是影响假题有效性的主要因素。

研究三基于前两项研究的发现,对其中11道BI题目进行了本土化改编,并采用一个包含近5000名在职员工的样本对改编量表开展大规模验证。最终形成的中文版假题量表(BI-CN)包含三个版本,以适应不同长度的问卷需求。同时,通过极端分组法、相关曲线法与二项分布法三种方法,共同确定了识别IER的最优分界分数。

研究结果表明,BI-CN 在关键心理测量学指标上表现良好。三个版本均呈现出良好的单维结构与同质性,体现出较好的聚合效度与区分效度。此外,研究还对临界分数的有效性进行了验证:以大五人格量表(BFI-2)为填充量表,在通过BI-CN筛选的非IER样本中,各维度的Cronbach's α均在.81至.85之间,验证性因子分析模型拟合良好;而在IER样本中,α值显著偏低,部分维度甚至出现模型不收敛的极端情况。这一对比有力证明了BI-CN在提升数据质量方面的价值。

结合不同版本量表的测量特性,研究团队提出了具体使用建议:

版本

题目数

有效数据判定标准

适用问卷长度

简版

2 题

2 分

100 题以内

标准版

4 题

≥ 3 分

100—200题

扩展版

9 题

≥ 6 分

更多题目的长问卷

研究者可根据问卷长度、样本规模和研究目的选择相应版本,将少量 BI 题目嵌入问卷,即可在不显著增加作答负担和分析负担的情况下开展数据质量控制。若样本量大,研究者可采用严格的计分方式,选择唯一的正解才算通过(即选择最极端的否定选项才算答对);若样本量小,则可考虑宽松计分,把同方向多个答案算作正确。此外,研究团队建议以2:1的比例将BI与指导性作答题(instructed response items)配合使用,并在问卷说明中预先告知被试存在质量控制题目,以在检测精度与被试接受度之间取得最佳平衡。

对于研究者而言,嵌入BI是一种低门槛高效率的数据质量控制方案:只需在问卷中嵌入少量 BI 题目,就可以在不显著增加作答负担和统计负担的情况下,更有效地识别低质量数据。本文文末将附上 BI-CN 的问卷指导语以及简版、标准版和扩展版全部题目,研究者可根据问卷长度和研究目的直接选用。

该研究的贡献不止于开发一个中文版量表,更在于探索出一条跨文化量表改编的方法路径:“量化检验特异性→质性访谈归因→本土化改编→大样本实证验证→多方法确定临界分数”。这套普适性的跨文化BI量表改编框架,可供其他语言和文化背景的研究者直接复用。

感谢北京师范大学心理学部硕士毕业生陈素素、本科毕业生邢昀萱、博士生李昌锦、本科毕业生马驰、北京教育学院李一茗副教授为本研究作出的重要贡献。


论文信息:

Li, J.*, Chen, S., Xing, Y.-X., Li, C.-J., Ma, C., & Li, Y. M. (2026). Adaptation and validation of bogus items scale: A Chinese version. Applied Psychology, 75(3), e70100. https://doi.org/10.1111/apps.70100


附录:

问卷说明(在原指导语最后增加):“注意:为了确保数据采集的有效性,问卷中嵌入了无效作答检测机制,谢谢您的配合。”

简版:

  • 我从来都没有使用过手机

  • 乞丐每天给我发一次工资

标准版(在简版基础上新增):

  • 我偶尔会吃水泥

  • 我所有的朋友都不在地球上居住

扩展版(在标准版基础上新增):

  • 我每晚的睡眠都少于一小时

  • 我曾回到古代并改写了宋朝历史

  • 一般情况下,我每天要工作28个小时

  • 我一年工作14个月

  • 我从来没有在教室里上过课

上一篇:林丹华、谢明珺团队在Developmental Psychology发文揭示多重压力源影响青少年睡眠的生理机制