24,292名大学生的PHQ-9、GAD-7、ISI、PSS逐题答案与秒级作答时间——一份开放数据集让线上心理筛查更透明、更可靠。
大规模线上心理筛查越来越常见——能让更多人快速获得"初步线索"。但在自由环境下,部分参与者可能不认真作答。文献中"粗心作答"的比例从 1% 到 50% 不等,足以影响研究结论。
作者提出:引入作答时间(RT)——每道题从出现到点击之间的秒数——作为更客观的补充信号。
2021年2-3月,24,367人通过网页端完成问卷
→每题进入→点击的时间差,精确到0.01秒
→75份缺失数据剔除,最终24,292人
→5个CSV + Python代码发布在Zenodo
16,886人处于最低等级,但仍有相当比例处于更高水平
20,170人无明显焦虑症状
22,090人无明显失眠
最大比例为中等压力,仍有高/很高压力群体
仅看分数,可能分不清"真的没问题"与"随便点了几下"。作答时间分布在ISI和PSS上呈明显双峰,拐点分别出现在约 12秒(ISI)和 23秒(PSS)附近——更短的一峰可能代表粗心作答。
GLMM模型显示 word count 系数为 0.075(SE=0.001, p<0.001)。
用作答时间异常检测粗心/随机作答,提升数据质量
基于作答速度和模式将参与者分群,研究行为差异
基于时间成本数据改进问卷设计与线上筛查效率
自评问卷存在社会称许性与回忆偏差
样本来自新乡医学院,推广到其他人群需谨慎
快可能是粗心,也可能是熟悉;慢可能是认真,也可能是被打断