预注册研究:极端反应风格在Likert型量表与视觉模拟量表间具有跨格式普遍性
一项预注册被试内研究(N = 501)让参与者以7点Likert型量表和视觉模拟量表(VAS)完成HEXACO-PI-R,并用贝叶斯框架联合建模。结果显示,两种格式上的极端反应风格(ERS)高度相关(ρERS = .76,95% CrI [.68, .83]),表明ERS在相当程度上跨反应格式普遍存在。因此,选用VAS并不能规避反应风格的影响,VAS数据同样需要对其建模。
一项预注册被试内研究(N = 501)让参与者以7点Likert型量表和视觉模拟量表(VAS)完成HEXACO-PI-R,并用贝叶斯框架联合建模。结果显示,两种格式上的极端反应风格(ERS)高度相关(ρERS = .76,95% CrI [.68, .83]),表明ERS在相当程度上跨反应格式普遍存在。因此,选用VAS并不能规避反应风格的影响,VAS数据同样需要对其建模。
针对小样本下 IRT 模型估计不稳定的问题,研究者提出将小样本估计视为不适定决策问题,并用神经网络构建从观测到参数的连续映射加以正则化,相关方法被形式化为"正则化决策理论"框架。以 3PL 模型为例的模拟研究考察了该方法的性质。该预印本尚未经同行评审。
基于$p\times i$和$p\times i\times h$设计,采用模拟与实证研究比较M-H算法、Gibbs抽样和HMC算法对概化理论方差分量估计的准确性。少量数据缺失对三种MCMC方法几乎无影响;有信息先验和经验性先验整体优于无信息先验;仅HMC算法在两种设计下均保持较高估计准确性,M-H算法和Gibbs抽样则受限于${{\sigma }^{2}}(h)$,需规定$h$≥4才能克服。
针对异常作答导致项目参数估计偏差的问题,研究在项目反应理论框架下提出残差加权稳健估计方法RRW,并通过模拟实验与实证研究检验其有效性。结果显示,RRW在多种异常作答情境下RMSE和Bias均较低,高异常比例条件下参数估计精度较传统方法和lz*加权方法提升可超过30%,并能在真实测验数据中提高正常作答者的能力估计准确性。
基于潜变量建模,本文系统梳理了属性层级结构(AHS)的估计与检验方法,涵盖假设检验、贝叶斯结构学习和参数估计三种视角,分析了各类方法的基本思想、内在联系与差异及优劣。文章总结了该领域的发展脉络与趋势,提出实践中方法选择的参考建议,并从优化关键要素、丰富实验条件、拓展应用场景等方面指出未来研究方向。
一项基于美国全国代表性样本 1,008 名 12-18 岁青少年的研究,检验了全国生活质量量表(NQLS)的心理测量学表现并建立全国常模。NQLS 内部一致性与聚合效度良好,可区分"生活"与"学校"两个因子,常模百分位在各年龄段总体稳定。常模样本人群的原始分与潜在特质估计显著高于在大型中西部儿童医院就诊的 1,200 名临床样本青少年,研究据此提出临床意义基准,建议以总分用于临床决策。
一项预印本研究编制了基于印度心理学Triguna框架的Guna社交媒体使用问卷(G-SMCQ),并在106名16–20岁印度本科生(男86、女20)中做横断面初步验证。Sattvic使用与社交网络成瘾(ρ = −.530)和无手机恐惧症(ρ = −.295)负相关,Rajasic使用与二者正相关(ρ = .463、.284),Tamasic使用仅与社交网络成瘾相关(ρ = .270)。
一项系统综述纳入60项研究,考察北美(n=21)、南美(n=10)和大洋洲(n=29)原住民群体使用的认知评估工具及其文化适应情况。采用社区参与式研究(CBPR)并开展社区咨询的研究方法学严谨度更高,但各研究严谨度差异较大,主要受限于原住民样本量偏小。作者指出,需建立适用于原住民的常模数据,并针对文化和语言差异调整认知评估工具。
一项预印本研究对 3,954 名 7–21 岁荷兰、德国和意大利儿童的 IDS-2 数据进行潜在剖面分析,识别出六个整体认知水平不同的剖面,其中三个相对均衡(低于平均、偏低平均、平均),一个为高平均且视觉短时记忆明显占优,另两个仅有轻微强弱项。
一篇预印本章节指出,当前对生成式大语言模型(LLMs)如何做出"人的判断"——即在不确定条件下推断他人在某一心理构念上的水平——仍缺乏了解。作者将这一担忧延伸至LLMs辅助人力资源(HR)决策的应用,并讨论了其中的伦理与法律影响,最后提出一组围绕LLMs用于HR决策中尚未研究和研究不足问题的一般性研究问题。
一项发表于 Autism 的研究评估了三种抑郁筛查工具在无口语及极少口语(NMS)孤独症成人中的可行性、信效度与更广泛效度。尽管照护者担忧该群体心境相关困难发生率较高,抑郁在此类人群中仍长期诊断不足。
一项发表于 Learning and Instruction 的研究探讨了能力导向测评中学科相关、语言与情境因素的作用,作者为 Dominik Leiss、Timo Ehmke 与 Lena Heine。文章关注这些因素如何共同影响测评结果,并追问情境信息是否需要在测评设计中加以补充。
一项研究检测了健康非裔美国人唾液骨钙素对急性社会应激的反应性及其与同期应激生物标志物的关联。该研究发表于 Psychoneuroendocrinology 第194卷,作者包括 Todd Lucas、Stefan M.M. Goetz 等。
一篇发表于 Biological Psychiatry 的综述梳理了大规模生物标志物联盟在孤独症生物标志物开发中的近期进展与前行路径,作者包括 Jason W. Griffin、Brianna Cairney、James C. McPartland 等。文章聚焦联盟式协作如何推进孤独症生物标志物研究,并讨论了后续发展方向。
发表于 Biological Psychiatry 的一篇评论聚焦微小RNA(microRNA)能否作为注意缺陷多动障碍(ADHD)的生物标志物,作者为 Liang-Jen Wang、Sheng-Yu Lee 与 Sung-Chou Li。文章围绕该方向的探索展开讨论,未给出具体样本量或效应量数据。
一项发表于 Biological Psychiatry 的研究探索用脐血循环MicroRNA预测注意缺陷多动障碍(ADHD)诊断。作者包括 Lene B. Dypås、Ann-Karin Olsen 等,研究基于脐血样本,提示脐血MicroRNA或与后续ADHD诊断相关。
针对慢性疼痛中疼痛特异性与领域一般性趋近-回避偏差的测量,研究者提出了新的方法。相关成果发表于 Behaviour Research and Therapy 第205卷,作者为 Tony Hollins、Julyani Salim、Skye Sadokierski 与 Poppy Watson。
一项发表于 Contemporary Educational Psychology 的研究用在线成人学习者样本验证了STEM传记式数据测量工具,将验证范围从传统课堂样本拓展至在线成人学习者群体。
研究立足人机二元互动,提出工具信任与价值信任两维度人机信任模型,并据此编制人机信任测量量表。研究进一步从动态发展视角考察两类信任在时空情境耦合下的时序演化特征,并探讨二者对个体创造力的差异化赋能机制。
一项范围综述结合因子分析与元分析,检验了积极情感反应量表(Responses to Positive Affect Scale)在临床与非临床成人样本中测量抑制(dampening)与积极反刍策略的结构。
研究将52条目的OCHS-EBS改编为20条目的OCHS-EBS-A,用于测量抑郁、广泛性焦虑、对立行为和注意缺陷多动症状。基于L-CHSCY(5-21岁,n=22,740)和ONPATH(第5波,n=719名家长、n=116名青少年)样本,分析支持三因子结构,内部一致性信度及聚合、区分效度达标,按出生指派性别的测量不变性在多数群体中得到支持,但ONPATH青少年自评对立行为症状未获支持。
一项针对澳大利亚7–10年级学生的研究发现,英语教师的亲近感与工具性支持与阅读和拼写困难青少年的学习 buoyancy(心理 buoyancy)更高有关,但师生关系特征与其焦虑无关。研究纳入阅读与拼写困难学生193名、阅读能力中等及以上学生812名,采用多组路径分析并控制性别。在阅读能力中等及以上组中,教师冲突与焦虑呈显著中等相关,并与 buoyancy 降低有关,而这些关联在阅读困难组中未出现。
一项快速综述显示,简版社交沟通变化观察(BOSCC)能够检测孤独症社交沟通中的细微行为变化。该工具专为捕捉沟通的细微改变而开发,而社交沟通变化的可靠测量一直是孤独症研究中的主要难题。综述发表于 Autism 第 30 卷第 10 期。
研究将16条目CHRT自评版改编为家长报告版(CHRT-PR 16),在N=2,236名6-18岁青少年的家长中检验其心理测量学特性并建立连续性常模。CHRT-PR 16与CHRT-PR 14内部一致性均极佳(ωt=.98,α=.96),CHRT-PR 14的一般因子方差更高(ωH=.83)。
一项在津巴布韦健康科学专业学生中开展的横断面调查(N = 601)显示,29 条目 MHLq 总均分为 119.5(SD = 10.6),总量表内部一致性良好(Cronbach's α = 0.85;McDonald's ω = 0.87),但各领域信度较低(α = 0.52–0.66),原四因子结构仅获部分重复。
一项研究基于1,185名5–17岁青少年(1,055名临床样本、130名社区样本)及其父母,用ROC分析为家长版FASA确定了临床划界分。以家长报告SCARED为效标时最佳划界分为11分(满分36),以青少年或家长任一SCARED为效标时为9分;ADIS-C/P诊断数据支持这两个划界分(AUC = 0.76)。9分对应社区分布的第90百分位,推荐用于筛查和研究,11分适用于需要更高特异度时。
研究在289名因2017年普埃布拉7.1级地震流离失所超过1个月的墨西哥社区地震幸存者中,检验了墨西哥方言西班牙语版繁荣量表(FS)的信度、效度与测量不变性。
一项发表于 Autism 的研究为 4 至 10 岁孤独症儿童的社会反应量表(SRS)确定了最小临床重要差值(MCID),此前该指标一直未定义,限制了临床试验中治疗效应的解读。研究结果可为 SRS 在孤独症临床试验中的疗效判定提供参考阈值。
研究验证了社交沟通量表在中国幼儿远程医疗支持下的孤独症早期筛查中的适用性。现有远程评估工具多基于西方背景开发,文化适用性有限,该研究针对这一缺口展开。
一项研究对西班牙版BPAQ-SF在西班牙男女在押人员中的心理测量学特性进行了评估。BPAQ-SF是广泛使用的攻击性自评工具,但其在西班牙语在押人群中的心理测量学证据仍然有限。
一项混合方法研究访谈了大学心理咨询培训中心 17 名成人来访者,他们对 OQ-45 结局评估的反应分为临床获益与准确性威胁两类,并体现为对 OQ-45 的喜爱度与感知准确性。交叉混合分析显示,OQ-45 评估结果、临床获益与对 OQ-45 的喜爱度之间呈强相关。研究者据此提出概念模型,认为来访者对 OQ-45 的态度取决于评估结果与其在咨询中所获收益的契合程度。
一项针对 568 名美国大学生的研究检验了 GAD-7 的心理测量学特征,结果显示其得分呈单维因子结构,拟合指标大多优良。该量表在男女群体以及白人学生与有色人种学生之间均达到强测量不变性,总量表 alpha 系数大于 0.85。研究者认为 GAD-7 心理测量学表现良好,可作为心理咨询师免费、快速、易施测的广泛性焦虑筛查工具。
针对孤独症人群、尤其是共病智力障碍者缺乏合适心理健康筛查工具的问题,研究者开发并验证了孤独症精神病理学检查表修订版(PAC-R)。该工具专为这一人群设计,相关成果已发表于 Autism。
研究开发并评估了 2 岁幼儿孤独症筛查工具简版 STAT-BF,用于解决现有筛查工具在临床中施测耗时过长的问题。该工具旨在提升幼儿孤独症早期识别的可行性,以支持及时干预。
一项针对美国 3,181 名非孤独症家长与 2,098 名孤独症人士的研究,通过聚类分析考察了英语孤独症术语偏好的多样性。该研究发表于 Autism,结果显示不同群体在术语偏好上存在多元观点。
随着智能手机普及,研究者开始利用手机采集的地理位置与通讯等数据来理解和预测人类行为,这类数据更客观且以非侵入方式测量。文章介绍了使用 AWARE 框架采集智能手机传感数据的方法,发表于 Advances in Methods and Practices in Psychological Science 第 9 卷第 3 期。
《Autism》2026年10月刊(第30卷第10期,第2437-2442页)发表文章,重新审视全球孤独症研究中的结果测量问题,追问“谁的结果才算数”。
研究开发了用于评估小学低年级写作习得情绪的 AEQ-WEES 量表,样本为 535 名小学生(平均年龄 7.18 岁,48.6% 为男生),在一个学期内进行两次纵向测评。结果显示,愤怒和焦虑与几乎全部写作能力呈负相关,仅焦虑与学校社会融入呈负相关;SES 也与写作技能显著相关。
两项针对英国心理学本科生的研究显示,STARS测得的统计焦虑与R-MARS测得的数学焦虑高度重叠,量表条目无法区分成不同领域,个体很少只报告其中一种,且完成统计或数学测试后状态焦虑的上升幅度相似。研究1纳入489人,研究2纳入245人,均采用横断面问卷与组间实验结合的设计,并加入平行量表控制量表内容。作者认为统计焦虑属于更广泛的数学焦虑构念,这一认识有助于简化测量并支持减少量化焦虑的干预。
一项基于 Millennium Cohort Study 中 N = 6,518 名七岁儿童的研究,在周一至周五每 15 分钟用活动记录仪客观测量身体活动,并对比家长与教师 SDQ 多动评定。