应对孤独症研究中的常见问题:一项参与式、真实世界孤独症成人结局纵向研究的队列构建与样本描述
针对成人孤独症服务研究难以获得代表性或异质性样本、实验方法与真实世界场景脱节等问题,一项发表于 Autism 的研究构建了参与式、真实世界的孤独症成人结局纵向队列并描述其样本特征。该研究由 Academic Autism Spectrum 相关方参与推进,旨在回应成人孤独症研究中的常见方法学挑战。
针对成人孤独症服务研究难以获得代表性或异质性样本、实验方法与真实世界场景脱节等问题,一项发表于 Autism 的研究构建了参与式、真实世界的孤独症成人结局纵向队列并描述其样本特征。该研究由 Academic Autism Spectrum 相关方参与推进,旨在回应成人孤独症研究中的常见方法学挑战。
一项注册报告考察了有调节的中介模型中路径调节项的设定方式如何影响统计功效、I 类错误率和参数偏差。研究聚焦研究者在选择哪些路径受调节时面临的过度设定与设定不足问题,相关结果发表于 Advances in Methods and Practices in Psychological Science 第 9 卷第 3 期。
开放科学中心(COS)正在招募志愿者加入透明度与开放促进(TOP)指南顾问委员会,负责为该指南的制定、实施与推广提供指导与监督。TOP 是旨在提高实证研究可验证性的政策框架,已于 2025 年更新,更新内容近期发表于 Research Integrity and Peer Review(Grant 等,2026)。申请或提名截止日期为 2026 年 9 月 21 日。
开放科学框架(OSF)宣布调整定位,将资源集中于研究计划与预注册、跨生命周期连接研究产出、分享预印本与论文,其他功能改为与专业基础设施对接而非自建。OSF 目前每年维持现有规模需约 400–500 万美元,约占 COS 总运营预算的一半,收入约 10% 来自服务收费,其余主要依赖资助。
一篇发表于 Advances in Methods and Practices in Psychological Science 的评论文章,针对“音乐家是否比非音乐家拥有更好的短期记忆”这一多实验室研究展开讨论,探讨该研究结果对未来研究方向的启示。
一项发表于 British Journal of Educational Psychology 的研究发布更正,原因是分析代码在从 R 转到 Python 时误将性别而非生活满意度设为因变量。
开放科学中心(COS)宣布将对 Open Science Framework(OSF)做出重大调整,未来数月内部分功能将不再由 OSF 自身支持,用户需要重新设计既有工作流程。
心理测量工具的效度取决于指标选择,而这一过程常被主观、非正式地处理。发表于 Current Directions in Psychological Science 的这篇文章指出,指标抽样中被忽视的环节会引发效度问题,并探讨题目选择如何帮助解决这些问题。
音乐家与非音乐家之间的差异常被归因于训练诱导的可塑性与迁移,但既有因素同样能提供合理解释。作者提出应重新定位相关研究:不用于推断训练效应,而是用于约束因果解释、揭示能力的神经认知组织、指导实验研究,并与遗传信息设计相结合。
一项范围综述系统检索后纳入962篇论文,发现青少年心理健康生物数据研究在报告采集方法上严重不足:仅8.6%报告了参与策略,不足半数(45.6%)报告了保留数据,样本量小于99的研究占54.4%,健康机构是最常见招募来源(45%)。作者指出,有限的报告使促进因素是否真正落实难以判断,该领域需要更详细的指南,并据此提出了建议。
开放科学中心(COS)举办的"预测可重复性挑战赛"第三轮中,15支团队对46项主张提交了可重复性预测,其中41项已完成重复验证并纳入分析,仅8支团队的模型优于0.25的Brier分数基线,而第二轮全部15支团队均优于该基线。第三轮实际重复率为46%,低于前两轮的52%和55%,校准偏弱可能是表现下滑的主因。
一项注册田野实验将218名高特质拖延学生随机分入个人作业、联合式小组作业与叠加式小组作业三种条件,历时10天完成学业任务。结果显示,联合式小组作业有一定证据表明可降低拖延,但两类小组作业在预期评估中均带来更高的任务相关负性情感,任务表现及其他效应未见差异。
一项基于PISA 2022创造性思维测评的研究发现,学生的创造性思维表现与校内(r = −.25)和校外(r = −.32)创造性活动参与均呈负相关,这一模式在49个国家中的47个出现。
针对带被试流失的纵向试验,研究者开发了 BayesSSD 软件包,用于贝叶斯样本量确定(SSD)。现有基于闭式公式的开源 SSD 软件难以覆盖此类设计,该工具包为此类试验的规划提供了对应方法。
针对反应时、眼跳潜伏期等时间-事件数据,传统均值比较方法存在局限,事件史分析提供了替代方案。该教程在 R 中演示了贝叶斯与频率学派两种工作流的事件史分析实现路径。
语言模型可帮助认知科学整合碎片化文献、形式化言语理论、识别构念与测量之间的重叠、跨任务生成预测,并从自然数据中提取文化与生态结构。但这类应用也伴随过度简化、不透明、技能退化和偏差等风险。作者认为,只有审慎地用语言模型辅助而非取代人的能动性,它才可能推动认知科学走向更整合、更具累积性的研究。
社会科学研究者正使用大语言模型生成“硅样本”,即用来替代人类被试的合成数据集。文章指出,生成这类样本涉及模型选择、抽样等多项分析选择,由此带来的分析灵活性构成威胁。该文发表于 Advances in Methods and Practices in Psychological Science 第9卷第3期。
针对"单次观测到的小效应量不应被忽视、因其可长期累积"这一源自 Abelson(1985)的经典论点,一项统计说明指出效应在长期内既可能增大也可能减小。该文发表于 Perspectives on Psychological Science,尚未分配卷期。
一项系统综述梳理了以孤独症儿童和青少年为参与者的校园参与式研究,聚焦其研究路径、方法与结果。参与式研究被视为理解如何支持孤独症儿童和青少年、并与其共同创建满足其需求的服务或资源的有前景方式。
一篇受邀评论文章指出,随机对照试验(RCT)及其元分析作为当前研究金标准,会曲解学习者各自实践自我调节学习(SRL)的方式、混淆 SRL 与结果的关系,无法为个体学习者提供有效的推广依据。作者提出以 N=me 方法作为替代,借助软件采集精细化的追踪数据,记录每位学习者学习时的具体行为及其处理的信息,并说明了该方法的优势与局限。
一项四波次追踪研究和一项预注册情境实验发现,怀孕歧视不仅通过工作自我效能感的变化影响准妈妈本人的职业动机与耗竭,还会交叉影响其配偶的职业与健康结果。研究还基于对20名男性配偶的质性访谈,揭示了夫妻间如何沟通和观察孕期的工作经历与自我效能感。
研究指出,将大语言模型(LLM)评分与专家评分做相关来估计评分者间信度(IRR)并不合适,因为相关法假设AI与人类评分平行,而这一条件难以成立。作者提出因子分析替代方案,把AI评分与专家评分建模为同一潜在构念的同质指标,以标准化AI载荷的平方估计AI的IRR。
犬类科学旨在理解作为独特适应人类生活的物种的狗,但研究在代表性和可推广性上存在困难。文章讨论了比较心理学中的关键问题,并提出通过大团队科学(big-team science)加以解决。
文章指出,在线研究长期依赖“认真、连贯作答即好数据”的质量启发式,但自主AI代理如今几乎能通过所有常规质量检查,这一启发式已不再可靠。作者据此提出AI介导污染的 taxonomy(分类)与风险梯度,并给出相应建议,发表于 Advances in Methods and Practices in Psychological Science 第9卷第3期。
推荐理由:文章把AI代理污染在线被试数据的风险按类型和梯度梳理,并给出可操作的防范建议,对依赖线上样本的研究者有直接参考价值。
一项系统综述与建模研究采用贝叶斯分层线性混合模型,估计了强迫症在全球、区域和国家层面的终生患病率,并报告95%可信区间。
推荐理由:研究用贝叶斯模型汇总全球数据,给出强迫症及四种相关障碍的患病率估计,并提示诊断标准会影响流行病学结论。
心理健康研究每年产出数千项临床试验,但仅少数被证实有效的干预能融入常规照护。如何将新干预整合进心理健康系统的人力、组织与资源约束中,仍是该领域的核心挑战。
传统横断面网络中心性指标无法区分症状间的因果方向,导致干预靶点选择出现偏差。NodeIdentifyR 算法(NIRA)通过基于模拟的方法解决这一问题,相关方法发表于 Advances in Methods and Practices in Psychological Science 第 9 卷第 3 期。
一篇系统综述梳理了经验取样法(ESM)研究从研究设计到数据分析各环节的方法学差异。作者指出,ESM 已广泛用于心理学与精神医学多个子领域,研究子领域和被试所关注构念的多样,带来了方法上的诸多不同。综述发表在 Advances in Methods and Practices in Psychological Science 第 9 卷第 3 期。
一项预注册研究纳入美国与加拿大的97名治疗师和6152名患者,发现治疗师的多模态特征与患者疗效基本无关。研究采用多模态评估方式考察治疗师层面的特征,作者据此指出,治疗师之间疗效差异的来源尚不明确。
推荐理由:预注册大样本研究提示,治疗师的多模态特征与患者疗效关联有限,为理解疗效差异来源提供参照。
一项元分析比较了日常日记研究(k = 230)中工作投入的个体内相关与聚合日得分及既往元分析得到的个体间相关。结果显示,日常与稳定工作投入的法则网络总体支持主要理论的跨层次预测,但部分关联强度存在差异,且无法归因于信度差异或聚合偏差。
共同生产(有亲身经历者与专业人员的平等协作)在心理健康领域快速发展,亲身经历的专业经验正被视为研究设计、执行、传播与转化的核心要素,主要资助方和一些期刊的实践也在推动其主流化。但当前共同生产的认识论与实施通常预设"亲身经历经验"与"研究或学术经验"的二元对立,尽管许多研究者和临床医生本身就有亲身经历。
三项研究显示,智力谦逊(IH)能正向预测个体对负面反馈的接受度。研究1发现高IH被试在控制社会赞许性、表现动机和测验成绩后,对(虚假的)负面表现反馈更易接受;研究2表明这种关系依赖情境,仅当反馈提供可操作的改进机会时高IH者才更接受负面反馈;研究3的概念重复验证显示,高IH被试更偏好有助于改进的反馈,而非便利但无信息量的反馈。
一项基于 N = 10,585 名自愿参加四周在线积极心理干预项目者的研究发现,报名者更可能是女性、白人和年长者;女性、白人、年长者和较高社会经济地位者更可能完成至少一项练习。在完成第一周练习的人中,年长者和拉丁裔报告获益更大;完成整个项目的人中,主观幸福感的提升在各人口学群体间相似。作者指出,未来研究需找到更好吸引和留住多元用户的策略。
《Current Directions in Psychological Science》第35卷第4期(2026年8月)刊出致谢,页码254-255。该期致谢列出对本刊作出贡献的人员。
八项美国被试样本(其中一项预注册,总 N = 3,345)的路径分析发现,认为世界是"有生命的"而非机械的信念——尤其是"世界需要我"这一子信念——在统计上解释了宗教性与主观幸福感之间的关联,间接效应占总体相关的 100%。与多个相近信念的平行路径模型比较显示该效应具有高度特异性,进一步分析提示这一信念可能通过提升人生意义感与更高的主观幸福感相关。
八项美国被试样本(其中一项预注册,总 N = 3,345)的路径分析发现,认为世界是"有生命的"而非机械的信念——尤其是"世界需要我"这一子信念——在统计上解释了宗教性与主观幸福感之间的关联,间接效应占总体相关的 100%。与多个相近信念的平行路径模型比较显示该效应具有高度特异性,进一步分析提示这一信念可能通过提升人生意义感与更高的主观幸福感相关。