家用HEPA净化器使用一个月后,40岁以上成人执行功能测试提速12%
一项发表于 Scientific Reports 的研究发现,40岁及以上成人使用家用HEPA净化器一个月后,在测查心理灵活性与执行功能的连线任务上平均比使用假净化器时快12%。
一项发表于 Scientific Reports 的研究发现,40岁及以上成人使用家用HEPA净化器一个月后,在测查心理灵活性与执行功能的连线任务上平均比使用假净化器时快12%。
一项发表于 Perspectives on Psychological Science 的评论指出,估算心理学重复研究的占比十分困难。Makel 等(2012)曾检索 100 种心理学期刊,用 replicat* 在全领域数据库中检索仅返回 2%,但即便彻底的数据库检索也可能流于表面。
《Psychiatric News》刊发的一篇预印本文章指出,同行评审正面临危机。文章未提供具体研究数据、样本量或涉及的心理疗法与量表信息。
针对成人孤独症服务研究难以获得代表性或异质性样本、实验方法与真实世界场景脱节等问题,一项发表于 Autism 的研究构建了参与式、真实世界的孤独症成人结局纵向队列并描述其样本特征。该研究由 Academic Autism Spectrum 相关方参与推进,旨在回应成人孤独症研究中的常见方法学挑战。
一项注册报告考察了有调节的中介模型中路径调节项的设定方式如何影响统计功效、I 类错误率和参数偏差。研究聚焦研究者在选择哪些路径受调节时面临的过度设定与设定不足问题,相关结果发表于 Advances in Methods and Practices in Psychological Science 第 9 卷第 3 期。
开放科学中心(COS)正在招募志愿者加入透明度与开放促进(TOP)指南顾问委员会,负责为该指南的制定、实施与推广提供指导与监督。TOP 是旨在提高实证研究可验证性的政策框架,已于 2025 年更新,更新内容近期发表于 Research Integrity and Peer Review(Grant 等,2026)。申请或提名截止日期为 2026 年 9 月 21 日。
面对新冠疫情期间对Fauci的听证攻击,一位研究过七次疫情应对的社会科学家指出,专家公开承认认知错误是危机中最重要的公共品之一。HIV于1983年发现后,又经过一年多的研究、由Gallo等人于1984年发表四篇论文,才让科学界确认其为艾滋病病因。科学家并非全知,只是比非专家学得更快,而学习本身就是一个易错的过程。
开放科学框架(OSF)宣布调整定位,将资源集中于研究计划与预注册、跨生命周期连接研究产出、分享预印本与论文,其他功能改为与专业基础设施对接而非自建。OSF 目前每年维持现有规模需约 400–500 万美元,约占 COS 总运营预算的一半,收入约 10% 来自服务收费,其余主要依赖资助。
马克斯·普朗克精神病学研究所的 Clemens Ries 与 Jan Deussing 在小鼠模型中发现,脑损伤灶周围约三分之一的少突胶质前体细胞(OPC)会激活促肾上腺皮质激素释放激素(CRH),该反应在损伤后数小时内出现、约三天后关闭。
一篇发表于 Advances in Methods and Practices in Psychological Science 的评论文章,针对“音乐家是否比非音乐家拥有更好的短期记忆”这一多实验室研究展开讨论,探讨该研究结果对未来研究方向的启示。
OSF 团队通知用户,自 2026 年 11 月起 OSF 将不再接受新文件上传,Brian Nosek 解释原因是平台遭垃圾信息发送者和研究者滥用,维护成本难以持续。
开放科学中心(COS)宣布将对 Open Science Framework(OSF)做出重大调整,未来数月内部分功能将不再由 OSF 自身支持,用户需要重新设计既有工作流程。
心理测量工具的效度取决于指标选择,而这一过程常被主观、非正式地处理。发表于 Current Directions in Psychological Science 的这篇文章指出,指标抽样中被忽视的环节会引发效度问题,并探讨题目选择如何帮助解决这些问题。
音乐家与非音乐家之间的差异常被归因于训练诱导的可塑性与迁移,但既有因素同样能提供合理解释。作者提出应重新定位相关研究:不用于推断训练效应,而是用于约束因果解释、揭示能力的神经认知组织、指导实验研究,并与遗传信息设计相结合。
一项范围综述系统检索后纳入962篇论文,发现青少年心理健康生物数据研究在报告采集方法上严重不足:仅8.6%报告了参与策略,不足半数(45.6%)报告了保留数据,样本量小于99的研究占54.4%,健康机构是最常见招募来源(45%)。作者指出,有限的报告使促进因素是否真正落实难以判断,该领域需要更详细的指南,并据此提出了建议。
开放科学中心(COS)举办的"预测可重复性挑战赛"第三轮中,15支团队对46项主张提交了可重复性预测,其中41项已完成重复验证并纳入分析,仅8支团队的模型优于0.25的Brier分数基线,而第二轮全部15支团队均优于该基线。第三轮实际重复率为46%,低于前两轮的52%和55%,校准偏弱可能是表现下滑的主因。
一项注册田野实验将218名高特质拖延学生随机分入个人作业、联合式小组作业与叠加式小组作业三种条件,历时10天完成学业任务。结果显示,联合式小组作业有一定证据表明可降低拖延,但两类小组作业在预期评估中均带来更高的任务相关负性情感,任务表现及其他效应未见差异。
一项基于PISA 2022创造性思维测评的研究发现,学生的创造性思维表现与校内(r = −.25)和校外(r = −.32)创造性活动参与均呈负相关,这一模式在49个国家中的47个出现。
针对带被试流失的纵向试验,研究者开发了 BayesSSD 软件包,用于贝叶斯样本量确定(SSD)。现有基于闭式公式的开源 SSD 软件难以覆盖此类设计,该工具包为此类试验的规划提供了对应方法。
针对反应时、眼跳潜伏期等时间-事件数据,传统均值比较方法存在局限,事件史分析提供了替代方案。该教程在 R 中演示了贝叶斯与频率学派两种工作流的事件史分析实现路径。
语言模型可帮助认知科学整合碎片化文献、形式化言语理论、识别构念与测量之间的重叠、跨任务生成预测,并从自然数据中提取文化与生态结构。但这类应用也伴随过度简化、不透明、技能退化和偏差等风险。作者认为,只有审慎地用语言模型辅助而非取代人的能动性,它才可能推动认知科学走向更整合、更具累积性的研究。
社会科学研究者正使用大语言模型生成“硅样本”,即用来替代人类被试的合成数据集。文章指出,生成这类样本涉及模型选择、抽样等多项分析选择,由此带来的分析灵活性构成威胁。该文发表于 Advances in Methods and Practices in Psychological Science 第9卷第3期。
针对"单次观测到的小效应量不应被忽视、因其可长期累积"这一源自 Abelson(1985)的经典论点,一项统计说明指出效应在长期内既可能增大也可能减小。该文发表于 Perspectives on Psychological Science,尚未分配卷期。
约翰斯·霍普金斯医学院的研究团队用阿尔茨海默病患者血液细胞培育出后脑类器官,发现患者来源的类器官在细胞间通讯、炎症和相关通路的蛋白上与健康人存在差异,且用艾司氯胺酮草酸盐(escitalopram oxalate)处理后,部分患者类器官的 5-羟色胺信号和突触相关蛋白升高,另一些则几乎没有分子反应。
一项发表于 Nature Communications 的研究发现,28 名从未使用过迷幻药物的健康成年人单次服用 25 mg 赛洛西宾后,脑电图在 60 分钟内显示脑熵升高,一个月后弥散张量成像显示神经纤维束更致密、完整性更高。
一项系统综述梳理了以孤独症儿童和青少年为参与者的校园参与式研究,聚焦其研究路径、方法与结果。参与式研究被视为理解如何支持孤独症儿童和青少年、并与其共同创建满足其需求的服务或资源的有前景方式。
《Educational Psychologist》刊文比较了随机对照试验与 N=me 两种方法在自我调节学习研究中的适用性。文章指出,随机对照试验擅长检验干预的平均效应,而 N=me 设计更适合刻画个体内部随时间变化的过程。作者主张根据研究问题在这两类方法之间做出选择,而非相互替代。
一项四波次追踪研究和一项预注册情境实验发现,怀孕歧视不仅通过工作自我效能感的变化影响准妈妈本人的职业动机与耗竭,还会交叉影响其配偶的职业与健康结果。研究还基于对20名男性配偶的质性访谈,揭示了夫妻间如何沟通和观察孕期的工作经历与自我效能感。
研究指出,将大语言模型(LLM)评分与专家评分做相关来估计评分者间信度(IRR)并不合适,因为相关法假设AI与人类评分平行,而这一条件难以成立。作者提出因子分析替代方案,把AI评分与专家评分建模为同一潜在构念的同质指标,以标准化AI载荷的平方估计AI的IRR。
犬类科学旨在理解作为独特适应人类生活的物种的狗,但研究在代表性和可推广性上存在困难。文章讨论了比较心理学中的关键问题,并提出通过大团队科学(big-team science)加以解决。
文章指出,在线研究长期依赖“认真、连贯作答即好数据”的质量启发式,但自主AI代理如今几乎能通过所有常规质量检查,这一启发式已不再可靠。作者据此提出AI介导污染的 taxonomy(分类)与风险梯度,并给出相应建议,发表于 Advances in Methods and Practices in Psychological Science 第9卷第3期。
推荐理由:文章把AI代理污染在线被试数据的风险按类型和梯度梳理,并给出可操作的防范建议,对依赖线上样本的研究者有直接参考价值。
心理健康研究每年产出数千项临床试验,但仅少数被证实有效的干预能融入常规照护。如何将新干预整合进心理健康系统的人力、组织与资源约束中,仍是该领域的核心挑战。
Data Colada 发文解读 Francesca Gino 诉哈佛案中哈佛提交的第 222 号文件,其中包含取证专家 Julian Ackert 的 42 页报告。
传统横断面网络中心性指标无法区分症状间的因果方向,导致干预靶点选择出现偏差。NodeIdentifyR 算法(NIRA)通过基于模拟的方法解决这一问题,相关方法发表于 Advances in Methods and Practices in Psychological Science 第 9 卷第 3 期。
一篇系统综述梳理了经验取样法(ESM)研究从研究设计到数据分析各环节的方法学差异。作者指出,ESM 已广泛用于心理学与精神医学多个子领域,研究子领域和被试所关注构念的多样,带来了方法上的诸多不同。综述发表在 Advances in Methods and Practices in Psychological Science 第 9 卷第 3 期。
一项预注册研究纳入美国与加拿大的97名治疗师和6152名患者,发现治疗师的多模态特征与患者疗效基本无关。研究采用多模态评估方式考察治疗师层面的特征,作者据此指出,治疗师之间疗效差异的来源尚不明确。
推荐理由:预注册大样本研究提示,治疗师的多模态特征与患者疗效关联有限,为理解疗效差异来源提供参照。
一项元分析比较了日常日记研究(k = 230)中工作投入的个体内相关与聚合日得分及既往元分析得到的个体间相关。结果显示,日常与稳定工作投入的法则网络总体支持主要理论的跨层次预测,但部分关联强度存在差异,且无法归因于信度差异或聚合偏差。
一项方法学论文用 Many Labs 的沉没成本效应重复数据展示,仅含实验条件单一预测变量的 OLS 回归在 15 个实验室得到中位 R² = .051,而 10 折交叉验证的中位 R² 为 -.128。
共同生产(有亲身经历者与专业人员的平等协作)在心理健康领域快速发展,亲身经历的专业经验正被视为研究设计、执行、传播与转化的核心要素,主要资助方和一些期刊的实践也在推动其主流化。但当前共同生产的认识论与实施通常预设"亲身经历经验"与"研究或学术经验"的二元对立,尽管许多研究者和临床医生本身就有亲身经历。
心理学家几乎从不使用稳健标准误,但经济学家的普遍做法表明他们应该使用。稳健标准误解决的是异方差问题,即部分数据点比另一些噪声更大;由于回归系数对某些数据点的噪声远比另一些敏感,忽略噪声分布位置会低估标准误。