跳到正文

全部动态

今日 0 条
9月4日周五
  1. Journal of Counseling & Development22

    大学生样本中 GAD-7 得分的心理测量学分析

    一项针对 568 名美国大学生的研究检验了 GAD-7 的心理测量学特征,结果显示其得分呈单维因子结构,拟合指标大多优良。该量表在男女群体以及白人学生与有色人种学生之间均达到强测量不变性,总量表 alpha 系数大于 0.85。研究者认为 GAD-7 心理测量学表现良好,可作为心理咨询师免费、快速、易施测的广泛性焦虑筛查工具。

9月2日周三
9月1日周二
  1. Center for Open Science22

    开放科学中心问答:Colubri 谈 Epigame 疫情游戏研究与预注册更新

    马萨诸塞大学陈医学院助理教授 Andres Colubri 的 Epigame 研究用手机游戏结合蓝牙近距离感应模拟疫情传播,通过随机对照试验检验提高自愿隔离的游戏内成本是否改变人们的隔离选择。该研究已在 OSF 注册,并在数据促使团队拒绝原假设后更新了预注册。Colubri 将预注册视为研究者自建的“科学可重复性封印”,论文只是研究记录的一部分。

8月31日周一
8月28日周五
8月26日周三
8月22日周六
  1. Autism40

    应对孤独症研究中的常见问题:一项参与式、真实世界孤独症成人结局纵向研究的队列构建与样本描述

    针对成人孤独症服务研究难以获得代表性或异质性样本、实验方法与真实世界场景脱节等问题,一项发表于 Autism 的研究构建了参与式、真实世界的孤独症成人结局纵向队列并描述其样本特征。该研究由 Academic Autism Spectrum 相关方参与推进,旨在回应成人孤独症研究中的常见方法学挑战。

8月20日周四
  1. Advances in Methods and Practices in Psych Science42

    模型(误)设定如何影响有调节的中介分析中的统计功效、I 类错误率与参数偏差?一项注册报告

    一项注册报告考察了有调节的中介模型中路径调节项的设定方式如何影响统计功效、I 类错误率和参数偏差。研究聚焦研究者在选择哪些路径受调节时面临的过度设定与设定不足问题,相关结果发表于 Advances in Methods and Practices in Psychological Science 第 9 卷第 3 期。

  2. Advances in Methods and Practices in Psych Science40

    使用 AWARE 框架采集智能手机传感数据

    随着智能手机普及,研究者开始利用手机采集的地理位置与通讯等数据来理解和预测人类行为,这类数据更客观且以非侵入方式测量。文章介绍了使用 AWARE 框架采集智能手机传感数据的方法,发表于 Advances in Methods and Practices in Psychological Science 第 9 卷第 3 期。

8月11日周二
8月7日周五
  1. Center for Open Science50

    预测可重复性挑战赛第三轮结果:15支团队预测46项健康行为主张,仅8支优于基线

    开放科学中心(COS)举办的"预测可重复性挑战赛"第三轮中,15支团队对46项主张提交了可重复性预测,其中41项已完成重复验证并纳入分析,仅8支团队的模型优于0.25的Brier分数基线,而第二轮全部15支团队均优于该基线。第三轮实际重复率为46%,低于前两轮的52%和55%,校准偏弱可能是表现下滑的主因。

8月5日周三
8月4日周二
7月30日周四
  1. Advances in Methods and Practices in Psych Science58

    用大语言模型模拟人类数据时的分析灵活性威胁

    社会科学研究者正使用大语言模型生成“硅样本”,即用来替代人类被试的合成数据集。文章指出,生成这类样本涉及模型选择、抽样等多项分析选择,由此带来的分析灵活性构成威胁。该文发表于 Advances in Methods and Practices in Psychological Science 第9卷第3期。

7月20日周一
  1. Educational Psychologist22

    自我调节学习研究方法的重塑:随机对照试验与 N=me 之争

    《Educational Psychologist》刊文比较了随机对照试验与 N=me 两种方法在自我调节学习研究中的适用性。文章指出,随机对照试验擅长检验干预的平均效应,而 N=me 设计更适合刻画个体内部随时间变化的过程。作者主张根据研究问题在这两类方法之间做出选择,而非相互替代。

7月9日周四
  1. Personnel Psychology52

    研究提出用因子分析替代相关法估计AI评分的评分者间信度

    研究指出,将大语言模型(LLM)评分与专家评分做相关来估计评分者间信度(IRR)并不合适,因为相关法假设AI与人类评分平行,而这一条件难以成立。作者提出因子分析替代方案,把AI评分与专家评分建模为同一潜在构念的同质指标,以标准化AI载荷的平方估计AI的IRR。

  2. Advances in Methods and Practices in Psych Science62

    AI介导的在线研究数据污染:分类、风险梯度与建议

    文章指出,在线研究长期依赖“认真、连贯作答即好数据”的质量启发式,但自主AI代理如今几乎能通过所有常规质量检查,这一启发式已不再可靠。作者据此提出AI介导污染的 taxonomy(分类)与风险梯度,并给出相应建议,发表于 Advances in Methods and Practices in Psychological Science 第9卷第3期。

    推荐理由:文章把AI代理污染在线被试数据的风险按类型和梯度梳理,并给出可操作的防范建议,对依赖线上样本的研究者有直接参考价值。

7月2日周四
6月8日周一
  1. Legal and Criminological Psychology45

    自评与临床评估的精神病态:同一支温度计吗?

    一项基于 Pathways to Desistance 研究数据的分析,采用 NEAT–SG 等值设计将 PCL–YV 与 YPI 进行连接,发现等值分数虽精度高(SEE 值紧密聚集),但与实际观测分数偏差较大、准确性差。在 PCL–YV 传统阈值 ≥30 附近的临床重要区间内,等值分数与观测分数竟呈负相关。研究提示,自评量表要成为临床显著精神病态的有效筛查工具,需满足比等值精度更严格的条件。

5月18日周一
  1. Legal and Criminological Psychology40

    中国青少年犯罪倾向量表(JCPS)的编制与核心特征

    研究编制了青少年犯罪倾向问卷(JCPS),最终版含32个条目,验证性因素分析支持四因子三阶模型,内部一致性Cronbach's α = .91,重测信度0.86。该量表在性别上具强测量等值性、组间为弱等值性,犯罪倾向与自我控制、公正世界信念显著负相关,与道德推脱、品行问题倾向显著正相关。网络分析显示不同情境下青少年犯罪倾向的核心特征各异,为分层预防提供了干预靶点。

4月22日周三
3月19日周四
3月2日周一
2月16日周一
12月15日周一
12月10日周三
  1. Data Colada38

    二次回归为何会凭空造出倒U形:对JEP:G生成式AI与创造力研究Study 3的质疑

    一项发表于JEP:G、声称生成式AI使用与创造力呈倒U形关系的研究(Study 3),其U形被指为伪影。该研究对创意工作者做两波调查,由主管用九项量表评定创造力,二次项显著。但加入置信带后,单调关联远未被排除;改用two-lines检验后U形不显著(p = .81)。作者指出,38%的数据集中在AI使用1–2分区间,二次回归为拟合该处陡峭斜率而被迫在高分区弯出负斜率。

11月17日周一
  1. Data Colada22

    ResearchBox 更新:更易用,并通过 Zenodo 备份实现更透明的永久保存

    ResearchBox 新增 Zenodo 备份并为每个公开数据盒生成 DOI,同时放宽数据代码本要求、优化上传分组并打通 AsPredicted 账号。一项 N=30 的随机调查显示,被试在 ResearchBox 上判断数据是否可获取、下载研究材料的速度和易用性评价均优于 OSF,其中成功回答 Study 4 数据问题的中位耗时分别为 31 秒和 126 秒。

10月11日周六
9月23日周二
  1. Data Colada36

    JASA 将刊批评 p-curve 的四种统计特性,原作者回应称实践中仍稳健

    统计期刊 JASA 即将发表对 p-curve 的批评,指出其存在四种不良统计特性,包括对接近 .05 或 .025 截断值的 p 值过度敏感、单调性可能被违反等。p-curve 开发者回应称,模拟显示单调性违反仅在 0.2%–2.8% 的模拟中出现,加入 p = .04988 的极端值后检验力下降 0.1%–5%,且 p-curve 应用已内置排除极端值的稳健性检验。

6月23日周一
  1. Data Colada38

    一项 LinkedIn 审计研究:种族歧视实验中的刺激材料多样性不足

    一项发表于 QJE 的 LinkedIn 审计研究通过约 400 个虚构年轻男性账号发送了 3 万多条连接请求,发现黑人照片的连接接受率更低,但接受后获得职业建议的比例相当。Data Colada 指出该研究虽在随机化和刺激配对设计上颇为精巧,但 197 对 AI 生成照片在吸引力上高度相似,刺激材料多样性不足,可能限制结论的推广。

6月2日周一
4月1日周二
  1. Data Colada20

    中位数在彩票估值中真的“刀刃般不稳定”吗:对 Oprea 回应的再回应

    针对 Oprea 对“复杂性”批评的回应,本文指出其数据并不支持中位数“不稳定”和“不具代表性”两点主张。在 150 次自助抽样中,多数镜像前景的中位数标准误为 0,取值完全一致;而被质疑的聚合中位数 CDF 排除了 G50 和 L50 两个前景,且聚合中位数并非作者实际分析的对象。按均值与中位数附近观测占比比较,中位数代表性明显更高,且中位数准确复现了彩票与镜像的差异及前景理论预测模式。

3月6日周四
3月5日周三
  1. Data Colada22

    政治学者注意:分箱估计量违反 ceteris paribus

    Data Colada 发文指出,Hainmueller、Mummolo 和 Xu(HMX)2019 年提出的分箱估计量在观察数据中常存在偏差,双方分歧的核心在于分析交互作用时是否应遵循 ceteris paribus。作者以博士招生为例说明,当交互项中的变量相关时,非线性会污染交互效应估计,而 HMX 所选估计目标并未反映研究者真正想问的问题。