跳到正文

#AI与心理

今日 0 条
10月2日周五
  1. PsyArXiv 预印本42

    用大语言模型为心理治疗研究中的微笑提供语境:基于依恋访谈的方法学

    一项预印本研究提出用大语言模型为心理治疗研究中的微笑补充语境,将双方微笑与谈话轮次的情感效价(正性、中性、负性)关联。在70次依恋访谈、1,294个谈话轮次中,仅访谈者的微笑随被试话语情感显著变化(d = .51,q < .001),被试自身微笑无显著差异(d = .05,q = .165);双方在正性轮次比负性轮次更常同时微笑(d = .21,p < .001)。

9月19日周六
  1. Advances in Methods and Practices in Psych Science60

    在心理学论文中寻找生成式人工智能的指纹

    发表在 Advances in Methods and Practices in Psychological Science 的文章指出,生成式人工智能尤其是大语言模型已嵌入研究过程,越来越多科学家用其协助撰写稿件。作者关注的是能在多大程度上识别出心理学出版物中 LLM 参与的痕迹。

    推荐理由:文章讨论如何在心理学论文中识别大语言模型参与写作的痕迹,为期刊与审稿人判断稿件来源提供方法参考。

9月1日周二
  1. Center for Open Science22

    开放科学中心问答:Colubri 谈 Epigame 疫情游戏研究与预注册更新

    马萨诸塞大学陈医学院助理教授 Andres Colubri 的 Epigame 研究用手机游戏结合蓝牙近距离感应模拟疫情传播,通过随机对照试验检验提高自愿隔离的游戏内成本是否改变人们的隔离选择。该研究已在 OSF 注册,并在数据促使团队拒绝原假设后更新了预注册。Colubri 将预注册视为研究者自建的“科学可重复性封印”,论文只是研究记录的一部分。

7月30日周四
  1. Advances in Methods and Practices in Psych Science58

    用大语言模型模拟人类数据时的分析灵活性威胁

    社会科学研究者正使用大语言模型生成“硅样本”,即用来替代人类被试的合成数据集。文章指出,生成这类样本涉及模型选择、抽样等多项分析选择,由此带来的分析灵活性构成威胁。该文发表于 Advances in Methods and Practices in Psychological Science 第9卷第3期。

7月9日周四
  1. Personnel Psychology52

    研究提出用因子分析替代相关法估计AI评分的评分者间信度

    研究指出,将大语言模型(LLM)评分与专家评分做相关来估计评分者间信度(IRR)并不合适,因为相关法假设AI与人类评分平行,而这一条件难以成立。作者提出因子分析替代方案,把AI评分与专家评分建模为同一潜在构念的同质指标,以标准化AI载荷的平方估计AI的IRR。

  2. Advances in Methods and Practices in Psych Science62

    AI介导的在线研究数据污染:分类、风险梯度与建议

    文章指出,在线研究长期依赖“认真、连贯作答即好数据”的质量启发式,但自主AI代理如今几乎能通过所有常规质量检查,这一启发式已不再可靠。作者据此提出AI介导污染的 taxonomy(分类)与风险梯度,并给出相应建议,发表于 Advances in Methods and Practices in Psychological Science 第9卷第3期。

    推荐理由:文章把AI代理污染在线被试数据的风险按类型和梯度梳理,并给出可操作的防范建议,对依赖线上样本的研究者有直接参考价值。

12月15日周一
12月10日周三
  1. Data Colada38

    二次回归为何会凭空造出倒U形:对JEP:G生成式AI与创造力研究Study 3的质疑

    一项发表于JEP:G、声称生成式AI使用与创造力呈倒U形关系的研究(Study 3),其U形被指为伪影。该研究对创意工作者做两波调查,由主管用九项量表评定创造力,二次项显著。但加入置信带后,单调关联远未被排除;改用two-lines检验后U形不显著(p = .81)。作者指出,38%的数据集中在AI使用1–2分区间,二次回归为拟合该处陡峭斜率而被迫在高分区弯出负斜率。

11月17日周一
  1. Data Colada22

    ResearchBox 更新:更易用,并通过 Zenodo 备份实现更透明的永久保存

    ResearchBox 新增 Zenodo 备份并为每个公开数据盒生成 DOI,同时放宽数据代码本要求、优化上传分组并打通 AsPredicted 账号。一项 N=30 的随机调查显示,被试在 ResearchBox 上判断数据是否可获取、下载研究材料的速度和易用性评价均优于 OSF,其中成功回答 Study 4 数据问题的中位耗时分别为 31 秒和 126 秒。

6月23日周一
  1. Data Colada38

    一项 LinkedIn 审计研究:种族歧视实验中的刺激材料多样性不足

    一项发表于 QJE 的 LinkedIn 审计研究通过约 400 个虚构年轻男性账号发送了 3 万多条连接请求,发现黑人照片的连接接受率更低,但接受后获得职业建议的比例相当。Data Colada 指出该研究虽在随机化和刺激配对设计上颇为精巧,但 197 对 AI 生成照片在吸引力上高度相似,刺激材料多样性不足,可能限制结论的推广。