两篇被指由AI生成、疑似未真正分析OpenNeuro脑影像数据的论文正被Elsevier调查
牛津大学发展神经心理学荣休教授Dorothy Bishop在审稿时发现,一篇投稿对OpenNeuro公开数据集(50名被试的功能性MRI原始扫描)的描述与原始研究不符,随后检索作者姓名又发现《Journal of Neurolinguistics》今年发表的两篇论文疑似由AI生成。
牛津大学发展神经心理学荣休教授Dorothy Bishop在审稿时发现,一篇投稿对OpenNeuro公开数据集(50名被试的功能性MRI原始扫描)的描述与原始研究不符,随后检索作者姓名又发现《Journal of Neurolinguistics》今年发表的两篇论文疑似由AI生成。
诺贝尔奖得主 2015 年的一篇论文被永久标注“关注”,其撤稿数量在诺奖得主撤稿榜上以 15 篇居首。美国司法部官员在 2025 年就“党派”观点质询了十余家期刊。此外,AI 生成科学存在“合成效度”问题,一项调查显示四分之三的研究者不确定该披露哪些 AI 使用情况。
一项8月31日发布在arXiv的分析追踪了1,975篇至少有一位作者标注Pharmakon Neuroscience Network(PNN)为机构隶属的论文,发现其中480篇被专利引用、57篇出现在政策文件中、12篇出现在临床指南里,而PNN实为论文买卖网络。
Data Colada 对 Ariely 和 Wertenbroch 2002 年发表于 Psychological Science 的截止日期与拖延研究进行取证分析,发现 Study 1 中“自设截止日期”组有 13 名学生的最终成绩被手动修改,其中 12 处改动方向符合作者假设,去掉这些改动后论文的关键发现即消失。
推荐理由:通过比对早期手稿与发表版本的统计量,可以了解数据篡改如何被逐行还原出来。
JAMA Psychiatry 就 2026 年 3 月 11 日发表的 Li 等人研究《Clozapine After 1 Failed Antipsychotic Drug Trial in First-Episode Psychosis。
推荐理由:期刊披露一项已发表试验在数据收集结束后才修改注册记录,涉及主要结局与样本量,可供关注临床试验透明度的读者参考。
一项即将发表于 Psychological Science 的重复研究未能重现 Ariely 和 Wertenbroch 2002 年关于截止日期与拖延的 Study 2 结果。
推荐理由:一项重复研究未能重现经典截止日期效应,作者随后对原始数据文件的分析指向数据异常,可供关注科研诚信与可重复性的人参考。
开放科学中心(COS)正在招募志愿者加入透明度与开放促进(TOP)指南顾问委员会,负责为该指南的制定、实施与推广提供指导与监督。TOP 是旨在提高实证研究可验证性的政策框架,已于 2025 年更新,更新内容近期发表于 Research Integrity and Peer Review(Grant 等,2026)。申请或提名截止日期为 2026 年 9 月 21 日。
开放科学框架(OSF)宣布调整定位,将资源集中于研究计划与预注册、跨生命周期连接研究产出、分享预印本与论文,其他功能改为与专业基础设施对接而非自建。OSF 目前每年维持现有规模需约 400–500 万美元,约占 COS 总运营预算的一半,收入约 10% 来自服务收费,其余主要依赖资助。
OSF 团队通知用户,自 2026 年 11 月起 OSF 将不再接受新文件上传,Brian Nosek 解释原因是平台遭垃圾信息发送者和研究者滥用,维护成本难以持续。
开放科学中心(COS)宣布将对 Open Science Framework(OSF)做出重大调整,未来数月内部分功能将不再由 OSF 自身支持,用户需要重新设计既有工作流程。
Data Colada 发文解读 Francesca Gino 诉哈佛案中哈佛提交的第 222 号文件,其中包含取证专家 Julian Ackert 的 42 页报告。
《Current Directions in Psychological Science》第35卷第4期(2026年8月)刊出致谢,页码254-255。该期致谢列出对本刊作出贡献的人员。
Data Colada作者Joe Simmons称,因Francesca Gino起诉其诽谤,哈佛一份1288页调查报告被公开,其中披露了Gino、Kouchaki和Casciaro(2020)研究3A的原始数据集。
Data Colada 公开了原定 2019 年发布、因收到疑似死亡威胁而搁置的调查,指出 Ping Dong 与 Chen-Bo Zhong 2017 年发表于 Psychological Science 的论文存在数据异常,该论文已于 2018 年撤稿。
推荐理由:作者公开了当年因威胁而搁置的数据造假调查,用五条时间戳证据说明数据可能是在采集阶段被伪造的。
因指出 Francesca Gino 合著的四项研究存在数据造假,Data Colada 三位作者遭其提起 2500 万美元诽谤诉讼,并已向马萨诸塞州联邦法院申请驳回。4 月 26 日听证会上,双方就涉案陈述是否属于“观点”及 Gino 是否属公众人物展开辩论,法官尚未裁定是否驳回。
Data Colada 发文梳理 Francesca Gino 诉讼中作为证据的哈佛撤稿请求(Exhibits 3、4、5),其中引用了哈佛聘请的独立取证公司的报告。
推荐理由:哈佛提交的撤稿请求首次公开了独立取证公司对四篇论文数据比对的细节,可了解学术不端调查如何取证。
Data Colada 作者此前报告四篇论文存在数据篡改证据,这些论文随后被撤稿,几周前他们因此被起诉。为应对诉讼发起的筹款已获得超过2600名捐赠者支持,涵盖社会科学、生命科学、健康科学、计算机科学、统计学等领域,包括诺贝尔奖得主、各级教职人员和学生。作者已聘请法律团队,其三个雇主 Penn、Berkeley 和 ESADE 表示将至少支持诉讼初期阶段,并称案件可能持续数月甚至数年。
Data Colada 系列第四篇指出,Gino、Kouchaki 与 Casciaro 2020 年发表于 Journal of Personality and Social Psychology 的研究中,Study 3a(N = 599 名 MTurk 被试)的“道德不洁”评分可能被篡改。
推荐理由:作者用被试写下的词语与评分不匹配,指出论文数据可能被篡改,为识别数据造假提供了一种可迁移的核查思路。
Data Colada 系列第三篇指出,Gino 与 Wiltermuth 2014 年发表于 Psychological Science 的研究中,实验 4 的数据几乎完全按“是否作弊”和“报纸用途数量”两列排序,其中 13 个作弊者观测值顺序异常,疑似排序后被手动修改。
推荐理由:通过数据排序异常与模拟检验,展示了识别数据篡改的一种可迁移取证思路。
Data Colada 系列文章第二部分称,Francesca Gino 等人 2015 年发表于 Psychological Science 的研究中,Study 4 的数据集出现异常:491 名哈佛学生被问及“Year in School”时,有 20 人回答“Harvard”,且这些记录集中在数据文件第 450 至 484 行之间。
推荐理由:文章用一份数据集中的异常作答记录,展示了识别数据篡改痕迹的一种可迁移核查思路。
Data Colada 发布四篇系列文章的第一篇,披露哈佛商学院教授 Francesca Gino 合著的四篇论文存在数据造假证据。作者称 2021 年与匿名研究团队审查了 Gino 的多项研究,并向哈佛商学院提交了证据最强的四篇论文报告。
推荐理由:作者公开对四篇论文的数据造假证据,并说明哈佛已要求撤稿三篇,可了解学术不端调查与撤稿流程。
Data Colada 与一组匿名研究者分析 Kristal 等人 2020 年公开的原始数据后指出,2012 年发表于 PNAS 的一项现场实验(N = 13,488,由美国东南部一家汽车保险公司实施)存在数据伪造证据。
推荐理由:通过字体、取整和分布异常还原数据造假手法,并说明公开数据为何是发现问题的关键。