贝叶斯高效编码作为知觉理论:进展、争议与前景
贝叶斯高效编码统一了高效编码与贝叶斯推断两大感觉加工理论,认为自然环境统计规律同时塑造感觉信息的编码方式与知觉解读方式。该框架可解释反直觉的知觉偏差,并建立环境统计、偏差与辨别阈限之间的规律性关系。文章综述了知觉与认知领域的行为和神经证据,以及环境适应在该框架中的表达,并回顾了将反应偏差分解为编码与解码成分的理论拓展。
贝叶斯高效编码统一了高效编码与贝叶斯推断两大感觉加工理论,认为自然环境统计规律同时塑造感觉信息的编码方式与知觉解读方式。该框架可解释反直觉的知觉偏差,并建立环境统计、偏差与辨别阈限之间的规律性关系。文章综述了知觉与认知领域的行为和神经证据,以及环境适应在该框架中的表达,并回顾了将反应偏差分解为编码与解码成分的理论拓展。
两项实验考察了文化、语言与情境因素如何影响说话者在语言产出中选择空间视角。研究发现,说话者通常从自身视角描述场景,但也具备使用异我中心视角的能力,而文化与语言母语属性会影响这一选择。
一项发表于 Trends in Cognitive Sciences 的框架性研究提出,应将机器理解概念化为系统(S)与理解对象(T)之间的关系,并分别对关系、系统与对象三个要素作出更精确的界定。该框架借鉴哲学与认知科学,结合当前AI实践,目的不是为理解给出某一种特定解释,而是为评估和推进机器理解提供概念工具。
一项重复验证研究以115名大学生为被试,让其解答6道结构不良的统计题,考察自我解释质量是否中介样例效应。结果显示,该中介作用受先验知识与工作记忆容量调节,能力较低者间接效应更强;流体智力未起调节作用,转换能力则被确认为样例效应的调节变量,能力较低者从支架中获益更多。
两项实验分别以183名和169名小学四年级学生为被试,比较自我解释与教学解释对音乐知识学习的影响。结果发现,学习低元素交互性的音程知识时自我解释组表现最佳,而学习高元素交互性的和弦知识时教学解释组优于自我解释组。
一项综述从强化学习角度整合了仪式的两种解释:仪式参与既由仪式过程中情感与社会奖赏的习惯性强化(无模型学习)驱动,也由文化共享世界模型带来的务实与合作收益的强化(有模型学习)驱动。该框架综合了以往关于仪式影响不确定结果与促进社会凝聚的观点,并解释仪式如何在过去与现今社会中维系主体间对齐的世界模型。
一项研究通过操纵点阵的形式信息,为视觉形式知觉假说提供了直接证据。研究招募884名被试,分6岁以下和6岁以上两组,采用4项计算机化测试测量非符号数量、视觉形式知觉和算术能力。结果显示,控制总周长条件下的点比较任务最难,得分从4.1–5.7降至2.0,且该条件与视觉形式知觉和算术表现的关联最弱,表明数量感本质上是一种视觉形式知觉。
随着技术日益复杂,其运作机制对普通人愈发不透明,但神经科学研究提示这并未加重"技术大脑"的负担,反而可能对社会大脑提出新要求。文章从社会认知视角探讨技术不透明性如何影响人际互动与信任。
CORRECT-BD 试验比较了右侧单侧超短脉冲电休克治疗与磁惊厥疗法在双相抑郁患者中的临床与认知结局。研究结果发表于 American Journal of Psychiatry 第 183 卷第 10 期,页码 754-763。目前仅有摘要信息,具体样本量、效应量与结局数据尚未提供。
推荐理由:CORRECT-BD 试验直接比较两种神经调控疗法在双相抑郁中的临床与认知结局,为临床选择提供对照证据。
一项双盲随机平行组预试验将 55 名双相抑郁患者随机分配接受右侧单侧超短脉冲 ECT 或磁惊厥治疗(MST),最多 21 次治疗。
字母—声音的系统对应关系教学(自然拼读)是儿童在拼音文字系统中学习阅读的基础。阅读科学已揭示影响自然拼读教学有效性的若干因素,相关研究发表于 Perspectives on Psychological Science 第21卷第5期。
一项发表于 Clinical Psychological Science 的研究在青少年住院患者中考察自我图式与自杀意念(SI)、非自杀性自伤(NSSI)的纵向及双向关联。研究指出,消极自我图式已被确立为青少年期自杀意念和非自杀性自伤的风险因素,但其与两者之间的双向关系尚不清楚。原文为提前在线发表版本,摘要仅提供上述有限信息。
推荐理由:研究用纵向数据考察青少年住院患者自我图式与自杀意念、非自杀性自伤之间的双向关系,有助于理解认知因素在其中的作用方向。
一项基于 Oregon ADHD-1000 数据集的纵向、个体中心研究,探索执行功能(EF)与青少年外化精神病理发展进程的关系。研究采用探索性数据分析与多项逻辑回归,考察 EF 如何关联外化精神病理的发展轨迹。
针对真实场景中目标外观多变、物体嵌入复杂动态环境的特点,文章提出注意模板可能有两种运作方式:随场景情境调整的灵活模板,以及跨情境通用的稳定模板。作者综述了近期行为与神经影像证据,讨论最优搜索如何取决于对模板适应成本与收益的权衡。
工作记忆多成分模型最初由容量有限的中央执行系统及语音回路、视空间画板两个领域特异性系统构成,情景缓冲器的引入用以解释不同来源信息如何绑定为统一情节。后续发展提示该缓冲器是兼具存储、执行操作与注意控制、可被意识通达的多维界面,据此模型被重新表述,情景缓冲器更名为“意识缓冲器”并置于工作记忆的核心位置。
眼动追踪范式已被用于研究婴儿早期语言理解、词汇量个体差异及障碍人群的语言能力,但眼动与底层语言能力之间的关联假设仍存根本性疑问。研究者旨在阐明这些假设,并梳理现有证据是否支持其成立,进而为不同人群的语言发展研究提出注意事项。
有观点提出,语言的句法就是一组依存规则,无需短语结构和转换规则,这一最简方案能解释人类语言加工中的多种现象和跨语言语序共性,并在区分不同理论的关键案例上更贴合人类数据,同时消除句法可学习性问题。作者推测,大语言模型与儿童一样,从语言模式中习得依存语法,从而获得出色的句法能力。
一篇发表于 Perspectives on Psychological Science 的综合框架指出,自我声音在沟通与身份认同中起基础作用,但长期被心理科学忽视。随着 AI 生成与数字操控声音日益普遍,理解个体如何感知与加工自我声音变得更为重要。
针对“人类心智依赖符号系统”这一观点,有学者指出,现代神经网络及基于其构建的人工智能系统同样能组合想法、产生新意并快速学习,这可能削弱人类认知过程与表征具有符号性的论据。文章讨论了两种解释——神经网络实现了符号系统,还是以亚符号方式近似符号系统——及其在不同分析层面对人类认知解释的理论后果,并提出研究心智符号基础的新议程。
知觉多稳定性在多个物种和感觉通道中均可观察到,其知觉形成过程中的时间动态与信息整合差异常可区分临床与非临床人群。计算精神病学可通过贝叶斯建模与主动信息寻求(如强化学习)两种路径解释这些差异,前者将知觉视为无意识推理,后者将知觉切换视为内部动作。该现象有望成为临床应用中前景广阔的无创工具,推动转化研究并加深对认知过程及其损伤机制的理解。
意识科学中结构主义与功能主义、普遍与局部、内在与外在等竞争性理论框架正陷入哲学僵局,这些争论平行推进,缺乏理解彼此关系的系统框架。研究提出可从元理论层面用解释媒介、范围和视角三个基本维度来涵盖各种意识模型,并展示不同维度间的相互作用如何共同制约证据、语言与概念,从而将理论冲突重构为可处理的意见分歧。
一项发表于 Current Directions in Psychological Science 的综述指出,集体记忆研究不应只关注个体记住了什么,还需量化记忆内容之间的相互关联。过去一个多世纪,人类记忆实验研究主要聚焦个体孤立地学习与记忆,记忆科学家直到近30年才开始系统研究社会影响。
阅读研究需将神经与行为测量同步记录,既考察注视内足以启动眼跳决策的早期神经效应,也考察语言驱动的后期效应。研究发现,眼跳决策在词汇加工的中间阶段被触发,随后才完成词义识别及其与语境的整合,这一机制可解释眼睛扫过文本的速度为何能快于大脑的理解速度。
综述提出,内在神经时间尺度(INTs)可能是社会互动中跨时间尺度信息整合的关键机制,右侧颞顶联合区(rTPJ)是其中的关键枢纽。rTPJ 动态整合快速的镜像过程与缓慢的心理化过程,该区域的脑间同步可预测社会互动的成功,而个体间时间尺度不匹配则会导致沟通失败。该框架将双过程理论统一于单一神经生理机制,为理解社会互动及其损伤提供了可检验的新解释。
一篇发表于 Personality and Social Psychology Review 的综述提出,人类智能的核心之一是灵活与他人协作达成目标,而人工智能进入人类空间正对 AI 提出更多社会性要求。文章探讨个体、群体与 AI 如何相互促进或削弱彼此的智能。
一篇发表于 Trends in Cognitive Sciences 的观点文章提出,语言的根源不在抽象的非模态符号,而在早期身体经验。作者认为,嘴作为认知器官,既是发音部位,也是触觉感知与主体间交流的场所;语言可能通过原本用于摄食和动作理解的神经回路被复用而演化,这些回路受可供性、具身模拟和声音象征逐步塑造。
人们倾向于将女性视为单一类别、男性视为多样个体,这种概念上的不对称在自然情境中尤为明显。在性别类别框架下,人们会把男女描述为对称的对立面,如女性温暖、男性果敢;但缺少这一框架时,女性作为性别类别更突出,被赋予更窄的属性范围,而男性则获得更广泛的属性空间,甚至包括传统上与女性相关的温暖特质。
一篇综述梳理了五种可规模化的环保行为心理干预策略:助推、社会规范、教育、经济激励和自然接触,研究显示各策略均能有效促进环保行为,但效果程度不一。文章进一步探讨了这些干预背后的认知过程,包括启发式、启动和自我图式,并指出认知科学洞见既能提升干预效果,也有助于预防有害的非预期环境后果。
一篇发表于 Personality and Social Psychology Review 的理论文章提出,效价不对称(负性刺激比正性刺激引发更多加工投入)虽被广泛观察到,但理论上仍存争议。作者整合两大主要理论,给出了一个形式化解释,以推进这一争论。
儿童对位值概念的理解是掌握符号数字系统的基础,位值决定数字中每一位的数值取决于其所在位置。Current Directions in Psychological Science 刊发的这篇综述梳理了儿童如何逐步发展出对位值的理解。
近期研究识别出在数秒尺度上发生的快速巩固过程,称为"微巩固",挑战了记忆巩固通常需要数小时的既有观点。行为学证据来自休息/练习时长操纵、序列任务范式以及干扰或双任务操作,海马神经重放和额顶网络离线beta振荡活动为微巩固机制提供了支持。在线与离线过程对学习的相对贡献取决于任务性质与需求,并可能受注意、反应抑制和疲劳效应影响。
移动式VR(ambulatory VR)通过支持沉浸式环境中更自然的运动、动作与互动,为在生态效度情境下研究认知与神经系统提供了新路径。该综述指出,这类范式借助具身感觉运动参与,丰富了记忆、导航与认知控制的研究,并探讨了其在衰老与疾病中可能的补偿机制。文章还讨论了将移动式VR与移动神经影像结合的方法学挑战与机遇。
一篇发表于 Trends in Cognitive Sciences 的综述提出,文化对认知的"塑造"可分为四条性质不同的路径:保留某些认知过程而让替代过程保持完整、剪除并不可逆地失去未使用的替代过程、产生新的认知过程,或对认知完全没有影响。作者将该框架应用于视觉错觉、大数精确表征和空间—数字关联三个长期争议效应,以厘清争论并锐化实证预测。
一篇发表于《Personality and Social Psychology Review》的理论文章提出,主动推断框架将神经系统建模为预测和调节感觉输入的统计引擎,知觉与行为在该框架下服务于同一目标。文章以此视角探讨身份与体验,将自我理解为主动推断过程。
尽管AI越来越聪明,其智慧却未同步跟进。一篇观点文章将人类智慧界定为解决分析技术无法处理的棘手问题的策略,包括启发式等“客体层面”策略,以及智力谦逊、换位思考、情境适应等“元认知”策略,并指出AI系统在元认知方面尤为薄弱。文章讨论了智慧型AI的基准测试、训练与实现方式。
婴儿的“面孔饮食”——即其与面孔视觉互动的性质和数量——被视为理解面孔知觉个体差异的切入点。个体在面孔知觉上的专长差异在出生后第二年已变得明显。该文提出这一视角,用以解释婴儿面孔知觉的发展路径。
一项功能磁共振研究分析了青少年在执行工作记忆任务时的瞬时网络状态,探讨执行功能障碍与抑郁风险的关联。研究关注抑郁风险背后外部导向与内部导向注意之间的失衡,相关神经关联此前尚不明确。
数字能力起源的争论可通过区分"数量内容"与"表征格式"来调和:数量是物理对象的属性,人类和许多动物天生对数量内容敏感,但内容如何被表征是另一问题,可能由先天估算系统非符号化编码,也可能通过数字符号和数词等文化格式符号化编码。来自发展心理学、比较认知、神经科学和计算的汇聚证据表明,数字由生物禀赋与文化实践动态共同建构,该框架可推广至几何和语言等其他认知领域。
针对 Nedergaard 和 Lupyan(2024)用四项研究验证无内心言语(anendophasia)的做法,Lind(2025)认为包括该研究在内尚无人证明无内心言语存在。这篇评论以无内心言语为例,讨论研究中的保真度与效度问题。
一项三层元分析汇总了焦虑与解释偏差的关联,解释偏差被视为焦虑障碍的跨诊断特征。研究进一步考察了影响该偏差大小的调节因素,原文摘要未给出具体效应量与纳入研究数量。
推荐理由:三层元分析汇总焦虑与解释偏差的关联强度,并考察调节因素,可为认知模型提供量化参照。