跳到正文
原文
PsyArXiv 预印本·· 2 小时前AI 评分36

任务复杂度、内部言语类比提示与提示设计如何塑造 LLM 在两步任务中的模型化强化学习表现

Echoes of Thought: Task Complexity, Inner Speech Analogs, and Prompt Design Shape LLMs' Response

AI 导读

一项预印本研究用两步任务测试 GPT-3.5 和四个开放权重 LLM,发现 GPT-3.5 仅在简化任务中表现出模型化强化学习特征,任务去简化后该效应消失。加入要求反思既往试次并预判未来行动后果的内部言语类比提示后,模型化推理特征可重新出现;开放权重 LLM 在去简化和促进性任务条件下该特征均减弱。

来源:PsyArXiv 预印本 · osf.io