三个实验共 1,951 人:先选想向人类还是 AI 倾诉,再被随机分到「如愿」或「不如愿」。只有自己选了 AI 的人,才觉得 AI 的支持更好。
但无论如愿与否,只要和 AI 聊过一次,下次愿意选 AI 的比例都上升了。
与 OpenAI 合作的 28 天日记式研究(981 人):偏好逐日向 AI 漂移、远离人类,且只在对话转向私人话题时发生;聊事务性内容不漂移。
边界:arXiv 预印本,未经同行评审;测到的是偏好漂移,研究既未作成瘾判定,也没有说 AI 支持有害。
1实验
被硬塞的 AI 安慰,并没有传说中那么好
这项研究先补上了以前实验缺的一块:想要的和得到的不一致时,会怎样。
此前不少研究发现,AI 的共情回复常被评得不输甚至优于人类。但那些实验要么把支持来源硬性指派给参与者,要么完全尊重本人选择;现实里最常见的第三种情形反而没人测:你想找人,得到的却是机器,或者反过来。Goldenberg 团队用三个实验补这一块,共 1,951 人:参与者先选择想跟人类还是 AI 分享一段情绪经历,然后被随机分到「如愿」或「不如愿」的对象。
自己选了 AI(如愿组)
觉得 AI 的支持确实更好。选择本身参与了体验的打分。
被硬塞 AI(不如愿组)
没这待遇。同样的 AI、同样的回复,评价并没有更好。
也就是说,此前「AI 共情不输人类」的漂亮成绩里,可能有一部分分数来自「这是我自己选的」。
2漂移
嘴上没给高分的人,手上的选择也在挪
真正让研究者在意的,是所有组共有的第二个发现。
无论如愿与否,只要和 AI 聊过,下一次愿意选 AI 的比例都上升了。被硬塞的人没在评价上给 AI 加分,做下一次选择时,却和如愿组朝同一个方向挪。为了看这股力道能走多远,团队与 OpenAI 合作做了第四个研究:981 人、28 天的日记式实验,每天和 AI 对话。结果偏好逐日向 AI 漂移、远离人类。里面有个开关式的细节:只在对话转向私人话题时才漂移,聊事务性内容就不动。
Source: arXiv preprint (2026-08; arXiv:2608.23196; experiments N=1,951 and a 28-day diary study N=981 with OpenAI). Every chat quietly becomes the reason for the next one — preference is written by use, not stored in the mind. Preprint, not yet peer-reviewed.
不管当初如愿没如愿,只要和 AI 聊过,下一次愿意选 AI 的比例都上升了。被硬塞的人嘴上没给 AI 加分,轮到再选一次时,手却和如愿组往同一个方向挪。团队想看看这股劲能走多远,就与 OpenAI 合作做了第四个研究:981 人、28 天的日记式实验,每天和 AI 对话。结果偏好一天天往 AI 那边漂、离人类越来越远。里面有个开关一样的细节:只有对话转向私人话题时才漂,聊事务性的内容就不动。
它是 arXiv 预印本,还没过同行评审;它测到的是偏好漂移,够不上「成瘾」两个字;它也没有说 AI 支持有害。这几条界线我记得格外牢,是交过学费的:2013 年读研二,我跟着一场 TED 演讲迷上「高能量姿势」,天天在复旦文科图书馆五楼的消防通道里叉腰站两分钟,还写进了课程报告,两年后那项研究复现接连翻车,导师在报告边上批了四个字:等等再信。所以这项研究再合我的胃口,我也先把它记在「等等再信」那一页。深夜找 AI 说几句,不丢人,也未必是坏事。真正值得你留意的是漂移发生的位置:它只在私人话题上出现。咨询室里坐了八年,我见的就是几百个把最难启齿的话慢慢摊开的人;被一点点改道的,恰好是原本通向某个具体的人的那一部分。
三个实验共 1,951 人:先选想向人类还是 AI 倾诉,再被随机分到「如愿」或「不如愿」。只有自己选了 AI 的人,才觉得 AI 的支持更好。
但无论如愿与否,只要和 AI 聊过一次,下次愿意选 AI 的比例都上升了。
与 OpenAI 合作的 28 天日记式研究(981 人):偏好逐日向 AI 漂移、远离人类,且只在对话转向私人话题时发生;聊事务性内容不漂移。
边界:arXiv 预印本,未经同行评审;测到的是偏好漂移,研究既未作成瘾判定,也没有说 AI 支持有害。
1实验
被硬塞的 AI 安慰,并没有传说中那么好
这项研究先补上了以前实验缺的一块:想要的和得到的不一致时,会怎样。
此前不少研究发现,AI 的共情回复常被评得不输甚至优于人类。但那些实验要么把支持来源硬性指派给参与者,要么完全尊重本人选择;现实里最常见的第三种情形反而没人测:你想找人,得到的却是机器,或者反过来。Goldenberg 团队用三个实验补这一块,共 1,951 人:参与者先选择想跟人类还是 AI 分享一段情绪经历,然后被随机分到「如愿」或「不如愿」的对象。
自己选了 AI(如愿组)
觉得 AI 的支持确实更好。选择本身参与了体验的打分。
被硬塞 AI(不如愿组)
没这待遇。同样的 AI、同样的回复,评价并没有更好。
也就是说,此前「AI 共情不输人类」的漂亮成绩里,可能有一部分分数来自「这是我自己选的」。
2漂移
嘴上没给高分的人,手上的选择也在挪
真正让研究者在意的,是所有组共有的第二个发现。
无论如愿与否,只要和 AI 聊过,下一次愿意选 AI 的比例都上升了。被硬塞的人没在评价上给 AI 加分,做下一次选择时,却和如愿组朝同一个方向挪。为了看这股力道能走多远,团队与 OpenAI 合作做了第四个研究:981 人、28 天的日记式实验,每天和 AI 对话。结果偏好逐日向 AI 漂移、远离人类。里面有个开关式的细节:只在对话转向私人话题时才漂移,聊事务性内容就不动。