vlog
← 返回全部文章

Psychology

1,951 人的实验:被硬塞的 AI 安慰并不更好,可聊过一次,下一次你就更想选它

2026年8月31日 · 丹·艾瑞里《怪诞行为学》~1 min read

凌晨一点,你被一件事堵得睡不着,想找个人说说。通讯录翻到一半停住了:这个明天要早起,那个上礼拜刚听你倒过苦水,剩下几个,开口前得先寒暄十分钟。屏幕上还有一个对话框,秒回,不困,不欠人情。2026 年 8 月 24 日挂上 arXiv 的一项研究(编号 2608.23196,通讯作者是哈佛的 Amit Goldenberg),盯上的就是你点开它之后发生的事。

30 秒读懂
1实验

被硬塞的 AI 安慰,并没有传说中那么好

这项研究先补上了以前实验缺的一块:想要的和得到的不一致时,会怎样。

此前不少研究发现,AI 的共情回复常被评得不输甚至优于人类。但那些实验要么把支持来源硬性指派给参与者,要么完全尊重本人选择;现实里最常见的第三种情形反而没人测:你想找人,得到的却是机器,或者反过来。Goldenberg 团队用三个实验补这一块,共 1,951 人:参与者先选择想跟人类还是 AI 分享一段情绪经历,然后被随机分到「如愿」或「不如愿」的对象。

自己选了 AI(如愿组)

觉得 AI 的支持确实更好。选择本身参与了体验的打分。

被硬塞 AI(不如愿组)

没这待遇。同样的 AI、同样的回复,评价并没有更好。

也就是说,此前「AI 共情不输人类」的漂亮成绩里,可能有一部分分数来自「这是我自己选的」。

2漂移

嘴上没给高分的人,手上的选择也在挪

真正让研究者在意的,是所有组共有的第二个发现。

无论如愿与否,只要和 AI 聊过,下一次愿意选 AI 的比例都上升了。被硬塞的人没在评价上给 AI 加分,做下一次选择时,却和如愿组朝同一个方向挪。为了看这股力道能走多远,团队与 OpenAI 合作做了第四个研究:981 人、28 天的日记式实验,每天和 AI 对话。结果偏好逐日向 AI 漂移、远离人类。里面有个开关式的细节:只在对话转向私人话题时才漂移,聊事务性内容就不动。

核心

「我用过它」这个事实本身在投票:私人话题聊过一次,下一次的选择就被推了一小把,推的方向与你当初愿不愿意无关。

作者把这叫路径依赖:每一次使用都在把下一次的选择往 AI 那边推,一步步从人际连接改道。

PREFERENCE ISN'T MEASURED — IT'S WRITTEN BY USE A first chat with AI chosen — or assigned The experience chose it → rated better assigned → no better rating “I used it” becomes evidence good or bad — it still counts Next choice tilts to AI rises in every group SELF-HERDING behind yesterday's you · Ariely each loop drifts further from humans 28-DAY DIARY STUDY · N=981 drift only on personal topics task talk: no drift the preference loop drift condition
Source: arXiv preprint (2026-08; arXiv:2608.23196; experiments N=1,951 and a 28-day diary study N=981 with OpenAI). Every chat quietly becomes the reason for the next one — preference is written by use, not stored in the mind. Preprint, not yet peer-reviewed.
3机理

你不光排在别人后面,还排在昨天的自己后面

这种漂移,艾瑞里在《怪诞行为学》里写过,名字叫「自我羊群效应」。

普通的羊群效应是看别人排队:那家店人多,应该不错。自我羊群效应是排在自己后面:我上次既然用了它,它应该不错。于是第一次的偶然,变成第二次的理由,再变成第三次的习惯。书里还有个配套概念「任意连贯性」:起点可以完全是任意的,比如实验里被随机塞来一个 AI;可此后的一致性是真实的,你会围着那个任意的起点,做出一连串彼此呼应的决定。

打个比方

奶茶店门口,你不光看哪家队伍长,还会翻自己昨天的小票:上次买的这家,应该不难喝。你多半忘了,上次选它只是因为另一家恰好关门。小票不记原因,只记结果。

拿这两个框架看这项研究就顺了:偏好不是心里一直放着的固定值,是被使用一次次写出来的。实验里那次随机分配,就是替你按下的「第一次」。

4带走

这对你意味着什么:看住的是第一次,不必戒掉每一次

先把丑话说全,这项研究的边界很清楚。

它是 arXiv 预印本,还没过同行评审;它测到的是偏好漂移,够不上「成瘾」二字;它也没有说 AI 支持有害。深夜找 AI 说几句,不丢人,也未必是坏事。值得留意的是漂移的位置:它只在私人话题上发生。被一点点改道的,恰好是原本通向某个具体的人的那部分。

可操作的就一件小事:下次发现自己「更想找 AI」时停半秒,分一分这里面有多少是「它真的合适」,有多少只是「我上次用了它」。分不清也不要紧,隔三差五把顺序换回来一次,给某个人发一句「在吗」,让两条路都保持踩得动。

本研究为 2026 年 8 月 24 日提交 arXiv 的预印本(编号 2608.23196),未经同行评审;所报告的效应是偏好漂移,研究既未作成瘾判定,也没有说 AI 支持有害。细节以原论文为准。

今晚要是又睡不着,排队之前,要不要先看一眼昨天的自己是怎么排到这儿来的?

本文取材自丹·艾瑞里《怪诞行为学》;研究为 2026-08 提交 arXiv 的预印本(编号 2608.23196,未经同行评审),结论以原论文为准。心理科普非心理咨询与诊疗,严重困扰请寻求专业帮助。

心理

1,951 人的实验:被硬塞的 AI 安慰并不更好,可聊过一次,下一次你就更想选它

2026年8月31日 · 丹·艾瑞里《怪诞行为学》约 5 分钟

你有没有过这种时候:凌晨一点,心里堵着一件事,睡不着,想找个人说说。通讯录翻到一半停住了——这个明天要早起,那个上礼拜刚听你倒过苦水,剩下几个,开口前得先寒暄十分钟。说实话,这一步我自己就常卡住:我这人偏内向,三十秒的闲聊都能在心里把自己劝退,何况深夜张口。可屏幕上还亮着一个对话框,秒回,不困,不欠人情。2026 年 8 月 24 日挂上 arXiv 的一项研究(编号 2608.23196,通讯作者是哈佛的 Amit Goldenberg),盯的就是你点开它之后发生的事。

30 秒读懂
1实验

被硬塞的 AI 安慰,并没有传说中那么好

这项研究先补上了以前实验缺的一块:想要的和得到的对不上时,会怎么样。

此前不少研究说,AI 的共情回复常被评得不输人类、甚至更高。可你看那些实验的摆法:要么把倾诉对象硬性指派给你,要么完全随你挑;现实里最常见的第三种情形反倒一直没人测:你想找人,得到的却是机器,或者倒过来。Goldenberg 团队用三个实验补上这一块,一共 1,951 人:先让每个人选想跟人类还是 AI 分享一段情绪经历,再随机安排「如愿」或「不如愿」的对象。

自己选了 AI(如愿组)

觉得 AI 的支持确实更好。这份「好」里,有一部分是「我自己选的」在参与打分。

被硬塞 AI(不如愿组)

没这待遇。同样的 AI、同样的回复,评价并没有更好。

这么一拆就清楚了:此前「AI 共情不输人类」的漂亮成绩里,可能有一部分分数,来自「这是我自己选的」。

2漂移

嘴上没给高分的人,手上的选择也在挪

真正让研究者坐不住的,是所有组共有的第二个发现。

不管当初如愿没如愿,只要和 AI 聊过,下一次愿意选 AI 的比例都上升了。被硬塞的人嘴上没给 AI 加分,轮到再选一次时,手却和如愿组往同一个方向挪。团队想看看这股劲能走多远,就与 OpenAI 合作做了第四个研究:981 人、28 天的日记式实验,每天和 AI 对话。结果偏好一天天往 AI 那边漂、离人类越来越远。里面有个开关一样的细节:只有对话转向私人话题时才漂,聊事务性的内容就不动。

核心

「我用过它」这个事实本身在投票:私人话题聊过一次,下一次的选择就被轻轻推了一把,而且推的方向,跟你当初愿不愿意没关系。

作者管这个叫路径依赖:每用一次,下一次的选择就被往 AI 那边带一点,一步一步,从人和人的连接上改了道。

偏好不是测出来的,是一次次用出来的 第一次用 AI 倾诉 自己选的,或被指派的 使用体验 如愿者:评价更高 被硬塞的:评价并不更好 「我用过它」成了下次的证据 体验好坏,都一样算数 下次更可能选 AI 如愿与否,都上升 自我羊群效应 排在昨天的自己后面 · 艾瑞里 每转一圈 偏好更偏离人类 28 天日记研究 · N=981 只有聊到私人话题才漂移 事务性对话:不漂移 偏好主循环 漂移条件旁注
来源:arXiv 预印本(2026-08,arXiv:2608.23196;实验 N=1,951,28 天日记研究 N=981,与 OpenAI 合作)。每一次倾诉都在悄悄成为下一次的理由——偏好是被使用写出来的,不是心里存好的。预印本,未经同行评审。
3机理

你不光排在别人后面,还排在昨天的自己后面

这种漂移,艾瑞里在《怪诞行为学》里早写过,名字叫「自我羊群效应」。

普通的羊群效应是看别人排队:那家店人多,应该不错。自我羊群效应是排在自己后面:我上次既然用了它,它应该不错。于是第一次的偶然,成了第二次的理由,再成了第三次的习惯。书里还有个配套的概念,叫「任意连贯性」:起点可以完全是随便来的,比如实验里被随机塞过来的那个 AI;可之后的一致是真的,你会围着那个随便的起点,做出一连串彼此呼应的决定。

打个比方

奶茶店门口,你不光看哪家队伍长,还会翻自己昨天的小票:上次买的这家,应该不难喝。你多半忘了,上次选它,只是因为另一家恰好关门。小票不记原因,只记结果。

你看啊,拿这两个框架一对,这项研究就顺了:偏好不是你心里一直搁着的一个定数,是被使用一次一次写出来的。实验里那次随机分配,等于替你按下了「第一次」。

4带走

这对你意味着什么:看住的是第一次,不必戒掉每一次

先把丑话说全,这项研究的边界很清楚。

它是 arXiv 预印本,还没过同行评审;它测到的是偏好漂移,够不上「成瘾」两个字;它也没有说 AI 支持有害。这几条界线我记得格外牢,是交过学费的:2013 年读研二,我跟着一场 TED 演讲迷上「高能量姿势」,天天在复旦文科图书馆五楼的消防通道里叉腰站两分钟,还写进了课程报告,两年后那项研究复现接连翻车,导师在报告边上批了四个字:等等再信。所以这项研究再合我的胃口,我也先把它记在「等等再信」那一页。深夜找 AI 说几句,不丢人,也未必是坏事。真正值得你留意的是漂移发生的位置:它只在私人话题上出现。咨询室里坐了八年,我见的就是几百个把最难启齿的话慢慢摊开的人;被一点点改道的,恰好是原本通向某个具体的人的那一部分。

可操作的就一件小事:下次发现自己「更想找 AI」的时候,停半秒,分一分这里头有多少是「它真的合适」,有多少只是「我上次用了它」。分不清也不要紧,隔三差五把顺序倒回来一次,给某个人发一句「在吗」,让两条路都保持踩得动。

本研究为 2026 年 8 月 24 日提交 arXiv 的预印本(编号 2608.23196),未经同行评审;所报告的效应是偏好漂移,研究既未作成瘾判定,也没有说 AI 支持有害。细节以原论文为准。

今晚要是又睡不着,排队之前,要不要先回头看一眼:昨天的你,是怎么排到这儿来的?

本文取材自丹·艾瑞里《怪诞行为学》;研究为 2026-08 提交 arXiv 的预印本(编号 2608.23196,未经同行评审),结论以原论文为准。心理科普非心理咨询与诊疗,严重困扰请寻求专业帮助。

心理学

1,951 人的实验:被硬塞的 AI 安慰并不更好,可聊过一次,下一次你就更想选它

2026年8月31日 · 丹·艾瑞里《怪诞行为学》約 5 分

凌晨一点,你被一件事堵得睡不着,想找个人说说。通讯录翻到一半停住了:这个明天要早起,那个上礼拜刚听你倒过苦水,剩下几个,开口前得先寒暄十分钟。屏幕上还有一个对话框,秒回,不困,不欠人情。2026 年 8 月 24 日挂上 arXiv 的一项研究(编号 2608.23196,通讯作者是哈佛的 Amit Goldenberg),盯上的就是你点开它之后发生的事。

30 秒读懂
1实验

被硬塞的 AI 安慰,并没有传说中那么好

这项研究先补上了以前实验缺的一块:想要的和得到的不一致时,会怎样。

此前不少研究发现,AI 的共情回复常被评得不输甚至优于人类。但那些实验要么把支持来源硬性指派给参与者,要么完全尊重本人选择;现实里最常见的第三种情形反而没人测:你想找人,得到的却是机器,或者反过来。Goldenberg 团队用三个实验补这一块,共 1,951 人:参与者先选择想跟人类还是 AI 分享一段情绪经历,然后被随机分到「如愿」或「不如愿」的对象。

自己选了 AI(如愿组)

觉得 AI 的支持确实更好。选择本身参与了体验的打分。

被硬塞 AI(不如愿组)

没这待遇。同样的 AI、同样的回复,评价并没有更好。

也就是说,此前「AI 共情不输人类」的漂亮成绩里,可能有一部分分数来自「这是我自己选的」。

2漂移

嘴上没给高分的人,手上的选择也在挪

真正让研究者在意的,是所有组共有的第二个发现。

无论如愿与否,只要和 AI 聊过,下一次愿意选 AI 的比例都上升了。被硬塞的人没在评价上给 AI 加分,做下一次选择时,却和如愿组朝同一个方向挪。为了看这股力道能走多远,团队与 OpenAI 合作做了第四个研究:981 人、28 天的日记式实验,每天和 AI 对话。结果偏好逐日向 AI 漂移、远离人类。里面有个开关式的细节:只在对话转向私人话题时才漂移,聊事务性内容就不动。

核心

「我用过它」这个事实本身在投票:私人话题聊过一次,下一次的选择就被推了一小把,推的方向与你当初愿不愿意无关。

作者把这叫路径依赖:每一次使用都在把下一次的选择往 AI 那边推,一步步从人际连接改道。

好みは測るものではなく、使うたびに書き換わる 初めて AI に打ち明ける 自分で選んでも、割り当てでも 使った体験 望んで得た人:評価が上がる 割り当てられた人:評価は同じ 「使った」が次の証拠になる 良し悪しに関係なく効く 次はもっと AI を選ぶ どの群でも上昇 自己ハーディング 昨日の自分の後ろに並ぶ · アリエリー 一周ごとに 人から遠のく 28日間の日記研究 · N=981 私的な話題のときだけ漂流 事務的な会話では動かない 好みのループ 漂流の条件
出典:arXiv プレプリント(2026-08、arXiv:2608.23196;実験 N=1,951、28 日間の日記研究 N=981、OpenAI と共同)。一度の対話が、静かに次の対話の理由になる——好みは心にしまわれた定数ではなく、使うたびに書き換えられる。プレプリントであり、査読前。
3机理

你不光排在别人后面,还排在昨天的自己后面

这种漂移,艾瑞里在《怪诞行为学》里写过,名字叫「自我羊群效应」。

普通的羊群效应是看别人排队:那家店人多,应该不错。自我羊群效应是排在自己后面:我上次既然用了它,它应该不错。于是第一次的偶然,变成第二次的理由,再变成第三次的习惯。书里还有个配套概念「任意连贯性」:起点可以完全是任意的,比如实验里被随机塞来一个 AI;可此后的一致性是真实的,你会围着那个任意的起点,做出一连串彼此呼应的决定。

打个比方

奶茶店门口,你不光看哪家队伍长,还会翻自己昨天的小票:上次买的这家,应该不难喝。你多半忘了,上次选它只是因为另一家恰好关门。小票不记原因,只记结果。

拿这两个框架看这项研究就顺了:偏好不是心里一直放着的固定值,是被使用一次次写出来的。实验里那次随机分配,就是替你按下的「第一次」。

4带走

这对你意味着什么:看住的是第一次,不必戒掉每一次

先把丑话说全,这项研究的边界很清楚。

它是 arXiv 预印本,还没过同行评审;它测到的是偏好漂移,够不上「成瘾」二字;它也没有说 AI 支持有害。深夜找 AI 说几句,不丢人,也未必是坏事。值得留意的是漂移的位置:它只在私人话题上发生。被一点点改道的,恰好是原本通向某个具体的人的那部分。

可操作的就一件小事:下次发现自己「更想找 AI」时停半秒,分一分这里面有多少是「它真的合适」,有多少只是「我上次用了它」。分不清也不要紧,隔三差五把顺序换回来一次,给某个人发一句「在吗」,让两条路都保持踩得动。

本研究为 2026 年 8 月 24 日提交 arXiv 的预印本(编号 2608.23196),未经同行评审;所报告的效应是偏好漂移,研究既未作成瘾判定,也没有说 AI 支持有害。细节以原论文为准。

今晚要是又睡不着,排队之前,要不要先看一眼昨天的自己是怎么排到这儿来的?

本文取材自丹·艾瑞里《怪诞行为学》;研究为 2026-08 提交 arXiv 的预印本(编号 2608.23196,未经同行评审),结论以原论文为准。心理科普非心理咨询与诊疗,严重困扰请寻求专业帮助。