Psychology
141 位自闭症成年人和 94 位非自闭症成年人看同样的故事:非自闭症的人给自己的共情打分高得多,测出来的准确率却没有差别
2026年9月13日 · 基思·斯坦诺维奇《对伪心理学说不》~1 min read
你有没有被人说过「你根本不懂我」?说这话的人,多半觉得自己挺懂人的。我做了 8 年一对一咨询,给自己「读得懂人」这项打的分一直不低。2026 年 6 月《分子自闭症》上一篇论文把这件事放上了秤:235 个成年人看同样的视频,拨滑块跟着讲述者的心情走,再跟讲述者本人的线对账。读得准不准,和觉得自己读得准,在一组人身上分了家。
30 秒读懂
- 141 名自闭症和 94 名非自闭症成年人各看 2 段视频,实时判断讲述者情绪,准确度按与讲述者自评的吻合度算:两组无显著差别。
- 自闭症评分者看自闭症讲述者时相对更准,p 等于 0.059、效应量 0.13:趋势水平,没到显著,效应很小。
- 最稳的一条:非自闭症参与者自评「共情程度」显著更高(效应量 0.67),「兴趣」也更高(0.43),准确度却不更高。
- 作者称这是对「双重共情问题」的部分支持;预录视频不等于真实社交,样本自愿报名,需要复现。
1滑块
同一段故事、同一个滑块,两组人读得一样准
这项研究让参与者跟着一个真人的心情走。
剑桥大学 Yonat Rum、西蒙·巴伦-科恩这组人先请讲述者各录一段讲亲身经历的视频,边讲边拨一个从「负面」到「正面」的滑块,每 0.5 秒记一次。参与者随机看 2 段,不告诉他们讲述者有没有自闭症诊断,照样拨;线贴得越近,「共情准确度」越高。
| 谁 | 做什么 | 量出什么 |
| 讲述者(5 自闭症 + 5 非自闭症) | 讲亲身经历,同步拨滑块,讲完给 12 种情绪打分 | 讲述者自己的情绪线,对账标准 |
| 235 名参与者(141 自闭症 + 94 非自闭症,平均 49 岁) | 各看 2 段,不知讲述者诊断,同样拨滑块、打分 | 共情准确度:与讲述者自评的吻合程度 |
| 同一批参与者 | 看完自评「我有多共情、多感兴趣」 | 自评共情、自评兴趣 |
第一条结果:评分者、讲述者是不是自闭症,对准确度都没有显著主效应。第二条要看仔细:自闭症评分者看自闭症讲述者相对更准,p 等于 0.059、效应量 0.13,论文的措辞是趋势水平;PsyPost 的报道写成了「显著更准」,比论文重了一格,我按论文说。
2自评
差出来的那一截在自评里:非自闭症的人给自己的共情打分高得多
准确度那把尺两边一样长,自评那把尺不一样。
非自闭症参与者自评的「共情程度」显著更高,p 小于 0.001,效应量 0.67;自评「兴趣」也更高,效应量 0.43。可他们的滑块没有贴得更近。开放式评论里,自闭症参与者多在写「辨认情绪对我很难」「这个任务我做得怎么样」;非自闭症参与者多在给任务设计提意见。作者据此猜,自闭症参与者可能低估了自己的共情能力。只是猜。
核心235 人里,自评共情更高的那一组,准确度并不更高。自评量的是「我觉得自己多投入」,准确度量的是「我跟没跟上对方」,两个数没有一起走。
这个数我看着有点脸热。刚入行那两年,督导徐老师听完我的个案记录,只问:「你急着让她好起来,是为了她,还是为了证明你行?」我答不上来。我给自己的「共情」分,打的是我有多投入、多想帮她;她的心情走到哪儿了、我跟没跟上,是另一张卷子。两张卷子我一直混着批,自评那栏从没低过。
Molecular Autism 2026 (Rum et al.): 141 autistic vs 94 non-autistic, equal accuracy; only self-rating differed. Educational, not professional advice.
3两把尺
斯坦诺维奇的两把尺:先把「共情」变成一个量得出来的数,再看理论敢不敢输
斯坦诺维奇最不讨喜的两条要求,这项研究都照办了。
第一把尺叫操作性定义。「共情」是个形容词,怎么听都对。斯坦诺维奇要你先说清楚怎么量、换个实验室能不能量出一样的数。这项研究的定义窄得有点无情:你的滑块和讲述者的滑块贴得多近。窄,可它能算、能比、能被推翻。按这把尺,「我觉得我很共情」不是测量,是见证。
打个比方
问一个人「你唱歌准不准」,和拿调音器对着他唱,是两件事。这项研究里,前者最自信的一组,后者没有更好。
第二把尺叫可证伪性。「双重共情问题」说的是误会双向:两边感知、表达的方式不同,非自闭症的人读自闭症者同样读不准。它有一个能输的预测:各群读自己人更准。结果主效应没有,交互只到趋势,作者用的词是「部分支持」。一个理论敢把自己摆到能输的位置、然后只赢一小截,这正是斯坦诺维奇说的科学该有的样子。0.13 的效应量,下一批人里可能还在,也可能没了,别从一篇研究下结论。
传统说法
自闭症者的社交沟通困难,源于他们自身的「共情缺陷」。
这项研究看到的
两组读得一样准,差别出在自评;「双重共情」只得到趋势水平的部分支持,传统模型也没被推翻。作者另提醒:别把「神经类型」当成同质类别。
4带走
这对你意味着什么:把「他读不懂人」改问成「我们俩谁都读得不准」
边界先摆出来,再说能带走什么。
预录视频不等于真实社交。自闭症参与者是自愿报名的成年人,不代表整个谱系,尤其不含需要较多支持的人。单次结果,需要复现;自评与表现的落差只在这一个任务里测到。不给任何诊断或干预建议。
能带走的是一个问法。下次心里冒出「他根本读不懂人」,把它拆成两件事:我读他,读准了几分;他读我,读准了几分。这项研究里两边读得一样准,谁也不免检。还有一条是对自己的:「我很共情」这个分是自己打的,别当成绩单用。
⚡为什么值得看:它把「共情」从形容词变成一个能对账的数,发现自评和准确度分开走了;「缺陷」叙事里有多少是自评撑着的,从这里才有得问。
你上一次说「他不懂我」的时候,要是手边也有那个滑块,你读他的那条线,敢不敢拿去跟他自己的对一对?
本文取材自基思·斯坦诺维奇《对伪心理学说不》,与 Yonat Rum、Simon Baron-Cohen 等人发表于《分子自闭症》(Molecular Autism,2026 年第 17 卷第 34 号,2026 年 6 月 10 日在线发表,DOI 10.1186/s13229-026-00723-2)的论文,报道见 PsyPost(2026 年 9 月 12 日)。本文为科普解读,非专业建议;严重困扰请找专业帮助;细节以原始研究为准。
心理
141 位自闭症成年人和 94 位非自闭症成年人看同样的故事:非自闭症的人给自己的共情打分高得多,测出来的准确率却没有差别
2026年9月13日 · 基思·斯坦诺维奇《对伪心理学说不》约 5 分钟
你有没有被人说过「你根本不懂我」?说这话的人,多半觉得自己挺懂人的。我做了 8 年一对一咨询,给自己「读得懂人」这项打的分一直不低。2026 年 6 月《分子自闭症》上一篇论文把这件事放上了秤:235 个成年人看同样的视频,拨滑块跟着讲述者的心情走,再跟讲述者本人的线对账。读得准不准,和觉得自己读得准,在一组人身上分了家。
30 秒读懂
- 141 名自闭症和 94 名非自闭症成年人各看 2 段视频,实时判断讲述者情绪,准确度按与讲述者自评的吻合度算:两组无显著差别。
- 自闭症评分者看自闭症讲述者时相对更准,p 等于 0.059、效应量 0.13:趋势水平,没到显著,效应很小。
- 最稳的一条:非自闭症参与者自评「共情程度」显著更高(效应量 0.67),「兴趣」也更高(0.43),准确度却不更高。
- 作者称这是对「双重共情问题」的部分支持;预录视频不等于真实社交,样本自愿报名,需要复现。
1滑块
同一段故事、同一个滑块,两组人读得一样准
这项研究让参与者跟着一个真人的心情走。
剑桥大学 Yonat Rum、西蒙·巴伦-科恩这组人先请讲述者各录一段讲亲身经历的视频,边讲边拨一个从「负面」到「正面」的滑块,每 0.5 秒记一次。参与者随机看 2 段,不告诉他们讲述者有没有自闭症诊断,照样拨;线贴得越近,「共情准确度」越高。
| 谁 | 做什么 | 量出什么 |
| 讲述者(5 自闭症 + 5 非自闭症) | 讲亲身经历,同步拨滑块,讲完给 12 种情绪打分 | 讲述者自己的情绪线,对账标准 |
| 235 名参与者(141 自闭症 + 94 非自闭症,平均 49 岁) | 各看 2 段,不知讲述者诊断,同样拨滑块、打分 | 共情准确度:与讲述者自评的吻合程度 |
| 同一批参与者 | 看完自评「我有多共情、多感兴趣」 | 自评共情、自评兴趣 |
第一条结果:评分者、讲述者是不是自闭症,对准确度都没有显著主效应。第二条要看仔细:自闭症评分者看自闭症讲述者相对更准,p 等于 0.059、效应量 0.13,论文的措辞是趋势水平;PsyPost 的报道写成了「显著更准」,比论文重了一格,我按论文说。
2自评
差出来的那一截在自评里:非自闭症的人给自己的共情打分高得多
准确度那把尺两边一样长,自评那把尺不一样。
非自闭症参与者自评的「共情程度」显著更高,p 小于 0.001,效应量 0.67;自评「兴趣」也更高,效应量 0.43。可他们的滑块没有贴得更近。开放式评论里,自闭症参与者多在写「辨认情绪对我很难」「这个任务我做得怎么样」;非自闭症参与者多在给任务设计提意见。作者据此猜,自闭症参与者可能低估了自己的共情能力。只是猜。
核心235 人里,自评共情更高的那一组,准确度并不更高。自评量的是「我觉得自己多投入」,准确度量的是「我跟没跟上对方」,两个数没有一起走。
这个数我看着有点脸热。刚入行那两年,督导徐老师听完我的个案记录,只问:「你急着让她好起来,是为了她,还是为了证明你行?」我答不上来。我给自己的「共情」分,打的是我有多投入、多想帮她;她的心情走到哪儿了、我跟没跟上,是另一张卷子。两张卷子我一直混着批,自评那栏从没低过。
来源:《分子自闭症》2026,Rum 等(141 名自闭症、94 名非自闭症评分者)。两组实测准确度无差异,差的只是自评的共情程度。科普非专业建议。
3两把尺
斯坦诺维奇的两把尺:先把「共情」变成一个量得出来的数,再看理论敢不敢输
斯坦诺维奇最不讨喜的两条要求,这项研究都照办了。
第一把尺叫操作性定义。「共情」是个形容词,怎么听都对。斯坦诺维奇要你先说清楚怎么量、换个实验室能不能量出一样的数。这项研究的定义窄得有点无情:你的滑块和讲述者的滑块贴得多近。窄,可它能算、能比、能被推翻。按这把尺,「我觉得我很共情」不是测量,是见证。
打个比方
问一个人「你唱歌准不准」,和拿调音器对着他唱,是两件事。这项研究里,前者最自信的一组,后者没有更好。
第二把尺叫可证伪性。「双重共情问题」说的是误会双向:两边感知、表达的方式不同,非自闭症的人读自闭症者同样读不准。它有一个能输的预测:各群读自己人更准。结果主效应没有,交互只到趋势,作者用的词是「部分支持」。一个理论敢把自己摆到能输的位置、然后只赢一小截,这正是斯坦诺维奇说的科学该有的样子。0.13 的效应量,下一批人里可能还在,也可能没了,别从一篇研究下结论。
传统说法
自闭症者的社交沟通困难,源于他们自身的「共情缺陷」。
这项研究看到的
两组读得一样准,差别出在自评;「双重共情」只得到趋势水平的部分支持,传统模型也没被推翻。作者另提醒:别把「神经类型」当成同质类别。
4带走
这对你意味着什么:把「他读不懂人」改问成「我们俩谁都读得不准」
边界先摆出来,再说能带走什么。
预录视频不等于真实社交。自闭症参与者是自愿报名的成年人,不代表整个谱系,尤其不含需要较多支持的人。单次结果,需要复现;自评与表现的落差只在这一个任务里测到。不给任何诊断或干预建议。
能带走的是一个问法。下次心里冒出「他根本读不懂人」,把它拆成两件事:我读他,读准了几分;他读我,读准了几分。这项研究里两边读得一样准,谁也不免检。还有一条是对自己的:「我很共情」这个分是自己打的,别当成绩单用。
⚡为什么值得看:它把「共情」从形容词变成一个能对账的数,发现自评和准确度分开走了;「缺陷」叙事里有多少是自评撑着的,从这里才有得问。
你上一次说「他不懂我」的时候,要是手边也有那个滑块,你读他的那条线,敢不敢拿去跟他自己的对一对?
本文取材自基思·斯坦诺维奇《对伪心理学说不》,与 Yonat Rum、Simon Baron-Cohen 等人发表于《分子自闭症》(Molecular Autism,2026 年第 17 卷第 34 号,2026 年 6 月 10 日在线发表,DOI 10.1186/s13229-026-00723-2)的论文,报道见 PsyPost(2026 年 9 月 12 日)。本文为科普解读,非专业建议;严重困扰请找专业帮助;细节以原始研究为准。
心理学
141 位自闭症成年人和 94 位非自闭症成年人看同样的故事:非自闭症的人给自己的共情打分高得多,测出来的准确率却没有差别
2026年9月13日 · 基思·斯坦诺维奇《对伪心理学说不》約 5 分
你有没有被人说过「你根本不懂我」?说这话的人,多半觉得自己挺懂人的。我做了 8 年一对一咨询,给自己「读得懂人」这项打的分一直不低。2026 年 6 月《分子自闭症》上一篇论文把这件事放上了秤:235 个成年人看同样的视频,拨滑块跟着讲述者的心情走,再跟讲述者本人的线对账。读得准不准,和觉得自己读得准,在一组人身上分了家。
30 秒读懂
- 141 名自闭症和 94 名非自闭症成年人各看 2 段视频,实时判断讲述者情绪,准确度按与讲述者自评的吻合度算:两组无显著差别。
- 自闭症评分者看自闭症讲述者时相对更准,p 等于 0.059、效应量 0.13:趋势水平,没到显著,效应很小。
- 最稳的一条:非自闭症参与者自评「共情程度」显著更高(效应量 0.67),「兴趣」也更高(0.43),准确度却不更高。
- 作者称这是对「双重共情问题」的部分支持;预录视频不等于真实社交,样本自愿报名,需要复现。
1滑块
同一段故事、同一个滑块,两组人读得一样准
这项研究让参与者跟着一个真人的心情走。
剑桥大学 Yonat Rum、西蒙·巴伦-科恩这组人先请讲述者各录一段讲亲身经历的视频,边讲边拨一个从「负面」到「正面」的滑块,每 0.5 秒记一次。参与者随机看 2 段,不告诉他们讲述者有没有自闭症诊断,照样拨;线贴得越近,「共情准确度」越高。
| 谁 | 做什么 | 量出什么 |
| 讲述者(5 自闭症 + 5 非自闭症) | 讲亲身经历,同步拨滑块,讲完给 12 种情绪打分 | 讲述者自己的情绪线,对账标准 |
| 235 名参与者(141 自闭症 + 94 非自闭症,平均 49 岁) | 各看 2 段,不知讲述者诊断,同样拨滑块、打分 | 共情准确度:与讲述者自评的吻合程度 |
| 同一批参与者 | 看完自评「我有多共情、多感兴趣」 | 自评共情、自评兴趣 |
第一条结果:评分者、讲述者是不是自闭症,对准确度都没有显著主效应。第二条要看仔细:自闭症评分者看自闭症讲述者相对更准,p 等于 0.059、效应量 0.13,论文的措辞是趋势水平;PsyPost 的报道写成了「显著更准」,比论文重了一格,我按论文说。
2自评
差出来的那一截在自评里:非自闭症的人给自己的共情打分高得多
准确度那把尺两边一样长,自评那把尺不一样。
非自闭症参与者自评的「共情程度」显著更高,p 小于 0.001,效应量 0.67;自评「兴趣」也更高,效应量 0.43。可他们的滑块没有贴得更近。开放式评论里,自闭症参与者多在写「辨认情绪对我很难」「这个任务我做得怎么样」;非自闭症参与者多在给任务设计提意见。作者据此猜,自闭症参与者可能低估了自己的共情能力。只是猜。
核心235 人里,自评共情更高的那一组,准确度并不更高。自评量的是「我觉得自己多投入」,准确度量的是「我跟没跟上对方」,两个数没有一起走。
这个数我看着有点脸热。刚入行那两年,督导徐老师听完我的个案记录,只问:「你急着让她好起来,是为了她,还是为了证明你行?」我答不上来。我给自己的「共情」分,打的是我有多投入、多想帮她;她的心情走到哪儿了、我跟没跟上,是另一张卷子。两张卷子我一直混着批,自评那栏从没低过。
出典:Molecular Autism 2026、Rum ら(自閉症の人 141 名・自閉症でない人 94 名)。実測の正確さは両群で差がなく、差が出たのは自己評価の共感だけ。専門的助言ではありません。
3两把尺
斯坦诺维奇的两把尺:先把「共情」变成一个量得出来的数,再看理论敢不敢输
斯坦诺维奇最不讨喜的两条要求,这项研究都照办了。
第一把尺叫操作性定义。「共情」是个形容词,怎么听都对。斯坦诺维奇要你先说清楚怎么量、换个实验室能不能量出一样的数。这项研究的定义窄得有点无情:你的滑块和讲述者的滑块贴得多近。窄,可它能算、能比、能被推翻。按这把尺,「我觉得我很共情」不是测量,是见证。
打个比方
问一个人「你唱歌准不准」,和拿调音器对着他唱,是两件事。这项研究里,前者最自信的一组,后者没有更好。
第二把尺叫可证伪性。「双重共情问题」说的是误会双向:两边感知、表达的方式不同,非自闭症的人读自闭症者同样读不准。它有一个能输的预测:各群读自己人更准。结果主效应没有,交互只到趋势,作者用的词是「部分支持」。一个理论敢把自己摆到能输的位置、然后只赢一小截,这正是斯坦诺维奇说的科学该有的样子。0.13 的效应量,下一批人里可能还在,也可能没了,别从一篇研究下结论。
传统说法
自闭症者的社交沟通困难,源于他们自身的「共情缺陷」。
这项研究看到的
两组读得一样准,差别出在自评;「双重共情」只得到趋势水平的部分支持,传统模型也没被推翻。作者另提醒:别把「神经类型」当成同质类别。
4带走
这对你意味着什么:把「他读不懂人」改问成「我们俩谁都读得不准」
边界先摆出来,再说能带走什么。
预录视频不等于真实社交。自闭症参与者是自愿报名的成年人,不代表整个谱系,尤其不含需要较多支持的人。单次结果,需要复现;自评与表现的落差只在这一个任务里测到。不给任何诊断或干预建议。
能带走的是一个问法。下次心里冒出「他根本读不懂人」,把它拆成两件事:我读他,读准了几分;他读我,读准了几分。这项研究里两边读得一样准,谁也不免检。还有一条是对自己的:「我很共情」这个分是自己打的,别当成绩单用。
⚡为什么值得看:它把「共情」从形容词变成一个能对账的数,发现自评和准确度分开走了;「缺陷」叙事里有多少是自评撑着的,从这里才有得问。
你上一次说「他不懂我」的时候,要是手边也有那个滑块,你读他的那条线,敢不敢拿去跟他自己的对一对?
本文取材自基思·斯坦诺维奇《对伪心理学说不》,与 Yonat Rum、Simon Baron-Cohen 等人发表于《分子自闭症》(Molecular Autism,2026 年第 17 卷第 34 号,2026 年 6 月 10 日在线发表,DOI 10.1186/s13229-026-00723-2)的论文,报道见 PsyPost(2026 年 9 月 12 日)。本文为科普解读,非专业建议;严重困扰请找专业帮助;细节以原始研究为准。