vlog
← 返回全部文章

Psychology

问卷里的恶人没在评论区作恶:56,892 条真实 Reddit 评论,对不上暗黑人格的自我描述

2026 年 9 月 4 日 · 基思·斯坦诺维奇《对伪心理学说不》~1 min read

按常识,暗黑人格测验拿高分的人,评论区里应该最毒:马基雅维利主义、精神病态,哪个词听着都不像善茬。发表在 Computers in Human Behavior 上的一项新研究偏偏去验了这个常识:让被试填完暗黑人格问卷,再经他们本人同意,抓来他们真实的 Reddit 评论逐句分析,一共 56,892 条。结果,问卷里的「恶人」在评论区里几乎查无实据——暗黑得分越高的人,自己承认网上更不文明,可他们真实评论的毒性,和其他人没测出差别。

30 秒读懂
1设计

「你是什么人」和「你做了什么」,头一回被摁在同一张桌上对质

同一个心理学概念可以有两种操作性定义,这项研究让它们当面碰数。

斯坦诺维奇在《对伪心理学说不》里反复强调:一个心理学主张的分量,取决于它的测量方式。「网络毒人」这个概念至少有两种测法:给人发一份人格问卷,问「你是什么人」;或者调出行为记录,看「你做了什么」。以往多数研究只有前一种。这项研究把两种都备齐了:被试先填暗黑人格问卷、网络霸凌/钓鱼行为问卷和 6 题社交媒体习惯,再交出自己 Reddit 账号的公开发言供逐句分析。

抓取的真实评论
56,892 条
拆出的句子
152,741 个

人均约 499 条评论;这不是让被试现场表演,而是他们过去留在公开平台上的日常发言。

THE QUESTIONNAIRE VILLAIN NEVER SHOWED UP IN THE COMMENTSSELF-REPORT · WHAT THEY SAYREAL BEHAVIORDark-personality scorequestionnaire self-report“I post uncivil content”behavior self-reportBeen a target of toxicityvictimization self-reportActual toxicity56,892 Reddit commentsmeasured, not askedno significant linksignificant correlationno significant link
Source: PsyPost (2026-09-03), reporting a Computers in Human Behavior (2026) study that paired dark-personality questionnaires with toxicity analysis of 56,892 Reddit comments. Questionnaire scores tracked what people said about themselves, but not their real comments — only behavior self-reports and victimization did. Correlational findings from a limited sample; popular-science interpretation, not a clinical measure.
2结果

问卷上认下的恶,落到评论区里一条都没对上

得分最扎眼的「成功型精神病态」,评论毒性照样测不出差别。

问卷那头的结果毫不意外:暗黑人格得分越高,自述的网上不文明行为越多,其中「成功型精神病态」(Successful Psychopathy,精神病态加马基雅维利主义的算计操纵组合)关联最强。可一转到语料这头,画风全变了:暗黑人格与真实评论的任何毒性指标、语言学特征都没有显著关联;问卷测出的暗黑人格,与从文本推算出的暗黑人格之间,同样没有显著关联。

问卷那头

暗黑得分越高,自述的网上不文明行为越多;「成功型精神病态」关联最强。

评论区这头

同一批人的 56,892 条真实评论:毒性指标、语言学特征,都与暗黑得分无显著关联。

这有点像相亲:对方在自我介绍里坦白「我脾气差」,你把他三年的聊天记录翻了个底朝天,愣是没找到一句重话。自我介绍讲的是他怎么看待自己,聊天记录才是他怎么过日子,两份材料回答的本来就是不同的问题。

3对上的

真正对得上号的,是行为自述,还有挨过的毒

问卷并没有全军覆没:问对了问题的那部分,相当准。

同一批问卷里,也有和语料对得整整齐齐的部分。自称常发毒性内容的人,Reddit 评论确实更毒。还有一条容易被忽略的发现:自称在网上被毒过的人,自己发出的评论也更毒。研究者称之为加害与受害的互惠:挨过毒打的,更可能以毒还毒。

核心

同一批人、同一份语料:「你是什么人」的答案没对上,「你干过什么」「你挨过什么」的答案对上了。问卷这个工具没坏,出问题的是把人格自述直接当成行为预报来用。

4怎么读

「问卷谁不会装」这句吐槽,恰好没打中这项研究的要害

要是大家都在装好人,事情反而好解释了。

你可能想吐槽:问卷谁不会装?可这个解释在这里绕不过一道坎:真要装好人,暗黑得分高的人应该少报自己的不文明行为,这项研究里他们反而报得更多。人家在问卷上把「恶」认下了,只是语料里找不到对应的行为。更微妙的解释是斯坦诺维奇提醒过的那种:自陈量表测到的,可能是自我叙事而非行为倾向。一个人相信并讲述的「我是谁」,和他每天敲进输入框的字,可以是两本各记各的账。

反过来替问卷说两句也有必要。也许这些人的毒都撒在别的平台,Reddit 只是没被抽中的那片场子;也许现有的文本毒性工具,量不出算计型人格那种不留把柄的伤人法。这些可能性,研究本身排除不了。

局限备忘:样本相对小;只考察了 Reddit 一个平台;从文本推算心理特征的效度尚不明确;全部结果是相关,谈不上因果。它对不上的是这批被试的人格自述与评论毒性,不能引申成「暗黑人格研究是假的」。细节以原研究为准。
5带走

这对你意味着什么:给人定性之前,先看清手里是哪份材料

单一研究分量有限,可它掂量证据的方式今天就能用。

按聚合证据的标准,这只是一项研究,还没经过其他平台、其他样本的反复检验,别急着当定论转发。它真正值得带走的是那个动作:把「他说自己是什么人」和「他实际做了什么」当成两份材料分开审。你身边到处是这样的场景,同事的 MBTI、你自己年初给自己下的判词。这项研究里,人格自述连本人评论的毒性都预测不了,行为自述倒是条条兑现。下次想拿一张人格测验给自己或别人定性时,先问一句:我手里这份材料,记的是他做过的事,还是他讲给自己听的故事?

本文取材自基思·斯坦诺维奇《对伪心理学说不》;研究发表于 Computers in Human Behavior(PsyPost 2026 年 9 月 3 日报道,Vladimir Hedrih),结论以原研究为准;相关不等于因果。心理科普非专业心理建议。

心理

问卷里的恶人没在评论区作恶:56,892 条真实 Reddit 评论,对不上暗黑人格的自我描述

2026 年 9 月 4 日 · 基思·斯坦诺维奇《对伪心理学说不》约 6 分钟

我有个来访者,化名阿萍,三十岁上下。她清清楚楚「记得」六岁那年在外婆家院子里被一只大白鹅追着咬,裤腿撕破,外婆抄着扫帚来赶。后来家里聚会一问:外婆家从没养过鹅,那年她压根没去过。她的事当不了证据,记忆跟问卷也是两码事,可有个道理是通的:一个人关于自己的讲述,可以真到这个地步,还是对不上账。发表在 Computers in Human Behavior 上的一项新研究,做的就是这种对账:让被试填完暗黑人格问卷(马基雅维利主义、精神病态,哪个词听着都不像善茬),再经他们本人同意,抓来他们真实的 Reddit 评论逐句分析,一共 56,892 条。按常识,问卷得分高的人评论区里该最毒。结果,问卷里的「恶人」在评论区几乎查无实据:暗黑得分越高的人,自己承认网上更不文明,可他们真实评论的毒性,和其他人的没测出差别。

30 秒读懂
1设计

「你是什么人」和「你做了什么」,这一回被摁在同一张桌上对账

同一个概念能有两种量法,这项研究让它们当面碰了数。

斯坦诺维奇在《对伪心理学说不》里反复讲一件事:一个心理学说法值多少分量,得看它是怎么量出来的。「网络毒人」这个概念至少有两种量法:发一份人格问卷,问「你是什么人」;或者调出行为记录,看「你做了什么」(心理学管这叫操作性定义,说白了就是:同一个词,换个量法,量到的可能不是同一个东西)。以往多数研究只有前一种。这项研究把两种都备齐了:被试先填暗黑人格问卷、网络霸凌/钓鱼行为问卷和 6 道社交媒体习惯题,再交出自己 Reddit 账号的公开发言,供逐句分析。

抓取的真实评论
56,892 条
拆出的句子
152,741 个

人均约 499 条评论,全是他们过去留在公开平台上的日常发言,没有一句是当着研究者的面现场表演的。

问卷里的恶人,没在评论区出现自述侧 · 他们怎么说真实行为侧暗黑人格量表得分人格问卷自述“我常发不文明内容”行为自述自述曾遭毒性攻击受害自述真实毒性56,892 条 Reddit 评论测量而非询问无显著关联显著相关无显著关联
来源:PsyPost(2026-09-03)报道的 Computers in Human Behavior(2026)研究,把暗黑人格问卷与 56,892 条 Reddit 评论的毒性分析配对。问卷得分只对得上人们对自己的说法,对不上真实评论——只有行为自述和受害经历追踪到了真实行为。相关性研究、样本有限;科普解读,非临床测量。
2结果

问卷上认下的恶,落到评论区里一条都没对上

得分最扎眼的「成功型精神病态」,评论毒性照样量不出差别。

问卷那头的结果不意外:暗黑人格得分越高,自述的网上不文明行为越多,其中「成功型精神病态」(Successful Psychopathy,说白了就是精神病态加马基雅维利主义那种会算计、会操纵的组合)关联最强。可一转到评论这头,画风全变了:暗黑人格与真实评论的任何毒性指标、语言学特征都没有显著关联;连问卷量出的暗黑人格,和从文本推算出的暗黑人格之间,也没有显著关联。

问卷那头

暗黑得分越高,自述的网上不文明行为越多;「成功型精神病态」关联最强。

评论区这头

同一批人的 56,892 条真实评论:毒性指标、语言学特征,都与暗黑得分无显著关联。

这有点像相亲:对方在自我介绍里坦白「我脾气差」,你把他三年的聊天记录翻了个底朝天,愣是没找到一句重话。你说他撒谎吗?倒也未必。他讲的是他心里那个自己,聊天记录记的是他一天一天怎么过,两份材料答的本来就不是同一道题。

3对上的

真正对得上号的,是行为自述,还有挨过的毒

问卷没有全军覆没:问对了问题的那部分,相当准。

同一批问卷里,也有和评论对得整整齐齐的部分。自称常发毒性内容的人,Reddit 评论确实更毒。还有一条容易被漏看的:自称在网上被毒过的人,自己发出去的评论也更毒。研究者管这叫加害与受害的互惠,说白了:挨过毒打的,更可能以毒还毒。这一条我不想装超然,换我被人当众泼过几盆脏水,手底下未必收得住。

核心

同一批人、同一份语料:「你是什么人」的答案没对上,「你干过什么」「你挨过什么」的答案对上了。问卷这个工具没坏,坏在把人格自述直接拿去当行为预报用。

4怎么读

「问卷谁不会装」这句吐槽,恰好没打中这项研究的要害

要是大家都在装好人,事情反倒好解释了。

你可能想吐槽:问卷谁不会装?可这个解释在这儿绕不过一道坎:真要装好人,暗黑得分高的人该少报自己的不文明行为才对,这项研究里他们反而报得更多。人家把「恶」在问卷上认下了,只是评论里找不到对应的行为。更微妙的解释,是斯坦诺维奇提醒过的那种:自陈量表量到的,可能是自我叙事,而不是行为倾向——一个人相信并讲述的「我是谁」,和他每天敲进输入框的字,各记各的账。这种对不上的账,我自己也有一笔。刚入行那两年,一次例行督导,徐老师听完我的个案记录,技术一句没讲,只问:「你急着让她好起来,是为了她,还是为了证明你行?」我心里那版故事一直是前者,可摊在桌上的记录不肯替我作证,我没答上来。

反过来,也得替问卷说两句公道话。也许这些人的毒都撒在别的平台,Reddit 恰好不是他们撒野的那片场子;也许现有的文本毒性工具,量不出算计型人格那种不留把柄的伤人法。这些可能性,研究自己排除不了。

局限备忘:样本相对小;只考察了 Reddit 一个平台;从文本推算心理特征的效度尚不明确;全部结果是相关,谈不上因果。它对不上的是这批被试的人格自述与评论毒性,不能引申成「暗黑人格研究是假的」。细节以原研究为准。
5带走

这对你意味着什么:给人定性之前,先看清手里是哪份材料

单一研究分量有限,可它掂量证据的方式,今天就能用。

按聚合证据的标准,这只是一项研究,还没经过别的平台、别的样本反复检验,别急着当定论转发。它真正值得带走的是那个动作:把「他说自己是什么人」和「他实际做了什么」当成两份材料,分开审。你身边到处是把这两份材料用混的场景:同事的 MBTI、你年初给自己下的判词。这项研究里,人格自述连本人评论的毒性都预测不了,行为自述倒是条条兑现。所以下次想拿一张人格测验给自己或者别人定性,先停半拍问问:我手里这份材料,记的是他做过的事,还是他讲给自己听的故事?

本文取材自基思·斯坦诺维奇《对伪心理学说不》;研究发表于 Computers in Human Behavior(PsyPost 2026 年 9 月 3 日报道,Vladimir Hedrih),结论以原研究为准;相关不等于因果。心理科普非专业心理建议。

心理学

问卷里的恶人没在评论区作恶:56,892 条真实 Reddit 评论,对不上暗黑人格的自我描述

2026 年 9 月 4 日 · 基思·斯坦诺维奇《对伪心理学说不》約 5 分

按常识,暗黑人格测验拿高分的人,评论区里应该最毒:马基雅维利主义、精神病态,哪个词听着都不像善茬。发表在 Computers in Human Behavior 上的一项新研究偏偏去验了这个常识:让被试填完暗黑人格问卷,再经他们本人同意,抓来他们真实的 Reddit 评论逐句分析,一共 56,892 条。结果,问卷里的「恶人」在评论区里几乎查无实据——暗黑得分越高的人,自己承认网上更不文明,可他们真实评论的毒性,和其他人没测出差别。

30 秒读懂
1设计

「你是什么人」和「你做了什么」,头一回被摁在同一张桌上对质

同一个心理学概念可以有两种操作性定义,这项研究让它们当面碰数。

斯坦诺维奇在《对伪心理学说不》里反复强调:一个心理学主张的分量,取决于它的测量方式。「网络毒人」这个概念至少有两种测法:给人发一份人格问卷,问「你是什么人」;或者调出行为记录,看「你做了什么」。以往多数研究只有前一种。这项研究把两种都备齐了:被试先填暗黑人格问卷、网络霸凌/钓鱼行为问卷和 6 题社交媒体习惯,再交出自己 Reddit 账号的公开发言供逐句分析。

抓取的真实评论
56,892 条
拆出的句子
152,741 个

人均约 499 条评论;这不是让被试现场表演,而是他们过去留在公开平台上的日常发言。

アンケートの悪人は、コメント欄に現れなかった自己申告 · 本人の言い分実際の行動ダーク性格尺度スコア性格アンケートの自己申告「攻撃的な投稿をよくする」行動の自己申告攻撃された経験あり被害の自己申告実際の毒性Reddit コメント 56,892 件申告ではなく計測有意な関連なし有意な相関有意な関連なし
出典:PsyPost(2026-09-03)が報じた Computers in Human Behavior(2026)の研究。ダーク性格アンケートと、Reddit のコメント 56,892 件の毒性分析を突き合わせた。アンケートのスコアは本人の自己像とは一致したが、実際のコメントとは一致せず——実際の行動とつながったのは行動の自己申告と被害経験だけだった。相関研究でありサンプルは限定的。科学解説であり、臨床的な測定ではない。
2结果

问卷上认下的恶,落到评论区里一条都没对上

得分最扎眼的「成功型精神病态」,评论毒性照样测不出差别。

问卷那头的结果毫不意外:暗黑人格得分越高,自述的网上不文明行为越多,其中「成功型精神病态」(Successful Psychopathy,精神病态加马基雅维利主义的算计操纵组合)关联最强。可一转到语料这头,画风全变了:暗黑人格与真实评论的任何毒性指标、语言学特征都没有显著关联;问卷测出的暗黑人格,与从文本推算出的暗黑人格之间,同样没有显著关联。

问卷那头

暗黑得分越高,自述的网上不文明行为越多;「成功型精神病态」关联最强。

评论区这头

同一批人的 56,892 条真实评论:毒性指标、语言学特征,都与暗黑得分无显著关联。

这有点像相亲:对方在自我介绍里坦白「我脾气差」,你把他三年的聊天记录翻了个底朝天,愣是没找到一句重话。自我介绍讲的是他怎么看待自己,聊天记录才是他怎么过日子,两份材料回答的本来就是不同的问题。

3对上的

真正对得上号的,是行为自述,还有挨过的毒

问卷并没有全军覆没:问对了问题的那部分,相当准。

同一批问卷里,也有和语料对得整整齐齐的部分。自称常发毒性内容的人,Reddit 评论确实更毒。还有一条容易被忽略的发现:自称在网上被毒过的人,自己发出的评论也更毒。研究者称之为加害与受害的互惠:挨过毒打的,更可能以毒还毒。

核心

同一批人、同一份语料:「你是什么人」的答案没对上,「你干过什么」「你挨过什么」的答案对上了。问卷这个工具没坏,出问题的是把人格自述直接当成行为预报来用。

4怎么读

「问卷谁不会装」这句吐槽,恰好没打中这项研究的要害

要是大家都在装好人,事情反而好解释了。

你可能想吐槽:问卷谁不会装?可这个解释在这里绕不过一道坎:真要装好人,暗黑得分高的人应该少报自己的不文明行为,这项研究里他们反而报得更多。人家在问卷上把「恶」认下了,只是语料里找不到对应的行为。更微妙的解释是斯坦诺维奇提醒过的那种:自陈量表测到的,可能是自我叙事而非行为倾向。一个人相信并讲述的「我是谁」,和他每天敲进输入框的字,可以是两本各记各的账。

反过来替问卷说两句也有必要。也许这些人的毒都撒在别的平台,Reddit 只是没被抽中的那片场子;也许现有的文本毒性工具,量不出算计型人格那种不留把柄的伤人法。这些可能性,研究本身排除不了。

局限备忘:样本相对小;只考察了 Reddit 一个平台;从文本推算心理特征的效度尚不明确;全部结果是相关,谈不上因果。它对不上的是这批被试的人格自述与评论毒性,不能引申成「暗黑人格研究是假的」。细节以原研究为准。
5带走

这对你意味着什么:给人定性之前,先看清手里是哪份材料

单一研究分量有限,可它掂量证据的方式今天就能用。

按聚合证据的标准,这只是一项研究,还没经过其他平台、其他样本的反复检验,别急着当定论转发。它真正值得带走的是那个动作:把「他说自己是什么人」和「他实际做了什么」当成两份材料分开审。你身边到处是这样的场景,同事的 MBTI、你自己年初给自己下的判词。这项研究里,人格自述连本人评论的毒性都预测不了,行为自述倒是条条兑现。下次想拿一张人格测验给自己或别人定性时,先问一句:我手里这份材料,记的是他做过的事,还是他讲给自己听的故事?

本文取材自基思·斯坦诺维奇《对伪心理学说不》;研究发表于 Computers in Human Behavior(PsyPost 2026 年 9 月 3 日报道,Vladimir Hedrih),结论以原研究为准;相关不等于因果。心理科普非专业心理建议。