vlog
← 返回全部文章

Psychology

The More a Psychology Study Goes Viral, the Less Likely It's True

June 21, 2026 · Keith Stanovich, How to Think Straight About Psychology~5 min read

That clever psychology finding you shared last year — the one with the perfect counterintuitive twist, the one your friends actually clicked — has worse odds than you'd hope. Researchers trained a machine-learning model to read more than 14,000 psychology papers published in top journals between 2000 and 2019 and score how likely each was to hold up. The pattern that fell out is uncomfortable: the more media coverage a study got, the less likely it was to replicate. The headline you remember was, on average, the weaker science.

Virality is a filter, and it filters for the wrong thing

It helps to see media attention not as a reward for good work but as a sieve. What makes a study shareable is a short list: it's surprising, it's clean, it turns on a single counterintuitive flip you can say in one sentence. Power poses make you bolder. Smiling makes you happier. Willpower runs out like a muscle. Those are the studies editors chase and readers forward. But the same traits that make a result spread are the ones that make it fragile — a single dramatic effect, found once, is exactly the kind that tends to shrink or vanish when someone runs it again. Spotlight and sturdiness are pulling in opposite directions. And it isn't that fame is rare and trustworthy: the analysis found highly cited papers were no more likely to replicate than the rest. Citations don't certify truth either.

What "replication" actually showed

This isn't one model's hunch. Back in 2015, a consortium of 270 researchers tried to redo 100 well-known psychology studies under the original conditions. Only about a third to forty percent produced the same significant result the second time. On average, the replicated effects came in at roughly half the size of the originals. Read that slowly: take a shelf of textbook findings, run them again carefully, and most of the drama thins out or disappears. Not because the first researchers lied — mostly they didn't — but because a single study is a noisy instrument, and a striking number from one run is often just the noise that happened to look like a signal.

THE MORE A STUDY GOES VIRAL, THE LESS LIKELY IT REPLICATESMEDIA SPOTLIGHT · a filter, not a verdictit selects for the surprising, the clean, the single counterintuitive twistVIRAL · surprisingOne dramatic headline studyshareable — and fragilereplicates rarelyQUIET · replicatedA pile of repeated testsdull — and durabletrustworthy14,000+ papers, 2000–2019: of 100 landmark studies retested, only ~1 in 3 reproduced.Correlational, not causal; replication scores rose 2010→2019 as the field tightened up.spotlight filter
A machine-learning analysis of 14,000+ psychology papers in top journals (2000–2019) found that the more media coverage a study received, the less likely it was to replicate; highly cited papers fared no better. Background: the Reproducibility Project: Psychology (2015) retested 100 studies and reproduced only about a third, with effect sizes roughly half the originals. Framework: Keith Stanovich, How to Think Straight About Psychology (converging evidence over a single dramatic study). Popular-science explainer; the link is correlational, not causal.

The unit of trust is the pile, not the headline

This is the spine of Keith Stanovich's How to Think Straight About Psychology, and it's the part worth tattooing somewhere. Real knowledge in psychology isn't built on the one brilliant experiment. It's built on converging evidence — many studies, different labs, different methods, slowly stacking until the same finding shows up no matter who looks. A claim earns trust by surviving repetition, not by being astonishing the first time. So the headline that screams about one study has picked the wrong unit. The right unit is boring on purpose: the slow accumulation, the replication you never read about, the effect that keeps showing up after the buzz has moved on.

Don't overcorrect into cynicism

Now the guardrail, because the easy misread is "so psychology is fake." It isn't, and the data say so. The relationship is correlational — coverage tracks with fragility; it doesn't prove the media broke anything. And there's genuinely good news buried in the same numbers: between 2010 and 2019, average replication scores rose. Preregistration, bigger samples, and a field that got publicly embarrassed and decided to fix it are working. So the lesson isn't to sneer at every study. It's to hold a single splashy result loosely, and to trust most the findings dull enough that nobody made them go viral.

What to do with the next viral headline

Here's the move, small enough to actually use. When a "new study finds…" lands in your feed, ask one question before you share: is this one study, or many? A lone, surprising result is a hypothesis wearing a headline's costume — interesting, worth watching, not yet something to rebuild your habits around. Wait for the words "replicated," "meta-analysis," "across multiple labs." Notice that the most trustworthy science usually arrives without fireworks, because by the time something is solid, it's no longer surprising. The thrill of a finding and its truth are, more often than we'd like, inversely related. Treat your own astonishment as a yellow light, not a green one.

A headline is one study in a costume. Truth is the boring pile of studies behind it.

The more a finding surprises you, the longer you should wait before you believe it.

Sources: a 20-year machine-learning analysis scoring the replicability of 14,000+ psychology papers in top journals (2000–2019), which found media coverage inversely related to replication likelihood and citations unrelated to it (reported via Big Think, "Psychology studies that go viral are likelier to be bogus"); the Reproducibility Project: Psychology (Open Science Collaboration, 2015), which replicated 100 studies with roughly a third reproducing and effect sizes about half the originals. Framework from Keith Stanovich, How to Think Straight About Psychology (falsifiability, converging evidence, why media spotlight ≠ truth). Popular-science reflection — the coverage–replication link is correlational, not causal; not professional or clinical advice.

心理

一项心理学研究越是刷屏,越可能不靠谱

2026 年 6 月 21 日 · 斯坦诺维奇《对伪心理学说不》约 4 分钟

你去年转发过的那个聪明的心理学发现——带着完美的反直觉反转、朋友真的点开看了的那个——它成立的概率,恐怕比你希望的要低。研究者训练了一个机器学习模型,去读 2000 至 2019 年间发表在顶级期刊上的 1.4 万余篇心理学论文,给每一篇「能不能站得住」打分。结果让人不太舒服:一项研究被媒体报道得越多,它能被重复验证的概率反而越低。你记得的那条头条,平均而言,是更弱的那门科学。

病毒式传播是一道筛子,而它筛错了东西

不妨把媒体关注,看成一面筛网,而非对好工作的奖赏。一项研究好不好转发,靠的是一张短清单:意外、干净利落、能用一句话讲完一个反直觉的翻转。「高能量姿势让你更大胆」「微笑让你更快乐」「意志力像肌肉一样会耗尽」——正是这类研究,编辑追着写、读者抢着转。可让一个结论传得开的那些特质,恰恰也是让它脆弱的特质:一个只做出过一次的、戏剧性的单一效应,正是别人重做一遍时最容易缩水、甚至凭空消失的那种。聚光灯和结实,朝着相反的方向拉扯。而且别以为出名就稀有、就可信:那项分析发现,高被引论文也并不比其他更可能被重复。引用次数同样不替真相背书。

「可重复性」到底揭示了什么

这不是一个模型的臆测。早在 2015 年,一个由 270 名研究者组成的团队,就尝试在原始条件下重做 100 项知名的心理学研究。第二次能做出同样显著结果的,只有约三分之一到四成。平均来看,重复出来的效应,大小只有原文的一半左右。慢慢读这句话:把一架子写进教科书的发现,认真重做一遍,大部分的戏剧性都会变薄、乃至消失。不是因为最初的研究者撒了谎——绝大多数没有——而是因为单项研究是一件嘈杂的仪器,一次实验跑出的惊人数字,往往只是恰好长得像信号的噪声。

越是刷屏的研究,越难被重复验证媒体聚光灯 · 一道筛子,不是判决它专门筛出意外的、干净利落的、单一反直觉的结论刷屏 · 意外一项戏剧性的头条研究好转发——也脆弱很难被重复安静 · 被反复验证一摞重复验证的实验乏味——却耐久可信1.4 万余篇论文,2000–2019:100 项标志性研究复验,仅约三分之一重现。这是相关而非因果;2010→2019 间,随学科收紧,复验分数逐年回升。聚光灯筛子
一项以机器学习分析顶级期刊 1.4 万余篇心理学论文(2000–2019)的研究发现:一项研究被媒体报道得越多,它能被重复验证的概率反而越低;高被引论文也并不更可靠。背景:可重复性项目·心理学(2015)复验 100 项研究,仅约三分之一重现,效应量约为原文的一半。框架:斯坦诺维奇《对伪心理学说不》(用聚合证据,而非一项戏剧性研究)。本文为科普解读;此处为相关而非因果。

可信的单位是那一摞,不是那条头条

这正是斯坦诺维奇《对伪心理学说不》的脊梁,也是最该刻在某处的一句。心理学里真正的知识,不建在那一个天才实验上,而建在聚合证据上——许多研究、不同实验室、不同方法,慢慢叠起来,直到无论谁来看,同一个结论都还在。一个论断是靠熬过重复来赢得信任的,不是靠第一次让人吃惊。所以那条为一项研究尖叫的头条,挑错了单位。正确的单位故意很无聊:缓慢的累积、你从没读到过的那些复验、在热度退去之后仍一次次冒出来的那个效应。

别矫枉过正成犬儒

现在说护栏,因为最省事的误读是「那心理学都是假的」。它不是,数据也这么说。这层关系是相关性的——报道量与脆弱性同向变化,但并不证明媒体毁掉了什么。而同一组数字里,还埋着一个真正的好消息:2010 到 2019 年间,平均复验分数在回升。预注册、更大的样本、一个被公开打脸后下决心去修的学科,都在起作用。所以教训不是对每项研究都翻白眼,而是:对单一一个惊艳结果,手要松一点;最该信的,反倒是那些乏味到没人把它做成爆款的发现。

下次碰到刷屏头条,该怎么办

这就是那个动作,小到真能用上。当一条「最新研究发现……」落进你的信息流,转发之前先问一句:这是一项研究,还是许多项?一个孤零零的、令人意外的结果,是穿着头条戏服的一个假设——有意思、值得留意,但还不到能让你据此重搭习惯的地步。等到「已被重复验证」「元分析」「多个实验室一致」这些字眼出现再说。你会注意到,最可信的科学,往往不带烟花登场——因为等一件事真站稳了,它早已不再令人意外。一个发现带来的兴奋,和它的真实程度,比我们愿意承认的更常成反比。把你自己的惊讶,当成黄灯,而不是绿灯。

头条是穿着戏服的一项研究,真相是它背后那一摞乏味的研究。

一个发现越让你惊讶,你就越该多等一会儿再相信它。

资料来源:一项历时 20 年的机器学习分析,为顶级期刊 1.4 万余篇心理学论文(2000–2019)的可重复性打分,发现媒体报道量与可重复概率呈负相关、被引次数与之无关(经 Big Think《会刷屏的心理学研究更可能不靠谱》报道);可重复性项目·心理学(开放科学协作组,2015)复验 100 项研究,约三分之一重现,效应量约为原文的一半。框架取自斯坦诺维奇《对伪心理学说不》(可证伪性、聚合证据、为何媒体聚光灯≠真相)。本文为科普解读——报道与可重复之间是相关而非因果;非专业或临床建议。

心理学

心理学の研究は、バズるほど正しくない

2026年6月21日 · スタノヴィッチ『心理学をまじめに考える方法』約 6 分

去年あなたがシェアした、あの気の利いた心理学の発見——完璧な反直感のひねりがあって、友人が実際にクリックした、あれ。それが正しい見込みは、望みより低いかもしれない。研究者は機械学習モデルを訓練し、2000年から2019年にトップ誌へ載った心理学論文1万4千本超を読ませ、それぞれが「持ちこたえるか」を採点させた。浮かび上がった図式は、居心地が悪い。研究がメディアに取り上げられるほど、追試で再現される確率は下がった。あなたが覚えている見出しは、平均すると、より弱いほうの科学だったのだ。

拡散はふるいであり、しかも間違ったものをふるい分ける

メディアの注目を、良い仕事へのご褒美ではなく、一枚のふるいだと見るとわかりやすい。研究が拡散しやすいかどうかは、短いリストで決まる。意外で、きれいで、一文で言える反直感のひとひねりがある。「ハイパワー・ポーズで大胆になる」「笑えば幸せになる」「意志力は筋肉のように尽きる」——編集者が追いかけ、読者が転送するのは、まさにこの手の研究だ。だが、結論を広げる特質は、そのまま結論を脆くする特質でもある。一度きり見つかった劇的な単一効果は、誰かがもう一度走らせたとき、最も縮みやすく、消えやすい。脚光と頑丈さは、逆方向へ引っ張り合っている。しかも、有名なら希少で信頼できる、というわけでもない。分析では、被引用数の多い論文も、ほかより再現されやすいわけではなかった。引用も真実を保証しない。

「再現性」が実際に示したこと

これは一つのモデルの当て推量ではない。すでに2015年、270人の研究者からなる集団が、よく知られた心理学研究100件を、元の条件で再実験しようと試みた。二度目に同じ有意な結果が出たのは、約3分の1から4割にすぎない。平均すると、再現された効果の大きさは、原典のおよそ半分だった。ゆっくり読んでほしい。教科書に載った発見の棚を、丁寧にもう一度走らせると、劇的さの大半は薄れ、あるいは消える。最初の研究者が嘘をついたからではない——大半はついていない——単一研究は騒がしい計器であり、一回の実験が叩き出す驚きの数字は、たまたま信号のように見えた雑音であることが多いからだ。

バズる研究ほど、再現されにくいメディアの脚光 · 判決ではなく、ふるい意外で、きれいで、反直感のひとひねりだけを選び取るバズる · 意外劇的な見出しの一研究拡散しやすく——脆いめったに再現しない静か · 何度も追試積み重なった追試の山地味——だが頑丈信頼できる1万4千本超、2000–2019:代表的な100研究の追試で、再現は約3分の1のみ。相関であって因果ではない。2010→2019、分野が厳格化し再現スコアは上昇した。脚光のふるい
トップ誌の心理学論文1万4千本超(2000–2019)を機械学習で分析した研究は、メディアに取り上げられた研究ほど追試で再現されにくいことを見いだした。被引用数の多い論文も特に強くはなかった。背景:再現性プロジェクト・心理学(2015)は100研究を追試し、再現は約3分の1、効果量は原典のおよそ半分だった。枠組:スタノヴィッチ『心理学をまじめに考える方法』(一つの劇的な研究ではなく、収束する証拠)。本稿は科学解説であり、ここでの関係は相関であって因果ではない。

信頼の単位は山であって、見出しではない

これがスタノヴィッチ『心理学をまじめに考える方法』の背骨であり、どこかに刻んでおく価値のある一節だ。心理学の本当の知識は、一つの見事な実験の上には建たない。それは収束する証拠の上に建つ——多くの研究、別々の研究室、別々の方法が、誰が見ても同じ発見が残るまで、ゆっくり積み上がっていく。主張は、繰り返しを生き延びて信頼を勝ち取るのであって、最初に人を驚かせて勝ち取るのではない。だから一つの研究を叫び立てる見出しは、単位を間違えている。正しい単位は、わざと退屈だ。緩やかな蓄積、あなたが一度も読まなかった追試、騒ぎが去ったあとも何度も顔を出す効果。

シニシズムへ振り切れないこと

ここで手すりを。いちばん安直な誤読は「では心理学はインチキだ」だからだ。そうではないし、データもそう言う。この関係は相関である——報道量は脆さと連動するが、メディアが何かを壊したと証明するわけではない。そして同じ数字の中に、本物の朗報も埋まっている。2010年から2019年にかけて、平均の再現スコアは上昇した。事前登録、より大きな標本、公に恥をかいて直すと決めた分野が、効いている。だから教訓は、あらゆる研究に冷笑を向けることではない。単一の派手な結果は手を緩めて握り、誰もバズらせなかったほど地味な発見こそ、いちばん信じることだ。

次にバズる見出しに出会ったら

これが、実際に使えるほど小さい手だ。「最新研究によると……」があなたのフィードに落ちてきたら、シェアの前に一つ問う。これは一つの研究か、それとも多くの研究か。孤立した意外な結果は、見出しの衣装をまとった仮説だ——面白く、注視に値するが、それを土台に習慣を組み直すには早い。「再現された」「メタ分析」「複数の研究室で一致」という言葉が出るまで待とう。最も信頼できる科学は、たいてい花火なしで現れる。何かが固まる頃には、それはもう意外ではないからだ。発見の高揚と、その真実は、認めたくないほどしばしば反比例する。自分の驚きを、青信号ではなく、黄信号として扱おう。

見出しは衣装をまとった一つの研究。真実は、その背後にある退屈な研究の山だ。

発見があなたを驚かせるほど、信じる前に長く待つほうがいい。

出典:トップ誌の心理学論文1万4千本超(2000–2019)の再現可能性を採点した20年がかりの機械学習分析。報道量は再現の見込みと負の相関にあり、被引用数とは無関係だった(Big Think「バズる心理学研究ほど怪しい」より)/再現性プロジェクト・心理学(Open Science Collaboration, 2015)は100研究を追試し、約3分の1が再現、効果量は原典のおよそ半分だった。枠組はスタノヴィッチ『心理学をまじめに考える方法』より(反証可能性、収束する証拠、なぜメディアの脚光≠真実か)。本稿は科学解説——報道と再現の関係は相関であって因果ではない。専門的・臨床的な助言ではありません。