← 返回全部文章
Tech
AI 推荐的证据底座,正被 21.5 万篇写给机器看的假指南占领
2026 年 9 月 3 日 · 吴军《数学之美》~2 min read
开门做生意的网站,首页标题恨不得写成「某某,领先的市场数据平台」,招牌嘛,写给客人看的。worldmetrics.org 和 gitnux.org 的首页 HTML 标题倒好:「品牌名 — Facts & Grounding Page」。Grounding,检索接地,AI 检索系统的行话,买软件的人一辈子说不出这个词。这俩站等于把底牌拍在了招牌上:读者是机器,不是人。2026 年 9 月 2 日,Trellner 发布的一份测量报告顺着这条线往下挖,在 AI 推荐引擎的「证据底座」里,挖出一座量产假权威的工厂。
30 秒读懂
2026 年 9 月 2 日,Trellner 发布测量报告(Hacker News 286 分、126 条评论):拿 380 个软件品类挨个问 Perplexity 的 sonar 与 sonar-pro「最佳产品前五」,760 次调用收回 7,534 条引用、落在 2,055 个域名上。
59.8% 的引用指向 Tranco 排名十万名开外的域名,23.4% 压根不在前一百万名里;Wikipedia 在 7,534 条引用里统共被引了 3 次。
卖「交互式产品演示」的 guideflow.com 被引 194 次、覆盖 96/380 个品类,总量第三,排在 Gartner 前面。
三个同模板空壳站 wifitalents.com、worldmetrics.org、gitnux.org 合计发了 215,128 个机器生成的购买指南页;其中两站首页标题明晃晃写着「Facts & Grounding Page」。
报告自己认账:只测 Perplexity 一家、单日快照,也没证明去掉这些源后答案会变。
1 测量
七千五百条引用摊开一看,六成指向无名之地
先看它怎么量的,这份报告值钱就值钱在方法上。
做法土得很,但土办法扎实。2026 年 9 月 2 日一天之内,经 OpenRouter 向 perplexity/sonar 与 sonar-pro 两个型号,把 380 个软件品类挨个问了一遍「这个品类最好的五个产品是什么」,一共 760 次调用;品类清单在看到任何结果之前就定了稿,想事后挑好看的数,门都没有。收回 7,534 条引用,落在 2,055 个域名上。拿这些域名去对 Tranco 流量排名表,账就摊开了。
指向 Tranco 十万名开外域名的引用
59.8%
根本不在 Tranco 前一百万名的引用
23.4%
三条口径均为全部 7,534 条引用;有排名的引用中位数排名 71,611。作为对照,Wikipedia 全程只被引 3 次。
2 插队
一家卖演示工具的厂商,被引次数压过 Gartner
被引榜前两名还像那么回事,看到第三名,味儿就不对了。
域名 被引次数 身份
g2.com 291(3.86%) 软件评测平台
reddit.com 261 社区讨论
guideflow.com 194 演示工具厂商,Tranco 排名 177,039
gartner.com 158 老牌分析机构
zapier.com 82 自动化工具厂商
wifitalents.com 71 本文主角其一
capterra.com 68 软件目录
guideflow.com 是家卖「交互式产品演示」的厂商,自己不做评测,也没在被问的任何一个品类里参赛。可它的营销博客被引了 194 次、覆盖 96/380 个品类,总被引量全场第三,站点地图上挂着 2,176 篇不同的博文。你别看它没下场比赛,评委手里的参考材料倒有一摞是它印的。一家厂商靠营销博文坐进 AI 的证据席,这已经够怪;再往下挖,才挖到真正成建制的东西。
3 解剖
三个空壳站量产 21.5 万篇指南,标题里写明读者是机器
被引榜上的 wifitalents、worldmetrics、gitnux,是同一家工厂的三条产线。
三个域名都是 2023 年 12 月到 2024 年 5 月之间经 NameCheap 注册的,共用同一对 Cloudflare 域名服务器(pam 和 sean),页面模板和导航一个模子倒出来。每个站的「博客」都恰好只有 6 篇文章,内容全是哥仨互相吹,顺带吹第四个品牌 zipdo.co。真正的产能在别处:三站合计发了 215,128 个机器生成的 /best/<品类>-software/ 购买指南页。世界上哪来 21.5 万个软件品类。给这路站起个名,就叫「饲料站」:它活着的全部意义就是被检索命中,专门给 AI 的证据底座供货。
做工糙到什么程度?同一个问题「项目估算软件哪家好」,三个站给出三份互相打架的榜单,Gitnux 的第一名压根不在 Worldmetrics 的前五里;三站拢共署了九个各不相同的「编辑」名字;两站的署名行里还留着没渲染的模板变量「Within the next 26 days」。糙归糙没关系,反正没有人类会翻到这些页面。这门道我熟:2016 年厂里接珠三角一个区的惠企补贴申报系统,验收那天上午把域名解析指到一台叫 zs-demo-02 的演示机上,库里躺着头天晚上洗出来的一百二十条样板申报,专家组点了七八下,总分 96;生产库里那三千多条、有的卡了四十多天的,一条也没进去。戏演给打分的那关看就够了,用系统的人另算。饲料站连遮掩都懒得做,变现的柜台倒擦得锃亮:worldmetrics.org 在被 AI 引用的榜单页上方明码标价,「定制市场研究 5,000 欧元起」「厂商选型 2,500 欧元起」。
核心 「Facts & Grounding Page」这标题就是商业模式的自白:页面写给检索系统看,钱找被检索结果送上门的人类收。
THE ANSWER'S RAW-MATERIAL PIPE — 60% RUNS FROM FEEDER SITES VISIBLE AUTHORITIES · ≈9% OF ALL CITATIONS g2 · 291 Reddit · 261 Gartner · 158 Wikipedia: cited just 3 times out of 7,534 FEEDER SITES · 59.8% OF CITATIONS BEYOND TOP 100K Three sister sites 215,128 /best/ pages guideflow's blog 194 cites · 96/380 categories “Facts & Grounding Page” — a homepage title written for machines €2,500 vendor selection priced right on worldmetrics Which software is best? the user's question Perplexity retrieval rule: a page = evidence The top-five answer all the user ever sees citations · data money · manipulation Source: Trellner measurement report (2026-09-02). Of the 7,534 citations Perplexity's retrieval layer returned, visible authorities are a thin crust at roughly 9% — 59.8% point to no-name domains, and the feeder factory behind them sells vendor selection from €2,500 upward. Only Perplexity was tested, in a one-day snapshot; see the original report for details.
4 照亮
负反馈回路断了,作弊只剩机器这一关要骗
吴军在《数学之美》里写搜索反作弊,把它翻译成一个通信问题。
那一章的框架是:作弊的本质,是往排序信号里注入伪造的信任。垃圾链接骗 PageRank,就像往通信信道里注入噪声;反作弊要干的,是把信号的真实性还原回来。拿这套框架照今天的饲料站,能看清一件事:攻击手法一点没变,伪造信源本来就是信道里最老的攻击;变掉的是信道结构。我爸 2001 年在五金店进过一批「全新」继电器,其实是打磨翻新货,一个开维修部的老客户从兜里摸出放大镜一看丝印,字体不对,当场退货,我爸按行规赔了双倍,从那以后柜台上常年搁一瓶丙酮,擦一下丝印,翻新的就露馅。那位摸放大镜的老客户,就是负反馈回路本人:货到得了他手上,假的就藏不住。顾客一辈子摸不着原料的信道里,放大镜没处使。
旧搜索时代
作弊者要连闯两关:先骗过排名算法,再骗过点进页面的真人。页面太烂,用户扭头就走,跳出行为反手压低排名,负反馈回路把烂页面往下摁。
AI 检索时代
人只读 AI 汇总出来的答案,被引用的页面从头到尾见不着。骗过检索层这一关就算通关,页面糙成什么样都无所谓,标题干脆直接写给机器看。
打个比方
老式作弊像把假名牌摆进商场:柜台骗得过,顾客上手一摸就露馅,退货潮能淹死它。饲料站是往罐头厂的原料管道里灌料:吃罐头的人只见得到罐头,一辈子见不着原料,而管道的验收规格里就写了一条「有页面就算有证据」。权威的伪造成本一路掉到接近零,检索层还按老规格收货。
5 交底
报告主动交了底:它没有证明答案被带偏
这份报告最让我信得过的地方,恰恰是它自己认账的地方。
边界写得明明白白。只测了 Perplexity 一家;两个型号共用同一个检索层,289/380 个品类的引用列表逐字节一模一样,顶多算一套检索栈采了两次样;快照也就一天。最要紧的一条:报告没有证明去掉这些源之后答案会变。它测的是证据底座由什么构成,不是结论被带偏了多少。
底座之外的附带伤害倒是实打实。模型报出的 1,502 个「官网」里,17 个已经死了或者够不着;sonar 把数据平台 Dryad 的官网给成 dryad.co,这域名如今跳转到印尼赌博门户「BIGSLOT288」;sonar-pro 把数据质量工具 Monte Carlo 的官网给成 montecarlo.com,那是摩纳哥的赌场酒店集团。你问 AI 要个数据工具,它给你递来一家赌场。
Tranco 是抗操纵的域名流量排名,综合多家来源取均值。「中位数排名 71,611」只统计查得到排名的引用;23.4% 无排名的引用未计入,计入的话图景只会更偏。
6 带走
这对你意味着什么:把 AI 的推荐当线索,别当结论
检索层一天不改验收规格,饲料站的产线一天不停。
三条作业,直接抄。第一条,问完「哪家产品最好」,追一句「把引用来源列出来」;来源里全是眼生域名的那几条推荐,降权处理。第二条,AI 报出来的「官网」别顺手就点,先扫一眼域名对不对得上厂商名:1,502 个官网错了 17 个,错的那头可能就是赌场。第三条,自己做产品的,去搜搜自己的品类加上 best software,看看饲料站有没有替你「评」出一份榜单,你的竞争对手没准已经在给检索层供货了。
罐头还是那个罐头,标签照旧印着「精选原料」。下回 AI 给你报前五名,先别急着抄,问一句:原料管道那头,接的是谁家的产线?
取材声明:本文思想框架取材自吴军《数学之美》(搜索反作弊:作弊即向排序信号注入伪造的信任,反作弊即还原信号真实性);事实与全部数字来自 Trellner 2026 年 9 月 2 日发布的公开测量报告《Manufactured Sources Behind AI Recommendations》及其中数据,细节以报告原文为准。本文为技术科普解读。
技术
AI 推荐的证据底座,正被 21.5 万篇写给机器看的假指南占领
2026 年 9 月 3 日 · 吴军《数学之美》约 7 分钟
开门做生意的网站,首页标题恨不得写成「某某,领先的市场数据平台」,招牌嘛,写给客人看的。worldmetrics.org 和 gitnux.org 的首页 HTML 标题倒好:「品牌名 — Facts & Grounding Page」。Grounding,检索接地,AI 检索系统的行话,买软件的人一辈子说不出这个词。这俩站等于把底牌拍在了招牌上:读者是机器,不是人。2026 年 9 月 2 日,Trellner 发布的一份测量报告顺着这条线往下挖,在 AI 推荐引擎的「证据底座」里,挖出一座量产假权威的工厂。
30 秒读懂
2026 年 9 月 2 日,Trellner 发布测量报告(Hacker News 286 分、126 条评论):拿 380 个软件品类挨个问 Perplexity 的 sonar 与 sonar-pro「最佳产品前五」,760 次调用收回 7,534 条引用、落在 2,055 个域名上。
59.8% 的引用指向 Tranco 排名十万名开外的域名,23.4% 压根不在前一百万名里;Wikipedia 在 7,534 条引用里统共被引了 3 次。
卖「交互式产品演示」的 guideflow.com 被引 194 次、覆盖 96/380 个品类,总量第三,排在 Gartner 前面。
三个同模板空壳站 wifitalents.com、worldmetrics.org、gitnux.org 合计发了 215,128 个机器生成的购买指南页;其中两站首页标题明晃晃写着「Facts & Grounding Page」。
报告自己认账:只测 Perplexity 一家、单日快照,也没证明去掉这些源后答案会变。
1 测量
七千五百条引用摊开一看,六成指向无名之地
先看它怎么量的,这份报告值钱就值钱在方法上。
做法土得很,但土办法扎实。2026 年 9 月 2 日一天之内,经 OpenRouter 向 perplexity/sonar 与 sonar-pro 两个型号,把 380 个软件品类挨个问了一遍「这个品类最好的五个产品是什么」,一共 760 次调用;品类清单在看到任何结果之前就定了稿,想事后挑好看的数,门都没有。收回 7,534 条引用,落在 2,055 个域名上。拿这些域名去对 Tranco 流量排名表,账就摊开了。
指向 Tranco 十万名开外域名的引用
59.8%
根本不在 Tranco 前一百万名的引用
23.4%
三条口径均为全部 7,534 条引用;有排名的引用中位数排名 71,611。作为对照,Wikipedia 全程只被引 3 次。
2 插队
一家卖演示工具的厂商,被引次数压过 Gartner
被引榜前两名还像那么回事,看到第三名,味儿就不对了。
域名 被引次数 身份
g2.com 291(3.86%) 软件评测平台
reddit.com 261 社区讨论
guideflow.com 194 演示工具厂商,Tranco 排名 177,039
gartner.com 158 老牌分析机构
zapier.com 82 自动化工具厂商
wifitalents.com 71 本文主角其一
capterra.com 68 软件目录
guideflow.com 是家卖「交互式产品演示」的厂商,自己不做评测,也没在被问的任何一个品类里参赛。可它的营销博客被引了 194 次、覆盖 96/380 个品类,总被引量全场第三,站点地图上挂着 2,176 篇不同的博文。你别看它没下场比赛,评委手里的参考材料倒有一摞是它印的。一家厂商靠营销博文坐进 AI 的证据席,这已经够怪;再往下挖,才挖到真正成建制的东西。
3 解剖
三个空壳站量产 21.5 万篇指南,标题里写明读者是机器
被引榜上的 wifitalents、worldmetrics、gitnux,是同一家工厂的三条产线。
三个域名都是 2023 年 12 月到 2024 年 5 月之间经 NameCheap 注册的,共用同一对 Cloudflare 域名服务器(pam 和 sean),页面模板和导航一个模子倒出来。每个站的「博客」都恰好只有 6 篇文章,内容全是哥仨互相吹,顺带吹第四个品牌 zipdo.co。真正的产能在别处:三站合计发了 215,128 个机器生成的 /best/<品类>-software/ 购买指南页。世界上哪来 21.5 万个软件品类。给这路站起个名,就叫「饲料站」:它活着的全部意义就是被检索命中,专门给 AI 的证据底座供货。
做工糙到什么程度?同一个问题「项目估算软件哪家好」,三个站给出三份互相打架的榜单,Gitnux 的第一名压根不在 Worldmetrics 的前五里;三站拢共署了九个各不相同的「编辑」名字;两站的署名行里还留着没渲染的模板变量「Within the next 26 days」。糙归糙没关系,反正没有人类会翻到这些页面。这门道我熟:2016 年厂里接珠三角一个区的惠企补贴申报系统,验收那天上午把域名解析指到一台叫 zs-demo-02 的演示机上,库里躺着头天晚上洗出来的一百二十条样板申报,专家组点了七八下,总分 96;生产库里那三千多条、有的卡了四十多天的,一条也没进去。戏演给打分的那关看就够了,用系统的人另算。饲料站连遮掩都懒得做,变现的柜台倒擦得锃亮:worldmetrics.org 在被 AI 引用的榜单页上方明码标价,「定制市场研究 5,000 欧元起」「厂商选型 2,500 欧元起」。
核心 「Facts & Grounding Page」这标题就是商业模式的自白:页面写给检索系统看,钱找被检索结果送上门的人类收。
答案的原料管道,六成接进了饲料站 可见的权威 · 约占全部引用 9% g2 · 291 Reddit · 261 Gartner · 158 Wikipedia:7,534 条里只被引 3 次 饲料站 · 59.8% 的引用落在十万名开外 三姐妹空壳站 215,128 个 /best/ 页 guideflow 营销博客 194 次引用 · 96/380 品类 「Facts & Grounding Page」——首页标题写给机器看 厂商选型 €2,500 起 worldmetrics 榜单页明码标价 哪家软件最好? 用户提问 Perplexity 检索层 采信规格:有页面就算证据 推荐前五 用户只见得到这一层 引用·数据流 金钱·操纵 来源:Trellner 测量报告(2026-09-02)。Perplexity 检索层交回的 7,534 条引用里,可见的权威只占约 9% 的薄薄一层;59.8% 指向无名域名,背后的饲料站工厂按 €2,500 起出售厂商选型。本测量仅测 Perplexity 一家、单日快照,细节以报告原文为准。
4 照亮
负反馈回路断了,作弊只剩机器这一关要骗
吴军在《数学之美》里写搜索反作弊,把它翻译成一个通信问题。
那一章的框架是:作弊的本质,是往排序信号里注入伪造的信任。垃圾链接骗 PageRank,就像往通信信道里注入噪声;反作弊要干的,是把信号的真实性还原回来。拿这套框架照今天的饲料站,能看清一件事:攻击手法一点没变,伪造信源本来就是信道里最老的攻击;变掉的是信道结构。我爸 2001 年在五金店进过一批「全新」继电器,其实是打磨翻新货,一个开维修部的老客户从兜里摸出放大镜一看丝印,字体不对,当场退货,我爸按行规赔了双倍,从那以后柜台上常年搁一瓶丙酮,擦一下丝印,翻新的就露馅。那位摸放大镜的老客户,就是负反馈回路本人:货到得了他手上,假的就藏不住。顾客一辈子摸不着原料的信道里,放大镜没处使。
旧搜索时代
作弊者要连闯两关:先骗过排名算法,再骗过点进页面的真人。页面太烂,用户扭头就走,跳出行为反手压低排名,负反馈回路把烂页面往下摁。
AI 检索时代
人只读 AI 汇总出来的答案,被引用的页面从头到尾见不着。骗过检索层这一关就算通关,页面糙成什么样都无所谓,标题干脆直接写给机器看。
打个比方
老式作弊像把假名牌摆进商场:柜台骗得过,顾客上手一摸就露馅,退货潮能淹死它。饲料站是往罐头厂的原料管道里灌料:吃罐头的人只见得到罐头,一辈子见不着原料,而管道的验收规格里就写了一条「有页面就算有证据」。权威的伪造成本一路掉到接近零,检索层还按老规格收货。
5 交底
报告主动交了底:它没有证明答案被带偏
这份报告最让我信得过的地方,恰恰是它自己认账的地方。
边界写得明明白白。只测了 Perplexity 一家;两个型号共用同一个检索层,289/380 个品类的引用列表逐字节一模一样,顶多算一套检索栈采了两次样;快照也就一天。最要紧的一条:报告没有证明去掉这些源之后答案会变。它测的是证据底座由什么构成,不是结论被带偏了多少。
底座之外的附带伤害倒是实打实。模型报出的 1,502 个「官网」里,17 个已经死了或者够不着;sonar 把数据平台 Dryad 的官网给成 dryad.co,这域名如今跳转到印尼赌博门户「BIGSLOT288」;sonar-pro 把数据质量工具 Monte Carlo 的官网给成 montecarlo.com,那是摩纳哥的赌场酒店集团。你问 AI 要个数据工具,它给你递来一家赌场。
Tranco 是抗操纵的域名流量排名,综合多家来源取均值。「中位数排名 71,611」只统计查得到排名的引用;23.4% 无排名的引用未计入,计入的话图景只会更偏。
6 带走
这对你意味着什么:把 AI 的推荐当线索,别当结论
检索层一天不改验收规格,饲料站的产线一天不停。
三条作业,直接抄。第一条,问完「哪家产品最好」,追一句「把引用来源列出来」;来源里全是眼生域名的那几条推荐,降权处理。第二条,AI 报出来的「官网」别顺手就点,先扫一眼域名对不对得上厂商名:1,502 个官网错了 17 个,错的那头可能就是赌场。第三条,自己做产品的,去搜搜自己的品类加上 best software,看看饲料站有没有替你「评」出一份榜单,你的竞争对手没准已经在给检索层供货了。
罐头还是那个罐头,标签照旧印着「精选原料」。下回 AI 给你报前五名,先别急着抄,问一句:原料管道那头,接的是谁家的产线?
取材声明:本文思想框架取材自吴军《数学之美》(搜索反作弊:作弊即向排序信号注入伪造的信任,反作弊即还原信号真实性);事实与全部数字来自 Trellner 2026 年 9 月 2 日发布的公开测量报告《Manufactured Sources Behind AI Recommendations》及其中数据,细节以报告原文为准。本文为技术科普解读。
テクノロジー
AI 推荐的证据底座,正被 21.5 万篇写给机器看的假指南占领
2026 年 9 月 3 日 · 吴军《数学之美》約 7 分
开门做生意的网站,首页标题恨不得写成「某某,领先的市场数据平台」,招牌嘛,写给客人看的。worldmetrics.org 和 gitnux.org 的首页 HTML 标题倒好:「品牌名 — Facts & Grounding Page」。Grounding,检索接地,AI 检索系统的行话,买软件的人一辈子说不出这个词。这俩站等于把底牌拍在了招牌上:读者是机器,不是人。2026 年 9 月 2 日,Trellner 发布的一份测量报告顺着这条线往下挖,在 AI 推荐引擎的「证据底座」里,挖出一座量产假权威的工厂。
30 秒读懂
2026 年 9 月 2 日,Trellner 发布测量报告(Hacker News 286 分、126 条评论):拿 380 个软件品类挨个问 Perplexity 的 sonar 与 sonar-pro「最佳产品前五」,760 次调用收回 7,534 条引用、落在 2,055 个域名上。
59.8% 的引用指向 Tranco 排名十万名开外的域名,23.4% 压根不在前一百万名里;Wikipedia 在 7,534 条引用里统共被引了 3 次。
卖「交互式产品演示」的 guideflow.com 被引 194 次、覆盖 96/380 个品类,总量第三,排在 Gartner 前面。
三个同模板空壳站 wifitalents.com、worldmetrics.org、gitnux.org 合计发了 215,128 个机器生成的购买指南页;其中两站首页标题明晃晃写着「Facts & Grounding Page」。
报告自己认账:只测 Perplexity 一家、单日快照,也没证明去掉这些源后答案会变。
1 测量
七千五百条引用摊开一看,六成指向无名之地
先看它怎么量的,这份报告值钱就值钱在方法上。
做法土得很,但土办法扎实。2026 年 9 月 2 日一天之内,经 OpenRouter 向 perplexity/sonar 与 sonar-pro 两个型号,把 380 个软件品类挨个问了一遍「这个品类最好的五个产品是什么」,一共 760 次调用;品类清单在看到任何结果之前就定了稿,想事后挑好看的数,门都没有。收回 7,534 条引用,落在 2,055 个域名上。拿这些域名去对 Tranco 流量排名表,账就摊开了。
指向 Tranco 十万名开外域名的引用
59.8%
根本不在 Tranco 前一百万名的引用
23.4%
三条口径均为全部 7,534 条引用;有排名的引用中位数排名 71,611。作为对照,Wikipedia 全程只被引 3 次。
2 插队
一家卖演示工具的厂商,被引次数压过 Gartner
被引榜前两名还像那么回事,看到第三名,味儿就不对了。
域名 被引次数 身份
g2.com 291(3.86%) 软件评测平台
reddit.com 261 社区讨论
guideflow.com 194 演示工具厂商,Tranco 排名 177,039
gartner.com 158 老牌分析机构
zapier.com 82 自动化工具厂商
wifitalents.com 71 本文主角其一
capterra.com 68 软件目录
guideflow.com 是家卖「交互式产品演示」的厂商,自己不做评测,也没在被问的任何一个品类里参赛。可它的营销博客被引了 194 次、覆盖 96/380 个品类,总被引量全场第三,站点地图上挂着 2,176 篇不同的博文。你别看它没下场比赛,评委手里的参考材料倒有一摞是它印的。一家厂商靠营销博文坐进 AI 的证据席,这已经够怪;再往下挖,才挖到真正成建制的东西。
3 解剖
三个空壳站量产 21.5 万篇指南,标题里写明读者是机器
被引榜上的 wifitalents、worldmetrics、gitnux,是同一家工厂的三条产线。
三个域名都是 2023 年 12 月到 2024 年 5 月之间经 NameCheap 注册的,共用同一对 Cloudflare 域名服务器(pam 和 sean),页面模板和导航一个模子倒出来。每个站的「博客」都恰好只有 6 篇文章,内容全是哥仨互相吹,顺带吹第四个品牌 zipdo.co。真正的产能在别处:三站合计发了 215,128 个机器生成的 /best/<品类>-software/ 购买指南页。世界上哪来 21.5 万个软件品类。给这路站起个名,就叫「饲料站」:它活着的全部意义就是被检索命中,专门给 AI 的证据底座供货。
做工糙到什么程度?同一个问题「项目估算软件哪家好」,三个站给出三份互相打架的榜单,Gitnux 的第一名压根不在 Worldmetrics 的前五里;三站拢共署了九个各不相同的「编辑」名字;两站的署名行里还留着没渲染的模板变量「Within the next 26 days」。糙归糙没关系,反正没有人类会翻到这些页面。这门道我熟:2016 年厂里接珠三角一个区的惠企补贴申报系统,验收那天上午把域名解析指到一台叫 zs-demo-02 的演示机上,库里躺着头天晚上洗出来的一百二十条样板申报,专家组点了七八下,总分 96;生产库里那三千多条、有的卡了四十多天的,一条也没进去。戏演给打分的那关看就够了,用系统的人另算。饲料站连遮掩都懒得做,变现的柜台倒擦得锃亮:worldmetrics.org 在被 AI 引用的榜单页上方明码标价,「定制市场研究 5,000 欧元起」「厂商选型 2,500 欧元起」。
核心 「Facts & Grounding Page」这标题就是商业模式的自白:页面写给检索系统看,钱找被检索结果送上门的人类收。
回答の原料パイプ、6割は飼料サイトに接続していた 見える権威 · 全引用の約 9% g2 · 291 Reddit · 261 Gartner · 158 Wikipedia:7,534 件中わずか 3 回 飼料サイト · 引用の 59.8% は上位10万圏外 三姉妹の空殻サイト 215,128 の /best/ ページ guideflow の販促ブログ 194 回引用 · 96/380 品目 「Facts & Grounding Page」——見出しは機械宛て ベンダー選定 €2,500〜 worldmetrics に価格明記 どのソフトが最良? ユーザーの質問 Perplexity 検索層 採用基準:ページ=証拠 おすすめ上位5件 ユーザーに見えるのはここだけ 引用・データ カネ・操作 出典:Trellner 測定レポート(2026-09-02)。Perplexity の検索層が返した 7,534 件の引用のうち、見える権威は約 9% の薄い層にすぎず、59.8% は無名ドメインを指す。背後の飼料サイト工場は €2,500 からベンダー選定を販売している。測定対象は Perplexity のみ・単日のスナップショットであり、詳細は原レポートを参照。
4 照亮
负反馈回路断了,作弊只剩机器这一关要骗
吴军在《数学之美》里写搜索反作弊,把它翻译成一个通信问题。
那一章的框架是:作弊的本质,是往排序信号里注入伪造的信任。垃圾链接骗 PageRank,就像往通信信道里注入噪声;反作弊要干的,是把信号的真实性还原回来。拿这套框架照今天的饲料站,能看清一件事:攻击手法一点没变,伪造信源本来就是信道里最老的攻击;变掉的是信道结构。我爸 2001 年在五金店进过一批「全新」继电器,其实是打磨翻新货,一个开维修部的老客户从兜里摸出放大镜一看丝印,字体不对,当场退货,我爸按行规赔了双倍,从那以后柜台上常年搁一瓶丙酮,擦一下丝印,翻新的就露馅。那位摸放大镜的老客户,就是负反馈回路本人:货到得了他手上,假的就藏不住。顾客一辈子摸不着原料的信道里,放大镜没处使。
旧搜索时代
作弊者要连闯两关:先骗过排名算法,再骗过点进页面的真人。页面太烂,用户扭头就走,跳出行为反手压低排名,负反馈回路把烂页面往下摁。
AI 检索时代
人只读 AI 汇总出来的答案,被引用的页面从头到尾见不着。骗过检索层这一关就算通关,页面糙成什么样都无所谓,标题干脆直接写给机器看。
打个比方
老式作弊像把假名牌摆进商场:柜台骗得过,顾客上手一摸就露馅,退货潮能淹死它。饲料站是往罐头厂的原料管道里灌料:吃罐头的人只见得到罐头,一辈子见不着原料,而管道的验收规格里就写了一条「有页面就算有证据」。权威的伪造成本一路掉到接近零,检索层还按老规格收货。
5 交底
报告主动交了底:它没有证明答案被带偏
这份报告最让我信得过的地方,恰恰是它自己认账的地方。
边界写得明明白白。只测了 Perplexity 一家;两个型号共用同一个检索层,289/380 个品类的引用列表逐字节一模一样,顶多算一套检索栈采了两次样;快照也就一天。最要紧的一条:报告没有证明去掉这些源之后答案会变。它测的是证据底座由什么构成,不是结论被带偏了多少。
底座之外的附带伤害倒是实打实。模型报出的 1,502 个「官网」里,17 个已经死了或者够不着;sonar 把数据平台 Dryad 的官网给成 dryad.co,这域名如今跳转到印尼赌博门户「BIGSLOT288」;sonar-pro 把数据质量工具 Monte Carlo 的官网给成 montecarlo.com,那是摩纳哥的赌场酒店集团。你问 AI 要个数据工具,它给你递来一家赌场。
Tranco 是抗操纵的域名流量排名,综合多家来源取均值。「中位数排名 71,611」只统计查得到排名的引用;23.4% 无排名的引用未计入,计入的话图景只会更偏。
6 带走
这对你意味着什么:把 AI 的推荐当线索,别当结论
检索层一天不改验收规格,饲料站的产线一天不停。
三条作业,直接抄。第一条,问完「哪家产品最好」,追一句「把引用来源列出来」;来源里全是眼生域名的那几条推荐,降权处理。第二条,AI 报出来的「官网」别顺手就点,先扫一眼域名对不对得上厂商名:1,502 个官网错了 17 个,错的那头可能就是赌场。第三条,自己做产品的,去搜搜自己的品类加上 best software,看看饲料站有没有替你「评」出一份榜单,你的竞争对手没准已经在给检索层供货了。
罐头还是那个罐头,标签照旧印着「精选原料」。下回 AI 给你报前五名,先别急着抄,问一句:原料管道那头,接的是谁家的产线?
取材声明:本文思想框架取材自吴军《数学之美》(搜索反作弊:作弊即向排序信号注入伪造的信任,反作弊即还原信号真实性);事实与全部数字来自 Trellner 2026 年 9 月 2 日发布的公开测量报告《Manufactured Sources Behind AI Recommendations》及其中数据,细节以报告原文为准。本文为技术科普解读。