vlog
← 返回全部文章

Tech

AI 为了合规悄悄改答案,监管说这可能就是欺骗

2026 年 7 月 29 日 · 保罗·格雷厄姆《黑客与画家》~1 min read

说 AI 惹麻烦,大家想的都是它乱讲话。美国联邦贸易委员会 7 月 1 日甩出来的那份文件把箭头掉了个头:为了守住某个州的法律,把答案往稳妥里改,还一声不吭,这一头同样可能违法。

30 秒读懂
1文件

监管这回给这件事起了名字:输出导向,压制准确性

标题本身就是结论。

第 14365 号行政命令点名要 FTC 讲清一件事:开发者为了满足某个州的法律去改模型输出,《FTC 法》第 5 条管不管得着。7 月 1 日这份声明就是 FTC 交的卷子,六天后登上《联邦公报》。

里头两个词值得记住:output steering,输出导向,指有人在模型作答的路上伸了一只手,把回答推向预定方向;suppression of accuracy,压制准确性,指这一推偏离了最准确的那个答案。两个词盯的是同一只手。

文件里的术语它指的是什么
output steering(输出导向 / 输出操舵)在模型作答的路上加一只手,把回答推向预定方向
suppression of accuracy(压制准确性)这只手推的方向,偏离了最准确的那个答案
Section 5(《FTC 法》第 5 条)禁止不公平或欺骗性的商业行为,本次执法主张的依据
2机制

你按标签买的是准确,到手的是被调过的准确

FTC 的推理链条其实很短。

起点是一条关于用户的假设:打开一个号称能回答问题的系统,人默认它奔着真实与准确去。这个默认是产品宣传和界面一路暗示出来的,不是用户自己长出来的。公司在营销里说准确、说客观、说听你的,用户就照这句话掏钱。

接着系统在后台被调了。理由可能相当正当:某个州的法律要求某类内容必须那样处理。你别看后台动了刀,用户这边什么都没变,标签还写着准确。FTC 说,这道落差正是第 5 条要看的东西:宣传造出一个预期,实际做法背离它,中间隔着一层用户不知道的改动。

FTC 没说改输出本身违法,它盯的是改了不说,还继续按原来的说法卖。被点名的现实案例在科罗拉多:该州修订后的 AI 法,被认为可能激励企业在不披露的情况下动输出。

我 2007 年入行第一个活,是给政务大厅做排队叫号系统。验收当天喇叭把「请 A052 号到 3 号窗口」念成连读,全厅哄笑;需求方最后一条验收意见写的是「声音要像人」,我回去改了三天 TTS 停顿。大厅里排队的人只听见喇叭里那一句,不知道有谁提过什么要求。改是别人要的,用户只收到成品。

STEERED QUIETLY, THE LABEL STOPS BEING TRUETHE PATH OF ONE ANSWERTWO ROUTES AFTER THE STEERINGYour questionone factual askModel computesfrom weights aloneOutput steeredquietly rewrittenIt reaches youlabel: still accuratestate law asks for the editSources of steeringstate-law complianceundisclosed goalsNo disclosuremarketing still says accurateDisclose itclear, conspicuous, prominentGap with expectationmay count as Section 5 deceptionExpectation resetdisclosure is the safe routeanswer pathcompliance pressure
Source: the FTC proposed policy statement on the suppression of accuracy in AI systems, issued 1 July 2026 and published in the Federal Register on 7 July 2026 (document 2026-13628); the public comment window closes 31 July 2026 for this docket. Reading: the edit itself is not the violation; the violation is an undisclosed edit sold under a product still marketed as accurate, which Section 5 treats as deception. A proposed policy statement is not a binding rule. Framework: Paul Graham, Hackers & Painters.
打个比方

药店门口贴着一句「照方抓药,一粒不差」。后来当地出了新规,某味药必须减量,店里照办,标签一个字没改,柜台上的话术还是那句一粒不差。减量本身合规,麻烦出在你端着药盒回家,仍以为拿到的是方子上写的东西。

3难题

谁有权说哪个答案算准确,这才是没人愿意先答的题

披露解决知情,解决不了标准。

FTC 的立场很干脆:用户默认预期的目标就是真实与准确。这话听着没法反驳,往下走一步就麻烦了。谁来判定哪个回答更准确?碰上有争议的题目,最准确的回答常常不止一个,挑哪个本身就带着立场。

保罗·格雷厄姆在《黑客与画家》里有一章叫《不能说的话》。他的观察是,每个时代都揣着一批看似不言自明、其实荒谬的观念,身处其中的人看不见它,因为流行就是自己看不见自己的样子。他给的辨认办法之一是拿另一个时代或另一个社会当对照:同一句话,换个地方就从常识变成异端。

模型的输出被调,依据是此刻的合规要求与主流共识。十年后回头看,这批依据里大概率有几条会显得可笑。所以格雷厄姆那一章真正的建议不是去当烈士,是把思想和言说分开:心里保持自由,嘴上谨慎,只打值得打的仗。

披露聪明就聪明在这儿:它不要求任何人去裁定什么算准确,只要求公司把那只手亮出来——我调了,按谁的要求调的,调的是哪一类内容。判断权留给用户。

为什么值得看:从外面看,被调过的回答和没调过的长得一模一样,你没办法验证。能改变这件事的只有一条路:让公司自己说出来。标签就是为这个存在的。

4分量

一份还没生效的文件,为什么现在就值得你花十分钟

这份文件现在还管不着谁。

这是拟议政策声明。它仍在征求意见,7 月 31 日截止;它也不是规则,政策声明只表明一个执法机构打算怎么解释既有法条。真到执法,还得一案一案地打。把它读成「AI 改答案从此违法」,就读错了。

可它把一件模糊的事写成了能讨论的形状。以前你觉得模型答得不对劲,只能靠感觉,连该找谁说都不知道。现在有了两个术语、一条法条,还有一套披露强度的门槛:清晰、显著、突出,且强到足以抵消营销与产品设计造成的相反印象。最狠的是「足以抵消」四个字。

「足以抵消」这四个字我读着有画面。2019 年 6 月我们整个部门被叫进会议室,会议名叫「业务转型宣讲会」,HR 放的 PPT 模板还是我两年前给部门做的那套,赔偿 N+1。字面上一句假话都没有,可那个名字把所有人的预期按在了另一个方向上。文件那句「足以抵消」,防的就是这种名字。

过去的默认

模型答得不对劲,那就是模型不行。你能做的是换一个、多问几遍,反正说不清哪儿出了岔子。

文件给的新默认

答得不对劲,也可能是有人在中间调过。你能追问的是:调了吗?按谁的要求?标签上写了吗?

核心

披露有硬门槛:它必须强到足以抵消营销与产品设计造成的相反印象。写在用户协议深处的那种,按这个标准等于没写。

这对你意味着什么

先看标签,再看答案

能做的不多。用一个模型之前,翻一下它的模型卡或系统说明,看有没有写明哪类输出被调过、按谁的要求调的。写得含糊的,心里给它减一格。这不解决准确性,只解决你有没有被蒙在鼓里。

还有 7 月 31 日那个截止日。公众意见征询对任何人开放,写一段话提交上去,成本十几分钟。这类文件最后长成什么样,取决于窗口期里谁出现过。

口径说明:本文所述为 FTC 于 2026 年 7 月 1 日发布的拟议政策声明,7 月 7 日登《联邦公报》(文号 2026-13628),公众意见征询 2026 年 7 月 31 日截止。拟议政策声明尚未生效,政策声明本身也不具法律效力,只表明执法机构对现行法条的解释立场。本文为技术科普解读,不构成法律建议。

食品包装背面那行配料表,当年也是厂商极力反对才印上去的。没人要求厂家只做健康食品,只要求把放了什么写清楚。模型这边眼下争的就是这一步:标签上到底写不写。

本文框架取材自保罗·格雷厄姆《黑客与画家》(Paul Graham, Hackers & Painters)中关于道德时尚与异端、说真话的成本的论述。政策事实来自美国联邦贸易委员会 2026 年 7 月新闻稿、《联邦公报》2026 年 7 月 7 日文号 2026-13628,以及多家律所的公开解读。本文为技术科普解读,非法律建议。

技术

AI 为了合规悄悄改答案,监管说这可能就是欺骗

2026 年 7 月 29 日 · 保罗·格雷厄姆《黑客与画家》约 7 分钟

说 AI 惹麻烦,大家想的都是它乱讲话。美国联邦贸易委员会 7 月 1 日甩出来的那份文件把箭头掉了个头:为了守住某个州的法律,把答案往稳妥里改,还一声不吭,这一头同样可能违法。

30 秒读懂
1文件

监管这回给这件事起了名字:输出导向,压制准确性

标题本身就是结论。

第 14365 号行政命令点名要 FTC 讲清一件事:开发者为了满足某个州的法律去改模型输出,《FTC 法》第 5 条管不管得着。7 月 1 日这份声明就是 FTC 交的卷子,六天后登上《联邦公报》。

里头两个词值得记住:output steering,输出导向,指有人在模型作答的路上伸了一只手,把回答推向预定方向;suppression of accuracy,压制准确性,指这一推偏离了最准确的那个答案。两个词盯的是同一只手。

文件里的术语它指的是什么
output steering(输出导向 / 输出操舵)在模型作答的路上加一只手,把回答推向预定方向
suppression of accuracy(压制准确性)这只手推的方向,偏离了最准确的那个答案
Section 5(《FTC 法》第 5 条)禁止不公平或欺骗性的商业行为,本次执法主张的依据
2机制

你按标签买的是准确,到手的是被调过的准确

FTC 的推理链条其实很短。

起点是一条关于用户的假设:打开一个号称能回答问题的系统,人默认它奔着真实与准确去。这个默认是产品宣传和界面一路暗示出来的,不是用户自己长出来的。公司在营销里说准确、说客观、说听你的,用户就照这句话掏钱。

接着系统在后台被调了。理由可能相当正当:某个州的法律要求某类内容必须那样处理。你别看后台动了刀,用户这边什么都没变,标签还写着准确。FTC 说,这道落差正是第 5 条要看的东西:宣传造出一个预期,实际做法背离它,中间隔着一层用户不知道的改动。

FTC 没说改输出本身违法,它盯的是改了不说,还继续按原来的说法卖。被点名的现实案例在科罗拉多:该州修订后的 AI 法,被认为可能激励企业在不披露的情况下动输出。

我 2007 年入行第一个活,是给政务大厅做排队叫号系统。验收当天喇叭把「请 A052 号到 3 号窗口」念成连读,全厅哄笑;需求方最后一条验收意见写的是「声音要像人」,我回去改了三天 TTS 停顿。大厅里排队的人只听见喇叭里那一句,不知道有谁提过什么要求。改是别人要的,用户只收到成品。

答案被悄悄调过,标签就不再是真的一句提问的路径 / THE PATH OF ONE ANSWER调过之后的两条路 / TWO ROUTES你的一句提问问它一件事实模型算出答案按权重给出结果输出被调过静默改写答案到你手上标签仍写着准确州法要求 → 静默改写调校从哪来州法的合规要求未披露的其他目标不披露宣传仍说准确客观披露清晰、显著、突出与预期错位可能构成第 5 条的欺骗预期被重塑披露是写明的出路回答的路径合规压力
来源:美国联邦贸易委员会 2026 年 7 月 1 日发布的拟议政策声明《关于人工智能系统中压制准确性的政策声明》,7 月 7 日登《联邦公报》(文号 2026-13628),公众意见征询 2026 年 7 月 31 日截止。解读:改动本身不算违法点,违法点在于未披露的改动配上仍宣称准确的产品,第 5 条把这种落差看作欺骗。拟议政策声明尚未生效,也不等于法律。框架:保罗·格雷厄姆《黑客与画家》。
打个比方

药店门口贴着一句「照方抓药,一粒不差」。后来当地出了新规,某味药必须减量,店里照办,标签一个字没改,柜台上的话术还是那句一粒不差。减量本身合规,麻烦出在你端着药盒回家,仍以为拿到的是方子上写的东西。

3难题

谁有权说哪个答案算准确,这才是没人愿意先答的题

披露解决知情,解决不了标准。

FTC 的立场很干脆:用户默认预期的目标就是真实与准确。这话听着没法反驳,往下走一步就麻烦了。谁来判定哪个回答更准确?碰上有争议的题目,最准确的回答常常不止一个,挑哪个本身就带着立场。

保罗·格雷厄姆在《黑客与画家》里有一章叫《不能说的话》。他的观察是,每个时代都揣着一批看似不言自明、其实荒谬的观念,身处其中的人看不见它,因为流行就是自己看不见自己的样子。他给的辨认办法之一是拿另一个时代或另一个社会当对照:同一句话,换个地方就从常识变成异端。

模型的输出被调,依据是此刻的合规要求与主流共识。十年后回头看,这批依据里大概率有几条会显得可笑。所以格雷厄姆那一章真正的建议不是去当烈士,是把思想和言说分开:心里保持自由,嘴上谨慎,只打值得打的仗。

披露聪明就聪明在这儿:它不要求任何人去裁定什么算准确,只要求公司把那只手亮出来——我调了,按谁的要求调的,调的是哪一类内容。判断权留给用户。

为什么值得看:从外面看,被调过的回答和没调过的长得一模一样,你没办法验证。能改变这件事的只有一条路:让公司自己说出来。标签就是为这个存在的。

4分量

一份还没生效的文件,为什么现在就值得你花十分钟

这份文件现在还管不着谁。

这是拟议政策声明。它仍在征求意见,7 月 31 日截止;它也不是规则,政策声明只表明一个执法机构打算怎么解释既有法条。真到执法,还得一案一案地打。把它读成「AI 改答案从此违法」,就读错了。

可它把一件模糊的事写成了能讨论的形状。以前你觉得模型答得不对劲,只能靠感觉,连该找谁说都不知道。现在有了两个术语、一条法条,还有一套披露强度的门槛:清晰、显著、突出,且强到足以抵消营销与产品设计造成的相反印象。最狠的是「足以抵消」四个字。

「足以抵消」这四个字我读着有画面。2019 年 6 月我们整个部门被叫进会议室,会议名叫「业务转型宣讲会」,HR 放的 PPT 模板还是我两年前给部门做的那套,赔偿 N+1。字面上一句假话都没有,可那个名字把所有人的预期按在了另一个方向上。文件那句「足以抵消」,防的就是这种名字。

过去的默认

模型答得不对劲,那就是模型不行。你能做的是换一个、多问几遍,反正说不清哪儿出了岔子。

文件给的新默认

答得不对劲,也可能是有人在中间调过。你能追问的是:调了吗?按谁的要求?标签上写了吗?

核心

披露有硬门槛:它必须强到足以抵消营销与产品设计造成的相反印象。写在用户协议深处的那种,按这个标准等于没写。

这对你意味着什么

先看标签,再看答案

能做的不多。用一个模型之前,翻一下它的模型卡或系统说明,看有没有写明哪类输出被调过、按谁的要求调的。写得含糊的,心里给它减一格。这不解决准确性,只解决你有没有被蒙在鼓里。

还有 7 月 31 日那个截止日。公众意见征询对任何人开放,写一段话提交上去,成本十几分钟。这类文件最后长成什么样,取决于窗口期里谁出现过。

口径说明:本文所述为 FTC 于 2026 年 7 月 1 日发布的拟议政策声明,7 月 7 日登《联邦公报》(文号 2026-13628),公众意见征询 2026 年 7 月 31 日截止。拟议政策声明尚未生效,政策声明本身也不具法律效力,只表明执法机构对现行法条的解释立场。本文为技术科普解读,不构成法律建议。

食品包装背面那行配料表,当年也是厂商极力反对才印上去的。没人要求厂家只做健康食品,只要求把放了什么写清楚。模型这边眼下争的就是这一步:标签上到底写不写。

本文框架取材自保罗·格雷厄姆《黑客与画家》(Paul Graham, Hackers & Painters)中关于道德时尚与异端、说真话的成本的论述。政策事实来自美国联邦贸易委员会 2026 年 7 月新闻稿、《联邦公报》2026 年 7 月 7 日文号 2026-13628,以及多家律所的公开解读。本文为技术科普解读,非法律建议。

テクノロジー

AI 为了合规悄悄改答案,监管说这可能就是欺骗

2026 年 7 月 29 日 · 保罗·格雷厄姆《黑客与画家》約 7 分

说 AI 惹麻烦,大家想的都是它乱讲话。美国联邦贸易委员会 7 月 1 日甩出来的那份文件把箭头掉了个头:为了守住某个州的法律,把答案往稳妥里改,还一声不吭,这一头同样可能违法。

30 秒读懂
1文件

监管这回给这件事起了名字:输出导向,压制准确性

标题本身就是结论。

第 14365 号行政命令点名要 FTC 讲清一件事:开发者为了满足某个州的法律去改模型输出,《FTC 法》第 5 条管不管得着。7 月 1 日这份声明就是 FTC 交的卷子,六天后登上《联邦公报》。

里头两个词值得记住:output steering,输出导向,指有人在模型作答的路上伸了一只手,把回答推向预定方向;suppression of accuracy,压制准确性,指这一推偏离了最准确的那个答案。两个词盯的是同一只手。

文件里的术语它指的是什么
output steering(输出导向 / 输出操舵)在模型作答的路上加一只手,把回答推向预定方向
suppression of accuracy(压制准确性)这只手推的方向,偏离了最准确的那个答案
Section 5(《FTC 法》第 5 条)禁止不公平或欺骗性的商业行为,本次执法主张的依据
2机制

你按标签买的是准确,到手的是被调过的准确

FTC 的推理链条其实很短。

起点是一条关于用户的假设:打开一个号称能回答问题的系统,人默认它奔着真实与准确去。这个默认是产品宣传和界面一路暗示出来的,不是用户自己长出来的。公司在营销里说准确、说客观、说听你的,用户就照这句话掏钱。

接着系统在后台被调了。理由可能相当正当:某个州的法律要求某类内容必须那样处理。你别看后台动了刀,用户这边什么都没变,标签还写着准确。FTC 说,这道落差正是第 5 条要看的东西:宣传造出一个预期,实际做法背离它,中间隔着一层用户不知道的改动。

FTC 没说改输出本身违法,它盯的是改了不说,还继续按原来的说法卖。被点名的现实案例在科罗拉多:该州修订后的 AI 法,被认为可能激励企业在不披露的情况下动输出。

我 2007 年入行第一个活,是给政务大厅做排队叫号系统。验收当天喇叭把「请 A052 号到 3 号窗口」念成连读,全厅哄笑;需求方最后一条验收意见写的是「声音要像人」,我回去改了三天 TTS 停顿。大厅里排队的人只听见喇叭里那一句,不知道有谁提过什么要求。改是别人要的,用户只收到成品。

答えが黙って調整されると、ラベルは真実でなくなる答えが届くまで / THE PATH OF ONE ANSWER調整のあとの二つの道 / TWO ROUTESあなたの問い事実を一つ尋ねるモデルが答える重みどおりに生成出力が調整される黙って書き換え答えが手元に届くラベルは正確のまま州法が書き換えを促す調整はどこから州法への適合要求未開示の別の目的開示しない宣伝は正確と言い続ける開示する明確・目立つ・際立つ期待とのずれ第 5 条の欺瞞になり得る期待が作り直される開示が示された道回答の経路適合の圧力
出典:米連邦取引委員会(FTC)が 2026 年 7 月 1 日に公表した政策声明案「AI システムにおける正確性の抑制について」。2026 年 7 月 7 日に連邦官報へ掲載(文書番号 2026-13628)、意見公募は 2026 年 7 月 31 日締切。読み方:書き換えそのものが違法なのではなく、未開示の書き換えを「正確」と謳ったまま提供する落差を第 5 条は欺瞞として扱う。政策声明案はまだ発効しておらず、法律そのものでもない。枠組:ポール・グレアム『ハッカーと画家』。
打个比方

药店门口贴着一句「照方抓药,一粒不差」。后来当地出了新规,某味药必须减量,店里照办,标签一个字没改,柜台上的话术还是那句一粒不差。减量本身合规,麻烦出在你端着药盒回家,仍以为拿到的是方子上写的东西。

3难题

谁有权说哪个答案算准确,这才是没人愿意先答的题

披露解决知情,解决不了标准。

FTC 的立场很干脆:用户默认预期的目标就是真实与准确。这话听着没法反驳,往下走一步就麻烦了。谁来判定哪个回答更准确?碰上有争议的题目,最准确的回答常常不止一个,挑哪个本身就带着立场。

保罗·格雷厄姆在《黑客与画家》里有一章叫《不能说的话》。他的观察是,每个时代都揣着一批看似不言自明、其实荒谬的观念,身处其中的人看不见它,因为流行就是自己看不见自己的样子。他给的辨认办法之一是拿另一个时代或另一个社会当对照:同一句话,换个地方就从常识变成异端。

模型的输出被调,依据是此刻的合规要求与主流共识。十年后回头看,这批依据里大概率有几条会显得可笑。所以格雷厄姆那一章真正的建议不是去当烈士,是把思想和言说分开:心里保持自由,嘴上谨慎,只打值得打的仗。

披露聪明就聪明在这儿:它不要求任何人去裁定什么算准确,只要求公司把那只手亮出来——我调了,按谁的要求调的,调的是哪一类内容。判断权留给用户。

为什么值得看:从外面看,被调过的回答和没调过的长得一模一样,你没办法验证。能改变这件事的只有一条路:让公司自己说出来。标签就是为这个存在的。

4分量

一份还没生效的文件,为什么现在就值得你花十分钟

这份文件现在还管不着谁。

这是拟议政策声明。它仍在征求意见,7 月 31 日截止;它也不是规则,政策声明只表明一个执法机构打算怎么解释既有法条。真到执法,还得一案一案地打。把它读成「AI 改答案从此违法」,就读错了。

可它把一件模糊的事写成了能讨论的形状。以前你觉得模型答得不对劲,只能靠感觉,连该找谁说都不知道。现在有了两个术语、一条法条,还有一套披露强度的门槛:清晰、显著、突出,且强到足以抵消营销与产品设计造成的相反印象。最狠的是「足以抵消」四个字。

「足以抵消」这四个字我读着有画面。2019 年 6 月我们整个部门被叫进会议室,会议名叫「业务转型宣讲会」,HR 放的 PPT 模板还是我两年前给部门做的那套,赔偿 N+1。字面上一句假话都没有,可那个名字把所有人的预期按在了另一个方向上。文件那句「足以抵消」,防的就是这种名字。

过去的默认

模型答得不对劲,那就是模型不行。你能做的是换一个、多问几遍,反正说不清哪儿出了岔子。

文件给的新默认

答得不对劲,也可能是有人在中间调过。你能追问的是:调了吗?按谁的要求?标签上写了吗?

核心

披露有硬门槛:它必须强到足以抵消营销与产品设计造成的相反印象。写在用户协议深处的那种,按这个标准等于没写。

这对你意味着什么

先看标签,再看答案

能做的不多。用一个模型之前,翻一下它的模型卡或系统说明,看有没有写明哪类输出被调过、按谁的要求调的。写得含糊的,心里给它减一格。这不解决准确性,只解决你有没有被蒙在鼓里。

还有 7 月 31 日那个截止日。公众意见征询对任何人开放,写一段话提交上去,成本十几分钟。这类文件最后长成什么样,取决于窗口期里谁出现过。

口径说明:本文所述为 FTC 于 2026 年 7 月 1 日发布的拟议政策声明,7 月 7 日登《联邦公报》(文号 2026-13628),公众意见征询 2026 年 7 月 31 日截止。拟议政策声明尚未生效,政策声明本身也不具法律效力,只表明执法机构对现行法条的解释立场。本文为技术科普解读,不构成法律建议。

食品包装背面那行配料表,当年也是厂商极力反对才印上去的。没人要求厂家只做健康食品,只要求把放了什么写清楚。模型这边眼下争的就是这一步:标签上到底写不写。

本文框架取材自保罗·格雷厄姆《黑客与画家》(Paul Graham, Hackers & Painters)中关于道德时尚与异端、说真话的成本的论述。政策事实来自美国联邦贸易委员会 2026 年 7 月新闻稿、《联邦公报》2026 年 7 月 7 日文号 2026-13628,以及多家律所的公开解读。本文为技术科普解读,非法律建议。