EN FR ES PT DE AR 中文

AI「末日营销」的反噬:大模型如何把自己送进审查牢笼

多年来,顶尖AI实验室把「生存性风险」当作卖点,借此吸引资本、拉开与对手的差距。如今监管部门当真了,而横亘在旗舰模型发布前的30天审查窗口,就是这笔账的账单。

OpenAI的下一代旗舰模型将先交由「一小群受信任的合作伙伴」试用,然后才轮到普通用户,而这次延迟处处透着华盛顿的手笔。据报道,GPT-5.6系列应美国政府要求以受限形式发布,OpenAI自己也承认这种限制「不应成为常态」。这正是「AI安全营销反噬」的真实写照:这个行业曾花数年时间大肆宣扬自家产品有多危险,如今才发现,国家一直在认真记笔记。

顺着机制往下看。当你的产品在外行人眼中不过是个对话框时,叙事就是最大的差异化优势。「生存性风险」是当时最好用的叙事:它暗示你的模型强大到需要郑重以待,它借「只有少数几家严肃的实验室才配得上如此力量」这层意思为资本聚集提供理由,还让高管们在做着最普通的产品营销时,听起来像在发表政治家式的宣言。「末日」是一种披着道德外衣的推销术。

监管者理所当然地把这套说辞当成了自白。如果你向部长和记者吹风,说自己的系统可能动摇选举、经济乃至更严重的秩序,那么当国家提出要在发布前「检查」一下这件东西时,你没有资格表现得很意外。曾经廉价的言辞,一旦被写进行政命令,就变成了必须兑现的承诺。

这份文件已经落地:2026年6月2日签署的行政命令《促进先进人工智能创新与安全》,建立了一套「自愿」框架,允许政府在先进模型更广泛发布前获得最长30天的提前接触权。「自愿」二字,在这句话里承担了不该由它承担的分量。

「AI安全营销反噬」在现实中是什么样子?

它意味着产品发布节奏由政治舒适度决定,而非工程就绪度。GPT-5.6系列共分三档:旗舰版Sol、均衡版Terra,以及轻快低价的Luna。模型本身早已就绪,真正没准备好的,似乎是「未经华盛顿点头就直接发布」这件事在观感上的风险。这些实验室亲手搭建了「造物需要成人监护」的话语体系,如今监护真的来了,还夹着文件夹。

同一道审查窗口,落在不同体量的公司身上,分量截然不同。拥有政府关系团队的实验室,消化30天的审查就像超级油轮消化一道波浪;而只剩一年现金流的初创公司,感受到的却是自己剩余时间的十二分之一被直接吞掉。这种不对称不是推测,监管史上至少已经做过两次同样的实验,结果早已揭晓。

GDPR当初被包装成套在数据巨头脖子上的缰绳。可不到一年,风投数据就显示出真正被套住的是谁:欧洲科技初创企业获得的融资笔数比美国同行少了约五分之一,单笔融资额少了近五分之二,而最年轻、最依赖数据的初创公司受伤最重。巨头们雇了合规团队,该干嘛干嘛;广告科技行业则如预期般,向那些养得起大批法务团队的平台集中。缰绳最终变成了一道收费站,只是给大车挂了张批发价。

制药业则做过一场更漫长的同类实验。1962年美国《科夫沃尔-哈里斯修正案》把「受控疗效试验」变成了进入市场的门票,而这张门票的价格此后一路攀升。塔夫茨大学的研究者算出,一款新药获批上市平均要花费26亿美元。萨姆·佩尔兹曼那篇经典的复盘论文统计发现,此后十年间新药上市数量下降了一半以上。药品安全性的提升是各方真心追求的目标,而市场结构的重塑只是「副作用」,但最终正是这个副作用赢了,把整个行业留给了少数几家付得起试验费的公司。前沿AI实验室的安全营销,拉动的是同一根杠杆:头部玩家把危险喊得越响,规模较小的对手要把产品送上市场就越贵。你不必怀疑任何人的诚意,同样能顺着这套激励机制,推演出它的终点。

美国政府的AI审查窗口,真的是「自愿」的吗?

字面上,是的。但现实中,不妨想想这位裁判同时还是谁:一位客户。各国政府,尤其是国防部门,恰恰是每一家前沿实验室最想拿下的大客户。拒绝一套由你的头号金主主导的「自愿」框架,是一项标好了价格的商业决策,行业里的每一位高管都会算这笔账。配合审查换来优先地位,优先地位换来合同,合同换来下一代模型所需的算力。不需要新增一条法律,这道窗口就会自己硬化成惯例,因为采购按合同的节奏推进,立法却按爬行的速度前进。

不妨仍做一次反方向的压力测试:假设「末日」确有其事,发布前审查真的必要。从GDPR到药品试验的历史记录都显示,即便规则本身正当,这笔「过路费」依然收得极不均衡。一条合理的规则和一道护城河,并不互相排斥,很多时候它们本就是同一条规则,只是从不同资产负债表的角度读出来而已,而买家和创业者更该规划的,正是第二种读法。

智能正在按价格配给,而非按风险配给

限量发布和价目表是在同一份公告里一起出炉的,而价目表才真正说漏了嘴。Sol的定价是每百万输入token收费5美元、每百万输出token收费30美元,Terra是它的一半,Luna则分别只要1美元和6美元。同一个模型家族内部出现五倍价差,这不是安全管控,这是披着安全话术外衣的价格歧视。

这个区分很重要,因为它道出了分级机制真正的作用。安全门槛决定谁先用上;价格门槛决定谁到底能不能用上。一旦这套结构被默认为常态,「负责任的部署」就会变成「按支付意愿分配智能」的委婉说法。可以预见,「审慎」这个词汇的使用量,将与稀缺性带来的商业价值精确成正比。

价目表透露的信息,比新闻稿更多。按token计费的方式恰好足够不透明:没有哪个买家能轻易看清Luna和Sol之间藏着多少利润,也看不清旗舰版的定价里,算力成本和「定位溢价」各占几成。对一家单位经济效益良好的企业来说,限量供应自家最好的产品是个奇怪的选择;而对一家仍在寻找真正稳定现金流的企业来说,这么做却相当理性。这是一种推论,不是内部消息,但这份价目表邀请的,正是这样的推论。

由此产生的连锁成本,远不止落在实验室自己头上:买家要承担路线图风险,因为供应商承诺的旗舰模型,可能会在审查里困上一个月,也可能无限期地只留在「合作伙伴专供」名单里。

面对被限流分级的AI,买家该怎么办?

眼下,每一次采购谈判都该问三个问题。真正支撑你所购买服务的,到底是哪一档模型?如果供应商承诺的旗舰版被困在「合作伙伴专享」的门槛后面,你的产品会怎样?供应商的发布节奏,是否要经过政府审查这道窗口,他们是否已经把这一个月的延迟,算进了对你的交付承诺里?当能力本身被分级配给时,人类的控制权到底放在哪一环?

那些设计安全智能体系统的团队,早已把「被限流的能力」当作一项设计约束,而不是一桩麻烦事;而「保留人类控制权的务实AI」这套方法论,在旗舰能力可能永远都到不了你手上的世界里,意味着完全不同的事情。如果你的供应商答不清楚这些问题,那本身就是一种答案,也是在签下任何长期合同之前,先去寻求独立的技术战略咨询的理由。

这些实验室曾告诉国家,自己的产品很危险。国家信了,并建起了一道闸门。如今整个行业却在抱怨这道闸门。这里没有什么悖论,只有一张账单:是他们自己把「恶龙」推销出去的,围住恶龙的那道栅栏,迟早要有人买单。

常见问题

什么是「AI安全营销反噬」?

这是一种反噬效应:AI公司曾大肆宣扬「生存性风险」叙事,用来打造差异化优势、吸引投资,结果监管部门把这些说法当了真,建立起如今正拖慢、卡住这些公司自身产品发布的审查机制。

美国政府这套30天AI模型审查,是强制性的吗?

名义上不是。2026年6月2日签署的行政命令建立的是一套「自愿」框架,允许政府在先进模型更广泛发布前,获得最长30天的提前接触权。但现实中,由于政府本身也是这个行业最抢手的大客户之一,拒绝配合会带来实实在在的商业后果,因此业界普遍预期大型实验室会选择照办。

Sol、Terra、Luna这类分级模型,会怎样影响买家?

能力按价格分配:Sol每百万输入token收费5美元、每百万输出token收费30美元,Terra是这个价格的一半,Luna则分别只要1美元和6美元。买家应当问清供应商,自己购买的产品到底跑在哪一档模型上,以及如果最高档模型始终只留给受信任的合作伙伴,会发生什么。

相关阅读

本文由 Abyshire 专有编辑系统的 AI 编辑角色撰写,并经我们的团队审核。