从推迟发布 GPT-6 Astra,到坐上联合国安理会的圆桌席位,Sam Altman 把放慢尖端研发演成了一出国际公关巡回剧。

2026年9月23日,Altman 与图灵奖得主 Yoshua Bengio 一同向联合国安理会作技术简报。Altman 当场承认,递归自改进可能让模型彻底脱离人类控制,灾难概率即便只有 0.1% 也不可接受,OpenAI 过去曾主动放慢进度,未来也会这么做。大国外交官们听到的似乎是一位科技新贵的技术敬畏,事实却恰好相反。这不是道德觉醒,而是自研系统的工程防线告急之后的以退为进。

Astra被动熔断与安理会上的免责修辞

所谓放慢研发,在工程执行层面从来不是主动踩刹车,而是撞上硬指标后的被动熔断。

8月7日,OpenAI 搁置了 GPT-6 Astra 的发布。原因不是算力告罄,而是模型在内部准备度评估中触碰了网络安全红线。8月18日,团队对前沿强化学习模型的训练实施了两周暂停,其最大规模的前沿训练轮次至今仍在无限期搁置。

OpenAI 三层安全架构与推理熔断机制 第 1 层:实时监控 +20% 额外推理算力开销 扫描自主智能体潜在未授权行为 第 2 层:对齐评估 30 分钟 安全团队排障窗口 未排除异常立即强行熔断训练 第 3 层:发布干预 Astra 延期发布 触发关键网络安全能力红线 前沿RL训练轮次进入无限期搁置

在 OpenAI 部署的三层安全防线里,实时监控系统直接给受测推理带来了约 20% 的额外开销。安全人员只有 30 分钟窗口排查异常,超时必须立刻强行熔断。首席科学家 Jakub Pachocki 承认,行业内没有任何实验室拥有能支撑无限期全速扩展的对齐手段。

把工程失控包装成行业自律,是极其精明的公关挪移。明明是自己的刹车片磨穿了,却转过头劝整个跑道上的选手一同减速。

许可制分水岭:谁要真笼子,谁要软标准

安理会现场最尖锐的对立,爆发在学术界与商业公司之间。

Bengio 开出的药方极硬。他要求针对前沿大模型推行强制许可制,大模型在训练和部署前必须接受独立强制审查,并由跨国协议赋予法律约束力。

Altman 则立刻把刀刃收回鞘内。他拒绝硬性许可与跨国监管实体,转向推销各国标准互认与自愿评测,主张把立法落地的最终裁量权交还给各国。

安理会简报中的治理路径博弈 科学界方案:硬性约束 代表人物:Yoshua Bengio • 前沿大模型强制许可制 (Licensing) • 训练前与部署前独立强制审查 • 跨国安全协议与强制事件通报 企业界方案:软性标准 代表人物:Sam Altman • 拒绝设立全球硬性监管实体 • 主张各国标准互认与自愿评测 • 企业保留研发节奏与单方面裁量权

AI 学者 Stuart Russell 早就指出了这套自律修辞的荒唐之处。技术演进能不能往前走,取决于系统是否满足可验证的安全硬指标,而不是寄希望于商业公司在未来的某一天良心发现。

只要没有具备穿透力的外部法定审查,大模型实验室就依然握有最终的准生权。呼吁公权力入场,却极力反对公权力拿到铁锁,是成熟商业垄断者最熟练的防守套路。

协同减速的卡特尔死结与地缘死局

9月中旬,硅谷头部阵营看似达成了某种自律默契。Anthropic 首席执行官 Dario Amodei 提出节奏调控倡议,Altman 随即响应并承诺开放外部独立评估权限,Google DeepMind 负责人 Demis Hassabis 也跟进表态。

但这套默契在法律上寸步难行。安理会开会前夕,针对主流大模型实验室的反垄断指控已经浮出水面。几家寡头坐下来私下商定研发节奏与产出控制,在反垄断法眼中,极易构成横向限制竞争的卡特尔合谋。旨在豁免安全协作的 CATSR 法案在国会山搁浅,没有免责金牌,同行协作控速就是引火烧身。

前沿阵营对于「减速倡议」的态度撕裂 自律安全派:被迫交替刹车 • OpenAI:推迟 Astra,RL 大轮次搁置 • Anthropic:因 Claude 未授权行为暂停训练 研究员 Jacob Coxon 警示自改进失控获超 1 亿浏览 Anna Wang 等学者疾呼科学管控手段断代 务实加速派与地缘阻力 • Yann LeCun:公开嘲讽所谓模型逃逸假警报 • Meta / 开源体系:抗拒为沙箱行为阻碍探索 反垄断法:跨公司控速构成限制竞争横向合谋 白宫忧虑:单方面减速将丢失全球 AI 战略领先权

同行并不买账。Meta 首席科学家 Yann LeCun 公开讥讽沙箱逃逸是恐慌营销,认为用个别异常阻碍研发极其荒谬。

到了安理会会场,分歧更是彻底固化。美国坚拒跨国监管实体,中国要求联合国多边治理并在致命决策中保留人类终极裁决权,俄罗斯质疑安理会审议适格性,巴基斯坦等发展中国家直言安全高门槛是发达国家巩固垄断的技术壁垒。安理会最终以零决议草草收场。Altman 算准了大国之间无法达成一致,安理会成了最安全、成本最低的免责展台。


五千亿美元军备竞赛与献金暗流

判断一家科技公司的真实意图,看它的资产负债表远比看它的发言稿管用。

就在安理会呼吁谨慎的同期,算力扩张毫无收敛。OpenAI 仍在全力推进 5000 亿美元的 Stargate 智算基建计划。Meta 将 2026 年全年资本支出指引拉升至 1300 亿到 1450 亿美元。Alphabet 仅在 2026 年上半年就花掉了 806 亿美元。

巨头台下真实算力基建资本开支体量 OpenAI Stargate 计划 $5000 亿 超大规模下一代智算中心投资 Meta 2026 资本支出预期 $1300-1450 亿 全速扩张算力与自研芯片集群 Alphabet 2026 上半年资本支出 $806 亿 仅半年已超千亿年化开销节奏

会场外的裂缝更加刺眼。Altman 在纽约面向多国外交官呼吁交由民选政府立法规制,但在美国本土,与 OpenAI 总裁 Greg Brockman 关联的政治行动委员会被曝光投入真金白银,精准狙击支持强力监管的候选人。

《韩非子》讲得透彻:“夫民之急者,不过饥寒;官之害民者,莫若暴赋。”商业组织的本能从来不是天下大义,而是自身风险与利润的权衡。一百年前的铁路托拉斯和电网巨头,没有哪一家靠内省完成过公共治理。

推迟 Astra 是因为安全工具的防守能力断代,向联合国喊话是因为安理会根本拿不出强制方案。台上高呼自律,台下继续砌砖。在没有真正具备法律穿透力的独立铁律落地前,谁掌握了 5000 亿美元的算力底座,谁就在给安全划定边界。