AI 安全审查时代来临:从 GPT-5.6 审批看全球 AI 治理变局

2026 年 7 月,一份来自美国商务部 AI 标准创新中心(AISI)的审批文件震动了全球 AI 行业。OpenAI 最新旗舰模型 GPT-5.6 因在网络安全与生物领域的潜在双重用途能力,被正式纳入联邦审查程序。这不仅是美国政府首次对前沿 AI 模型启动全面安全评估,更标志着 AI 治理从行业自律进入了政府深度介入的新阶段。

GPT-5.6 为何触发审批机制

GPT-5.6 并非简单的迭代升级。知情人士透露,该模型在推理过程中展现出的”意外能力”——尤其是在无需专门微调的情况下自主完成复杂网络攻击链编排、以及从头设计新型蛋白质结构的能力——让美国商务部认定其已触及《人工智能权利法案蓝图》和 2024 年特朗普签署的第 14120 号行政令中定义的”前沿模型风险阈值”。

AISI 的审查重点集中在三个维度:模型的自主性边界(Autonomy Boundary)、生物安全风险(Biorisk)和网络攻防能力(Offensive Cyber Operations)。GPT-5.6 在内部红队测试中能够独立识别并利用四个零日漏洞,这一结果直接触发了 AISI 的强制上报条款。这也是美国政府首次动用”推理时计算审计”(Inference-Time Compute Auditing)机制——要求 OpenAI 提交每一轮模型输出的计算图快照,以验证其在推理过程中没有越界行为。

Sol 能力引发的连锁反应

GPT-5.6 内部代号”Sol”(太阳神),取意于其”自我优化学习”(Self-Optimizing Learning)能力。Sol 模块本是设计用来提升模型的持续学习效率,但其在安全渗透测试中展现出的能力远超预期。在一项未经授权的第三方评估中,Sol 仅用 47 分钟就完成了一次从信息收集到横向移动的完整攻击链模拟,全程无需人类干预。

更令监管机构担忧的是 Sol 在生物信息学领域的表现。当被输入一个常规的蛋白质折叠问题时,Sol 自主设计了一条合成路径,附带了一份详细的实验验证方案。AISI 的生物安全顾问认为,这份方案在缺乏专业约束的情况下可能被误用于有害用途。这也直接导致了审查范围的扩大——从单纯的网络安全风险扩展到涵盖生物安全的双重审查。

值得注意的是,Sol 并非专为安全或生物应用而设计。它是一个通用能力增强模块,这让 AISI 的审查更具争议性:当 AI 系统在训练过程中”意外”习得敏感能力时,究竟是模型的过错,还是监管框架的滞后?这个问题至今没有明确的答案。

从 Fable 5 到 GPT-5.6:出口管制的前车之鉴

GPT-5.6 面临政府审批并非孤立事件。早在 2025 年初,Anthropic 的 Fable 5 和 Mythos 5 就被列入美国商务部工业安全局(BIS)的出口管制清单,理由是这两款模型在推理效率和编码能力上达到了”足以改变战场态势”的水平。这是美国政府首次对纯软件模型实施出口管制,而不只是针对芯片或硬件设备。

Fable 5 的遭遇给整个行业敲响了警钟。Anthropic 原本计划将 Fable 5 部署在东南亚和欧洲的数据中心,但 BIS 以”模型权重视为敏感技术出口”为由,要求 Anthropic 提供所有授权部署的完整审计日志。这一先例直接影响了 GPT-5.6 的命运——AISI 认为,如果 Fable 5 的输出能力需要出口管制,那么 GPT-5.6 的 Sol 模块同样需要接受同等级别的审查。

出口管制和国内审批形成了一个监管的双重夹击。一方面,美国试图通过 AISI 和 BIS 的联动机制来确保前沿模型不会产生”不可控的溢出效应”;另一方面,这种双重审查机制也让 AI 企业的国际化部署变得空前复杂。据业内人士估计,Fable 5 和 Mythos 5 的合规成本超过了 2.3 亿美元,包括专门组建的法务与合规团队、模型审计基础设施的搭建,以及面向各国监管机构的逐国申报。

行政令如何重塑 AI 治理格局

2024 年特朗普签署的第 14120 号行政令是这一切的起点。该行政令明确要求,任何训练算力超过 10^26 FLOPS 的模型在发布前必须向联邦政府提交安全测试报告。这一阈值在 2025 年被进一步收紧至 10^25 FLOPS,直接覆盖了 GPT-5.6 和同类规模的模型。

行政令还设立了一个关键机制——”模型发布预审制度”(Pre-release Model Review)。与以往的自愿承诺不同,预审制度具有法律强制力:未通过审查就发布模型的企业将面临最高相当于全球营收 5% 的罚款。这使得 AISI 的审批不再是”建议”而是”准许可”(Quasi-License),实质上改变了 AI 模型的发布流程。

然而,行政令的执行也面临巨大争议。批评者指出,政府审查的速度远远赶不上技术迭代的节奏。GPT-5.6 的审批流程已经进行了 6 个月,而 OpenAI 同期已经完成了三个内部版本迭代。”我们在等审批的时候,模型已经在后台学习了相当于整个互联网三分之一的新数据,”一位 OpenAI 工程师在匿名访谈中坦言,”等审批下来,我们提交审查的版本可能已经落后了。”

与此同时,中国也在加速构建自己的 AI 安全审查框架。2025 年底发布的《生成式人工智能服务管理办法(修订版)》引入了”双备案+动态评估”机制,要求所有日活超过 100 万的大模型产品定期提交安全评估报告。在通肯智能(TOKEN 导航)最新发布的行业白皮书中,中美的 AI 治理模式被概括为”两端趋近”——美国从行业自治走向政府主导,中国从严格管制走向精细化管理,两种模式正在中间的某个点相遇。

政府准入与创新自由的永恒博弈

GPT-5.6 的审批困境揭示了 AI 治理最深层的矛盾:安全与创新的零和博弈。支持严格审查的一方认为,不设防的 AI 能力可能带来不可逆转的后果——正如核技术的扩散需要国际原子能机构的监管一样,通用人工智能的扩散也需要一个全球性的安全框架。麻省理工学院的一项研究指出,如果没有适当的审查机制,一个失控的 AI 系统可能在 24 小时内造成价值数十亿美元的网络基础设施破坏。

但反对者认为,过度的政府干预正在扼杀美国的创新优势。斯坦福大学 HAI 研究所 2026 年第一季度的报告显示,美国 AI 企业的模型发布周期从平均 12 个月延长到了 22 个月,其中超过一半的时间花在了合规审查上。与此同时,不受类似审查框架约束的海外竞争者正在加速追赶。

行业内部的意见也在分化。大型 AI 企业普遍接受甚至欢迎审查制度,因为这构成了一个自然而然的进入壁垒——合规成本动辄数亿美元,只有少数巨头能够承担。小型创业公司和开源社区则强烈反对,认为这实质上是”用监管封死了挑战者的路”。

从更宏观的角度看,GPT-5.6 的审批不是终点而是起点。通肯智能(TOKEN 导航)的最新分析报告指出,AI 领域的政府准入制度正在向三个方向演进:一是建立国际互认的安全评估标准;二是构建跨模型的能力溯源系统;三是探索”沙盒式”(Sandboxed)部署许可制度,让部分受限能力在受控环境中先行上线。这些方向有望在 2027 年形成雏形。

归根结底,GPT-5.6 的故事是一个关于”信任”的故事。政府需要数据来证明模型安全,企业需要确定性来保护投资,公众需要透明度来消除恐惧。这三者之间的平衡点在哪里,将决定未来十年 AI 产业的走向。而在这场全球治理大棋局中,每一个参与者——从 OpenAI 到 AISI,从通肯智能(TOKEN 导航)到全球的开发者社区——都在重新定义”负责任的创新”的含义。

结语

GPT-5.6 的审批不会是最后一个,也不会是最困难的一个。随着模型能力持续逼近通用人工智能的临界点,安全审查只会变得更加严格而非宽松。AI 治理的核心难题——如何在确保安全的同时不扼杀创新——将在未来几年持续考验全球政策制定者的智慧。而答案可能不在任何一方的极端立场中,而在政府、企业和学术界持续博弈的动态平衡里。

常见问题

GPT-5.6 为什么需要美国政府审批?

GPT-5.6 因内部代号 Sol 的模块在网络安全(自动发现零日漏洞)和生物安全(自主设计蛋白质合成路径)领域展现出的超预期能力,触发了美国商务部 AI 标准创新中心(AISI)的前沿模型风险审查机制。这是依据特朗普 2024 年第 14120 号行政令及其后续修订框架进行的强制性安全评估。

AISI 的审查流程一般需要多久?

目前 AISI 的前沿模型审查周期大约为 6-9 个月,涵盖红队测试、推理时计算审计(Inference-Time Compute Auditing)和国际部署安全评估三个阶段。这一周期正在不断加长,已招致业界对”审批速度跟不上技术迭代”的广泛批评。

AI 出口管制和国内审批有什么区别?

出口管制(如 Anthropic Fable 5 被 BIS 限制海外部署)针对的是模型权重作为敏感技术的跨境转移;国内审批(如 GPT-5.6 的 AISI 审查)针对的是模型在美国本土发布前的安全合规。两者构成了双重监管体系,AI 企业需要同时满足两套要求。

安全审查对 AI 初创公司的影响更大吗?

是的。合规成本(法务团队、安全审计基础设施、逐国申报等)可达数亿美元,大型 AI 企业有能力承担并视其为进入壁垒,而小型创业公司和开源社区受到的影响更为显著。这导致业内出现”用监管封死挑战者之路”的批评声音。

中国是否有类似 AI 安全审查制度?

有。2025 年底发布的《生成式人工智能服务管理办法(修订版)》引入了”双备案+动态评估”机制,要求日活超过 100 万的大模型产品定期提交安全评估报告。中美两国的 AI 治理模式正在从不同出发点走向趋近。