AGI Daily
广告
AGI Daily跟踪世界 AGI 进展AGI INTELLIGENCE · DAILY
全部算力算法数据人物日报主题
AGI Daily
全部算力算法数据人物日报主题
广告

白宫自愿 AI 标准框架最后倒计时:8 月 1 日前 NSA 须交付涉密基准测试

2026-07-02 / 2026年7月2日 · 共 3,784 字

The White House

如果一切按计划推进,本周之内白宫将公布一份定义美国前沿 AI 模型如何发布的框架文件。对于大多数观察者而言,这看起来像又一份政策声明。但放在 Fable 5 被政府出口管制强制下线 19 天、GPT-5.6 至今仍被限制在约 20 家政府审查过的合作伙伴手中之后,这份"自愿"框架的实际意义已经和它的字面意思不再相同。

特朗普 6 月 2 日签署的第 14409 号行政令设定了 60 天的执行期限。8 月 1 日这个截止日期背后是三件必须完成的事:NSA 交付一套涉密基准测试流程来判定哪些模型构成"受控前沿模型";多机构联合设计一个自愿预审框架;人事管理局扩大 US Tech Force 网络安全人才招聘。而据 Financial Times 7 月 2 日报道,白宫与 AI 公司的谈判已进入后期,框架公布"可能最快本周"——这意味着距离框架落地可能只剩几天。

这不是又一个政策故事。它是美国 AI 行业从"自我监管"到"政府嵌入"的结构性转折点。

行政令到底要求了什么

第 14409 号行政令的核心在第三条(Secure Frontier Model Deployment)。它要求财政部长、战争部长(通过 NSA 局长)、国土安全部长(通过 CISA 局长),在 60 天内完成两件事:

第一,NSA 主导建立并维护一套涉密基准测试流程,用于评估 AI 模型的高级网络能力,并确定一个模型何时应当被认定为"受控前沿模型"(covered frontier model)。认定权在 NSA 局长手中。关键细节:这个基准测试流程是涉密的——前沿实验室在进入自愿框架之前,不可能知道精确的判定标准。

第二,设计一套自愿框架,允许 AI 开发者:(1)向联邦政府提交模型以判断是否属于受控前沿模型;(2)在向其他受信任合作伙伴发布前,给予政府最多 30 天的模型访问权;(3)与政府合作选择哪些合作伙伴可以获得早期访问权。

行政令明确声明:"本条中的任何内容不得被解释为授权建立强制性的政府许可、预审或审批要求。"——这一免责条款是白宫内部数月博弈的产物。据 WIRED 报道,最初的草案要求 90 天的预审窗口,但在 AI 公司和时任 AI 顾问 David Sacks 的反对下被特朗普搁置。最终版本将窗口缩短至 30 天,并由白宫幕僚长 Susie Wiles 和财政部长 Scott Bessent 联手推动复活。

但框架是否使用"自愿"这个词,已经无关紧要了。

Fable 5:19 天如何将"自愿"变成"必须"

2026 年 6 月 9 日,Anthropic 发布 Fable 5 和 Mythos 5。6 月 12 日下午 5 点 21 分,美国商务部以国家安全为由,对两款模型下达紧急出口管制指令,要求 Anthropic 停止向任何外国公民(包括 Anthropic 自己的外籍员工)提供访问权限。Anthropic 在数小时内将两款模型向所有用户下线。

触发条件:亚马逊研究人员发现了一个越狱方法,能绕过 Fable 5 的安全分类器,使模型识别软件漏洞并在一个案例中生成了漏洞利用代码。但 Anthropic 的后续测试表明,这个越狱没有暴露任何 Mythos 级别的独特能力——包括 Claude Haiku 4.5、Opus 4.8、GPT-5.5、Kimi K2.7 在内的所有被测试模型都能产生相同的输出。用 Anthropic 自己的话说,这属于一个"边界案例"——Fable 5 的分类器"出于充分谨慎"阻止了某个大概率无害的行为,而亚马逊的越狱恰好解锁了它。

但在缺乏共享的越狱严重性评估框架的情况下,政府的反应不是按比例匹配风险,而是直接动用紧急出口管制——让一个市值近万亿的公司的旗舰产品全球下线。6 月 26 日,商务部长 Lutnick 签发信函,部分恢复 Mythos 5 供关键基础设施防御者使用。6 月 30 日,管制完全解除。7 月 1 日,Fable 5 全球恢复上线。

19 天的教训对每一个前沿实验室来说都再清楚不过:不参加自愿框架的风险,不是没有政府预审——是紧急出口管制。

Anthropic 的四项承诺:将成为行业模板

Fable 5 恢复上线的代价是一套与政府的正式承诺,Anthropic 在 6 月 30 日的重新部署公告中详细列出了四项内容:

第一,预发布政府访问与评估。 对于在国家安全相关领域实质性推进能力前沿的模型,Anthropic 将在广泛发布前向指定政府合作伙伴提供模型及其安全防护措施的扩展早期访问权限。政府评估人员可以运行独立能力评估并测试防护栏。Anthropic 还将派驻技术员工与政府评估人员一起工作。

第二,快速威胁情报共享。 当发现重大越狱或滥用模式时,Anthropic 将迅速调查、分类并通知政府对应方,在公开发布前分享威胁情报报告,同时参与第 14409 号行政令第二节设立的跨机构 AI 网络安全漏洞信息交换所。

第三,联合研究的专用资源。 Anthropic 将组建专门团队处理与政府的共享安全优先事项,提供大量计算资源支持政府测试和研究。

第四,共同的行业标准。 Anthropic 与亚马逊、微软、谷歌及其他 Glasswing 合作伙伴共同起草了一套越狱严重性评估框架,从四个维度对越狱评分:能力增益(越狱后模型能力超出已有工具多少)、能力广度(同一越狱技术适用于多少种不同攻击任务)、武器化难度、可发现性。

Anthropic 在公告中写得直白:"政府参与 AI 发布需要一个持久、透明的流程,给予网络防御者和其他人对强大模型访问的确定性。这些规则应当被编纂为强有力的监管,并平等地适用于所有前沿模型开发者。"

这最后一句话是关键:Anthropic 不是在要求政府不要监管——它是在要求政府平等地监管所有人。这套四项承诺,将成为 8 月 1 日自愿框架下其他前沿实验室被要求采用的模板。

Google 和 OpenAI:各自的盘算

Reuters 7 月 2 日确认,Google 已参与白宫框架谈判,直接关联其即将发布的 Gemini 3.5 Pro。这款模型在 6 月 I/O 大会上跳票后预计 7 月发布,内部描述具有可能接近"受控前沿模型"阈值的高级编码和智能体能力。如果 NSA 的涉密基准测试将 Gemini 3.5 Pro 认定为受控前沿模型,Google 将面临与 Anthropic 同样的 30 天政府预审窗口——这对一家从未经历过此类审查的公司而言,是运营模式的实质性变化。

OpenAI 则已在框架中走得更远。GPT-5.6 Sol、Terra、Luna 三重奏自 6 月 26 日预览以来,仍被限制在约 20 家经过政府审查的合作组织手中。OpenAI 在预览中明确表示"不认为这种政府访问流程应该成为长期默认",但同时表示将"继续在扩大可用性之前与政府合作伙伴协调"。分析师共识将 GPT-5.6 的广泛发布放在 7 月中下旬——这恰好取决于即将公布的自愿框架如何正式验证 OpenAI 的预发布政府协调流程。

更微妙的动态在于:白宫幕后的三个月博弈中,原草案的 90 天预审窗口被砍到 30 天。30 天对于 Anthropic 或 OpenAI 来说是可以管理的时间成本,但对于试图快速迭代的小型实验室而言已经意味着发布节奏的根本变化。

涉密基准测试与开源模型的灰色地带

8 月 1 日截止日期中最不透明、也最可能产生深远影响的部分,是 NSA 的涉密基准测试流程。行政令要求 NSA 开发一套"评估 AI 模型高级网络能力的分类基准测试流程"——但这个过程本身是涉密的。

后果有三层:

第一,判定标准不透明。 前沿实验室在正式进入自愿框架之前,无法得知他们的模型是否会触发"受控前沿模型"认定。这意味着不确定性将推动谨慎的实验室提前与政府接触,以避免发布后被追溯认定为受控模型——这正是"自愿"框架实现事实强制的机制之一。

第二,国际访问规则悬而未决。 FT 报道指出,框架谈判中包含了"澄清哪些外国组织可以访问受控前沿模型以及在什么条件下访问"的条款。对于中国 AI 公司而言,这意味着美国盟友框架下的国际访问规则可能构成另一层事实上的出口限制。Fable 5 禁令期间,中国的开源权重模型获得了部分替代性采用——这个市场信号不会从华盛顿的视野中消失。

第三,开源模型的不确定位置。 行政令的"自愿"框架如何适用于开源模型发布者——他们可能没有能力或意愿参与政府预审流程——仍然是一个未回答的问题。如果一个开源模型达到了 NSA 涉密基准测试中的受控前沿模型阈值,政府是否会对模型权重本身采取出口管制?Fable 5 的先例表明答案是肯定的,但法律路径和执行机制完全不同。

从自我监管到政府嵌入

第 14409 号行政令的结构本身讲述了一个比任何新闻标题都更清晰的故事:美国 AI 治理已经从行业自愿承诺的时代进入了政府制度化参与的时代。

不到一年前,前沿实验室还在签署白宫的自愿安全承诺——那些承诺没有执行机制、没有时间表、没有涉密基准测试。而今,NSA 设定了分类标准,政府拥有 30 天的预审窗口,商务部已经证明它可以在一小时内让一个旗舰模型从全球下线。

Anthropic 从一家曾起诉国防部供应链风险认定的公司,转变为积极整合进美国政府 AI 安全基础设施的公司,只用了 19 天。它在重新部署公告中的措辞——"我们将这些步骤和导致重新部署的流程视为朝着正确方向的进展"——读起来不像是被迫妥协,更像是在主动定义游戏规则。

接下来的一周——FT 报道的时间窗口——将决定这套规则的具体形态。框架能否真正降低摩擦,还是只是将已有的临时审查制度化?8 月 1 日的 NSA 涉密基准测试将回答一个更根本的问题:前沿模型发布的权力中心,是否已经从实验室的会议室转移到了 Fort Meade 的机密设施。

来源

  1. Promoting Advanced Artificial Intelligence Innovation and Security — Executive Order 14409 · The White House
  2. US in Talks With AI Companies for Voluntary Model Standards, FT Reports · Reuters / Financial Times
  3. White House Accelerates Plans for AI Model Standards · Financial Times
  4. Redeploying Claude Fable 5 · Anthropic
  5. This Is How Trump Finally Signed the AI Executive Order · WIRED
  6. US in Talks With AI Companies Over Voluntary Standards for New Models · The Next Web
  7. Trump Finds an AI Policy He Can Live With · POLITICO
  8. AI News Today July 3 2026 · Build Fast with AI

评论

登录后即可参与评论。

加载评论中…

相关文章

  • 一名女性佩戴 Apple Vision Pro 头显

    苹果裁撤 200 余岗位:收缩 Vision Pro,重组 Siri 与 AI 团队

    人物 · 2026-08-21

  • Anthropic 联合创始人兼 CEO Dario Amodei 的肖像照

    Anthropic 拟为创始人设超级投票权:IPO 公众股东将几乎没有话语权

    人物 · 2026-08-20

  • Anthropic 联合创始人兼 CEO Dario Amodei 的肖像照

    Amodei 罕见正面回应:AI 反弹是几十年的信任危机,监管未必等于集权

    人物 · 2026-08-17

  • SpaceX 于 2026 年 6 月 12 日在纳斯达克上市,Elon Musk 通过视频致辞

    SpaceX 完成收购 Cursor:600 亿美元换股,AI 编程产品接入自家 GPU 舰队

    人物 · 2026-08-16

  • Grok 网站被置于放大镜下的图片合成示意,象征其图像生成能力正受到执法与监管审视

    Grok 儿童性虐图像诉讼扩大,问责矛头转向 xAI 的举报缺口

    人物 · 2026-08-15

  • Uber、Pony.ai 与 Verne 三方合作的 Robotaxi 车辆

    Pony.ai 与 Uber 计划在欧洲部署逾 2000 台 Robotaxi,但不自建车队

    人物 · 2026-08-15

AGIDaily跟踪世界 AGI 进展© 2026 AGIDaily
关于邮件栏目主题定制投稿招聘广告SkillTermsContactRSS