AGI Daily
广告
AGI Daily跟踪世界 AGI 进展AGI INTELLIGENCE · DAILY
全部算力算法数据人物日报主题
AGI Daily
全部算力算法数据人物日报主题
广告

Google 发布 Gemini 3.8 Flash Cyber:修复优先,只对受信防御者开放

2026-09-02 / 1 天前 · 共 2,337 字

Google

9 月 2 日,Google 发布 Gemini 3.8 Flash 与 Gemini 3.8 Flash Cyber 两个模型,并同步推出 Fairwind 计划。前者是面向长程编码与自主 Agent 的通用模型;后者是网络安全变体,只通过 Fairwind 计划向政府和受信防御者开放。Google 明确表示,在 Flash Cyber 上「从第一天起就投入漏洞修复,并把它排在漏洞利用这类进攻能力之前」。这一排序,与 OpenAI 前一天披露 Astra「达到 Critical 网络安全能力阈值」时的措辞,构成一组值得对照的立场。

同一个底座,两种护栏

Gemini 3.8 Flash 与 Flash Cyber 共享同一套基础智能,区别在护栏。前者随 3.8 一起面向所有开发者发布;后者「为网络安全配备了一套更宽松的缓解措施」,因此只开放给需要更完整网络能力的受信防御者。

更值得注意的是训练路径:Google 称 3.8 Flash 的编码与推理提升,部分来自「在要求极高的网络安全领域进行严格训练」。也就是说,网络攻防——一个需要模型在长链条上反复试错、验证假设、自我修正的领域——成了喂养通用编码与 Agent 能力的训练源。3.8 Flash 在 DeepSWE v1.1(长时程软件工程)上超过多数更大的前沿模型,在 HLE-Verified 上拿到 54.9%。Google 把这套机制概括为「3.8 Flash 更努力」:在复杂任务上多走几步推理、反复调用工具,代价是在高 effort 档位可能消耗更多 token。

这是六周内第三次 Flash 迭代。相比之下,网络安全的「严格训练」是这次迭代新增的解释变量——它把一条通常被单列为「安全」的能力线,直接接进了通用推理与编码能力的提升链条里。

把「修复」排在「利用」前面

Flash Cyber 的能力本身是进攻与防御同源的。在 CyberGym 这一漏洞发现基准上,它超过前代 3.5 Flash Cyber 以及更大的前沿模型;在 Google 内部一个覆盖 20 种编程语言的基准上,成功率超过 70%。但在修复环节,Google 给出了明确的排序:在 CWE-Bench(由 Collinear 运行的第三方补丁基准)上,Flash Cyber 的 pass@1 为 47.2%,与领先前沿模型的 47.8% 几乎持平,成本却显著更低,落在 Pareto 前沿上。

负责这次发布的 Tulsee Doshi(产品管理高级总监)与 Raluca Ada Popa(Google DeepMind Gemini 安全负责人)写道:「我们聚焦于给防御者提供对攻击者占优势的专业能力,这就是我们从一开始就投入漏洞修复、并把它排在利用之前的原因。」

对照 OpenAI 前一天发布的 Path to Astra,这条「修复优先」的叙事差异更清楚。OpenAI 承认 Astra 是「我们首个定为 Critical 级别的模型」:在 ExploitBench 上拿到 100% 的漏洞利用开发分数,评估中「发现并使用了两个零日漏洞」作为利用链的一部分,并复现了从浏览器沙箱逃逸、执行主机命令,到在加固操作系统上本地提权至 root 的完整攻击链。OpenAI 的回应不是「我们不做进攻」,而是「我们延迟了部分开发与发布、强化防护,并把最先进能力通过 Daybreak Blue 交给防御性用途」。

两家都在用护栏收束能力,但措辞方向相反:Google 把「修」说成产品主线,OpenAI 则把「攻」的能力等级作为决定发布门槛的依据。

Fairwind:把准入做成产品

Fairwind 是这轮发布里最实质的新东西。它是一个「面向政府与受信伙伴的受限访问计划」,把 Gemini 3.8 Flash Cyber 与 Google 的 CodeMender 脚手架绑在一起,让防御者在自己的云环境里「以 Agent 级规模发现、验证并修复漏洞」。Google 称已有超过 650 家全球合作伙伴,包括 CrowdStrike、Palo Alto Networks、Snowflake、Wiz 等;参与方要遵守严格的运营标准——把访问限制在内部网络安全、事件响应或渗透测试团队,并启用多因素认证。

把「最强的网络 AI」做成一个需要准入的产品,意味着竞争维度在发生变化:过去的问题是「谁的模型漏洞发现能力更强」,现在叠加了「谁能先拿到、以什么条件拿到」。Google 的说法是给防御者一个「适应窗口」,在攻击者掌握新能力之前先加固系统。这与 Anthropic 同周发布 Fable 5.1/Mythos 5.1 时的做法同构:Mythos 5.1 与 Fable 5.1 是同一模型、不同护栏,Mythos 只通过 Cyber Verification Program 与 Life Sciences Verification Program 向经过审查的机构开放;Fable 5.1 则「可以用于发现软件漏洞,但不能为它们开发利用」,渗透测试、漏洞利用生成与二进制漏洞扫描仍被重定向到 Opus 系列模型。

尚未回答的问题

这些能力数字目前全部出自厂商自报,没有一个能独立复现:CyberGym 的「超过更大前沿模型」没有给出具体分数或对照名单;内部 20 语言基准的「超过 70%」没有公开任务集;CWE-Bench 的 47.2% 依赖 Collinear 的运行方式。更根本的问题是,「修复优先」目前是一个产品定位,而不是一条可验证的能力边界——一个能在 CyberGym 上自主发现漏洞的模型,其「不做进攻」的承诺只能靠护栏而非能力本身来兑现。

下一个可观察的节点很具体:Fairwind 是否会从 Google Cloud 客户与安全伙伴扩展到更广泛的开发者;Gemini 3.8 Flash Cyber 的基准数字能否被第三方复现;以及 Astra 正式发布时,OpenAI 会在 system card 里给出怎样的防护与能力边界。到那时,「修复优先」到底是护栏还是话术,才会有独立证据。

来源

  1. Introducing Gemini 3.8 Flash and 3.8 Flash Cyber · Google
  2. Proactive cyber defense for governments and enterprises (Fairwind Program) · Google
  3. Path to Astra: critical capabilities and frontier safeguards · OpenAI
  4. Claude Fable 5.1 and Mythos 5.1 · Anthropic
  5. Google, Anthropic, and OpenAI Unveil Cyber AI Models, Safeguards, and Access Programs · The Hacker News

评论

登录后即可参与评论。

加载评论中…

相关文章

  • Qwen3.8-Flash-Next 官方发布横幅,展示模型名称与终极成本效率主题

    Qwen 开源 Qwen3.8-Flash-Next:125B 主干、每 token 激活 6B,提前预览 Qwen4 架构

    算法 · 2026-08-26

  • Claude Fable 5.1 基于 NASA Magellan 雷达数据重建的金星高分辨率高程图,展示一座约 15 公里宽的火山

    Claude Fable 5.1 列表价没动,降价只落在缓存读取

    算法 · 2026-09-01

  • VisualToolBench 任务示例:一个问题、一张输入图像、模型的工具调用轨迹与 rubric 评分

    VisualToolBench:多模态模型的短板在视觉感知,不在推理

    算法 · 2026-09-01

  • Dandelion 球面 PDE benchmark 中四个数据集的模拟快照

    Dandelion:只用坐标变换、无卷积的球面神经 PDE 求解器

    算法 · 2026-08-31

  • 合成图:智能手机屏幕上显示 Cisco 标志,背景为人工智能相关符号

    Cisco 向 9 万员工铺开 MyAgent:受监督的自主执行如何在大企业中落地

    算法 · 2026-08-31

  • 腾讯混元 Hy4 preview 模型卡中的基准测试结果图表

    腾讯开源混元 Hy4:1M 上下文工程化落地,模型开始优化自身基础设施

    算法 · 2026-08-31

AGIDaily跟踪世界 AGI 进展© 2026 AGIDaily
关于邮件栏目主题定制投稿招聘广告SkillTermsContactRSS