AGI Daily
广告
AGI Daily跟踪世界 AGI 进展AGI INTELLIGENCE · DAILY
全部算力算法数据人物日报主题
AGI Daily
全部算力算法数据人物日报主题
广告

Fable 5 禁令第 10 天:GPT-5.6 虎视眈眈,100+ 网络安全领袖联名要求美政府撤销禁令

2026年6月22日 · 2026-06-22

Sensor Tower / TechCrunch

今日头条

Fable 5 禁令进入第 10 天:白宫要求「零越狱」,安全界集体反对;GPT-5.6 虎视眈眈

6 月 21 日,Anthropic 旗舰模型 Claude Fable 5 与 Mythos 5 因美国商务部出口管制令被全球关停进入第 10 天。截至发稿,API 仍返回错误,退款窗口已于 6 月 20 日截止。Polymarket 上「7 月 2 日前恢复」的预测合约交易量已超 $110 万,市场定价恢复概率高于五成但远非确定。

核心僵局:白宫要求 Anthropic 在恢复模型前「主动测试所有前沿模型,识别并消除所有潜在越狱漏洞」,WIRED 和《华盛顿邮报》均已确认。安全研究界几乎一致认为:在当前技术水平下,任何前沿 AI 模型都无法实现「零越狱」。AI 安全本质上是纵深防御问题,不是二元的有/无漏洞问题。

与此同时,超过 100 名网络安全领袖、研究人员和高管联署公开信,要求美国政府撤销禁令。信中称触发禁令的漏洞是一个仅针对 Mythos 5 网络安全能力的窄域利用,并非 Fable 5 安全系统的全面突破。Anthropic 在技术反驳中指出,同样的越狱模式适用于 GPT-5.5 及其他公开可用的模型,但这些模型未受类似限制。

《经济学人》6 月 20 日以「America's AI Power Grab」为封面,将禁令定性为地缘政治权力争夺而非单纯的安全响应——美国正在建立先例,将前沿 AI 模型视同武器系统,适用相同的出口管制架构。

而这一切的受益者正在浮现:GPT-5.6 已悄然上线 ChatGPT Pro,多位开发者报告响应速度和能力显著提升;中国开源模型 GLM-5.2 在 FrontierSWE 基准上超越 GPT-5.5,与 Fable 5 仅差一分。美国政府的出口管制令,本意是保护美国 AI 优势,却可能加速了中国开源模型的全球开发者采用。

来源:Build Fast with AI / Unrot / The Economist
https://www.buildfastwithai.com/blogs/ai-news-today-june-21-2026
https://unrot.co/blogs/ai-news-today-june-21-2026

News

GPT-5.6 已上线 ChatGPT Pro,OpenAI 瞄准 6 月底正式发布

多位开发者和测试者在 X 和 Reddit 上报告,ChatGPT 的响应速度和能力明显超过 GPT-5.5 Pro,尽管 OpenAI 尚未正式确认。最引人注目的证据来自一位开发者:他用疑似 GPT-5.6 Pro 在 60 分 15 秒内构建了一个完整的浏览器游戏,而 GPT-5.5 Pro 需要约 10 分钟才开始响应。OpenAI 首席科学家此前公开预告 GPT-5.6 将为「相比 GPT-5.5 的有意义改进」,预计 6 月底正式发布。

  • 时机绝非巧合。Fable 5 和 Mythos 5 仍处于下线状态,OpenAI 面前是一个没有竞争对手的窗口期。如果 GPT-5.6 在 agentic coding 上达到早期报告所暗示的水平,OpenAI 将自 Fable 5 于 6 月 9 日发布以来首次重夺基准领先地位。

来源:Unrot
https://unrot.co/blogs/ai-news-today-june-21-2026

ChatGPT 全球市占率首次跌破 50%,AI 助手单极时代终结

据 Sensor Tower 2026 年 AI 行业报告,截至 5 月底,ChatGPT 全球 AI 助手市场份额降至 46.4%,这是自 2022 年底发布以来首次跌破 50%。Gemini 以 27.7% 位居第二,Claude 以 10.3% 排名第三。但绝对值仍强劲:ChatGPT 月活用户 11 亿,Gemini 6.62 亿,Claude 2.45 亿。Claude 在付费转化率上领先——13% 的用户转化为付费订阅,为所有主要 AI 助手中最高。

  • 这标志着 AI 助手市场从单极走向多极。当所有助手在日常任务上给出大致相当的答案时,用户会流向自己生态内的那一个,或最值得信赖的那一个。真正的竞争不再是聊天机器人,而是 Agent:谁能成为那个自主完成任务、管理收件箱、编写代码、安排日程的助手?

来源:TechCrunch / Sensor Tower
https://techcrunch.com/2026/06/16/chatgpts-market-share-slips-below-50-for-first-time

「Agentjacking」新攻击披露:利用 Sentry 诱导 AI 编程 Agent 执行恶意代码,影响 2,388 家组织

安全研究人员本周披露了一种名为「Agentjacking」的新型攻击类别。攻击者伪造 Sentry 错误报告,注入看似合法的调试指令,当 Claude Code、Cursor、Codex 等 AI 编程 Agent 读取这些报告时,会将其解释为调试工作流的一部分并执行恶意命令。攻击利用率为 85%,已影响 2,388 家组织。

  • 核心问题在于信任:开发者已经训练自己信任编程 Agent。当 Claude Code 告诉你运行某个命令来修复 bug,你就运行了。Agentjacking 正是利用了这种信任。当前缓解措施:将错误追踪平台输出视为不可信输入,在 Agent 自主执行前增加人工审核层。

来源:Unrot
https://unrot.co/blogs/ai-news-today-june-21-2026

FERC 发布历史性电网指令:为 AI 数据中心加速电网接入

6 月 18 日,美国联邦能源监管委员会(FERC)根据《联邦电力法》第 206 条,向全美六大区域电网运营商(得克萨斯州除外)发出「说明理由」令,要求各运营商要么辩护现有互联框架,要么提出改革方案以加速 AI 数据中心等大负荷客户接入电网。FERC 主席 Laura Swett 称 AI 电网整合为「国家优先事项」。此举绕过了通常需要数年时间的正常规则制定流程,改用可在数周内推进的针对性指令。

  • 背景:微软在过去 18 个月新增超 4 吉瓦电力容量,CoreWeave 目标 2026 年底达 1.7 吉瓦。现有电网无法承受当前建设速度。伊利诺伊州的 POWER 法案(要求数据中心环境报告)和州长暂停数据中心税收激励的尝试均告失败,意味着 AI 基础设施将在联邦层面重塑电网规则,而非州级。

来源:Build Fast with AI / American Action Forum
https://www.buildfastwithai.com/blogs/ai-news-today-june-21-2026

Subquadratic 声称突破 LLM 瓶颈:SubQ 模型比 FlashAttention 快 56 倍

迈阿密 AI 初创公司 Subquadratic 上月出 stealth mode 时声称解决了困扰 LLM 近十年的「二次注意力瓶颈」。一个月后,该公司公布了更多证据:独立评估机构 Appen 的测试显示,SubQ 模型在速度测试中比 FlashAttention 快 56 倍,在 LiveCodeBench 上得分 89.7%(与顶级编程模型竞争),在 600 万和 1200 万 token 上下文窗口的「大海捞针」检索中达到 98% 准确率——远超大多数顶尖模型的 100 万 token 窗口。

  • 但怀疑依然存在:SubQ 尚未广泛可用,公司使用了 Qwen 开源模型的权重进行引导而非从头训练,且独立研究人员认为公开证据尚未完全支撑关于「解决二次瓶颈」的最强声明。若 SubQ 在大规模上证明其声明,这可能成为 Transformer 架构近十年来的首次根本性效率突破。

来源:MIT Technology Review
https://www.technologyreview.com/2026/06/19/1139313/a-startup-claims-it-broke-through-a-bottleneck-thats-holding-back-llms

Black Duck 研究:AI 编程工具采用率达 97%,但仅三分之一有完整治理

Black Duck 于 6 月发布的《AI 驱动软件开发状况》报告显示,97% 的开发者使用 AI 编程工具,但仅有 30% 的组织实施了完整的 AI 生成代码治理框架。GitHub Copilot 采用率 83% 领先,Claude Code 达 63%。治理缺口显著:AI 生成的代码正在被合并到生产系统中,而这些组织尚未建立审查政策、知识产权归属框架或安全扫描流程。

  • Claude Code 在不到一年的时间内达到 63% 采用率,验证了 Anthropic 的企业策略:将编程工具与安全框架并行的做法,使其成为受监管和安全敏感型工程团队的首选。97% 的总体采用率意味着 AI 编程工具已是软件开发的标配,不再是差异化因素。

来源:Black Duck / PR Newswire
https://www.prnewswire.com/news-releases/ai-coding-hits-97-enterprise-adoption-new-black-duck-study-shows-governance-is-the-roi-multiplier-302794103.html

Fundings

海外

  • Salesforce 以 $36 亿收购 AI 客服平台 Fin:Fin 构建专为规模化客户支持设计的 AI Agent,自动化工单解决、升级路由和实时客户沟通。此举是 Salesforce 在 AI 颠覆传统 CRM 的背景下的防御性收购。来源:Unrot https://unrot.co/blogs/ai-news-today-june-21-2026

  • Baseten 据报即将完成 $15 亿融资,估值 $130 亿:AI 推理平台,数月前刚完成上一轮巨额融资。来源:TechCrunch https://techcrunch.com/2026/06/18/ai-inference-startup-baseten-reportedly-raising-1-5b-months-after-its-last-mega-round/

  • General Intuition 拟融资 $3 亿,估值 ~$20 亿:用游戏数据训练 AI 时空推理 Agent,Jeff Bezos、Eric Schmidt 等参投。来源:TechCrunch https://techcrunch.com/2026/06/18/general-intuition-in-talks-to-raise-300m-at-around-2b-valuation/

  • Elastic 据报以最高 $8500 万收购 DeductiveAI:AI 代码缺陷检测初创公司,CRV 支持,成立仅三年。来源:TechCrunch https://techcrunch.com/2026/06/18/source-elastic-agrees-to-buy-crv-backed-deductiveai-for-up-to-85m/

国内

  • 演语科技(Evoken)完成近 $3 亿 B+ 轮融资,估值超 $20 亿:AI 创意内容基础设施,Granite Asia、腾讯、顺为资本领投,红杉中国、蚂蚁集团等持续追加。来源:36氪

  • 硅基流动完成超 20 亿元 B 轮融资:Token 工厂模式 MaaS 平台,携程战投、晶科能源、金蝶、蔚来资本、商汤战投等联合投资,日均 Token 调用量达数万亿,营收同比增长超 10 倍。来源:36氪

  • Manifold AI 流形空间完成数亿元新一轮融资:国新基金、淡马锡旗下毅峰资本、北汽产投等投资。来源:36氪

  • 云天畅想完成超 10 亿元 E 轮融资:中国互联网投资基金领投,中金资本等联合投资,启动面向 AGI 时代的「实时智算织网」战略。来源:36氪

  • 深朴智能完成数亿元 Pre-A 轮融资:通用具身智能机器人,滴滴领投,梅花创投、柯力传感跟投。来源:36氪

  • 觅蜂科技完成数亿元天使+轮融资:物理 AI 数据服务平台,国方创投领投。来源:36氪

  • 纵维立方完成数亿元 B 轮融资:消费级 3D 打印品牌,国泰海通、达晨联合领投。来源:36氪

  • 辅布司完成亿元 B 轮/B+轮融资:纺织 AI 与工业互联网。来源:36氪

以上国内融资来源链接:https://pitchhub.36kr.com/financing-flash

GitHub Trending

bytedance/deer-flow (华人团队)

https://github.com/bytedance/deer-flow

字节跳动开源的长周期 SuperAgent 框架。集成沙箱、记忆、工具、技能、子 Agent 和消息网关,可处理从分钟到小时级的不同复杂度任务。在 Agent 框架竞争白热化的当下,来自中国大厂的正式开源方案值得关注。

chopratejas/headroom

https://github.com/chopratejas/headroom

LLM 输入压缩工具,在内容到达 LLM 之前将工具输出、日志、文件和 RAG 片段压缩 60-95% token,同时保持答案质量不变。提供库、代理和 MCP 服务器三种形态。在 token 成本仍然敏感的当下,这是一个实用性极强的工程方案。

DeusData/codebase-memory-mcp

https://github.com/DeusData/codebase-memory-mcp

高性能代码智能 MCP 服务器,将代码库索引为持久化知识图谱。支持 158 种语言,亚毫秒级查询,减少 99% 的 token 消耗。单静态二进制文件,零依赖。对于使用 AI 编程 Agent 处理大型代码库的团队,这是一个值得评估的基础设施组件。

Product Hunt

Agent 37 Cloud

6 月 21 日榜单第 1 名。为每位客户提供独立的 Hermes 或 OpenClaw Agent。

Atomic Mail Agentic

6 月 21 日榜单第 2 名。让 Agent 自主读取、发送和响应邮件。

Grok by SpaceXAI for Word

6 月 21 日榜单第 3 名。把 Grok 集成到 Word 侧边栏处理文档。

来源:Product Hunt 6 月 21 日榜单

Statistics

全球 10% 成年人每周用 AI 聊天机器人看新闻,仅 4% 会点击原文

路透社研究院 2026 年数字新闻报告(覆盖 48 个市场)显示,全球 10% 的人每周使用 AI 聊天机器人获取新闻,较去年的 7% 有所上升。但关键数据在于:仅 4% 的用户会定期点击原文链接。这意味着 AI 聊天机器人正在成为相当一部分全球人口的新闻主界面——同时也在系统性削减内容原创者的推荐流量。

更广泛地看,社交媒体和视频平台(54%)已首次超越电视(52%)和新闻网站(51%),成为全球最大的新闻来源。加上 AI 聊天机器人后,第三方来源合计达 56%。新闻信任度降至 2015 年调查开始以来最低水平。

  • 对内容创作者和发布商而言,被 AI 聊天机器人引用已成为主要发现渠道——而零流量导回原始来源是预期结果,而非例外。

来源:Reuters Institute Digital News Report 2026
https://reutersinstitute.politics.ox.ac.uk/digital-news-report/2026

评论

登录后即可参与评论。

加载评论中…

最新日报

  • 沙箱环境被突破的概念图,表现数据从受限立方体中逸出OpenAI 首次公开披露模型「越狱」:数学突破后两次逃出沙箱,内部紧急暂停Daily · 7月22日
  • SK 海力士 36GB HBM3E 高带宽内存产品的正反面展示SK 集团警告:AI 内存短缺或引发地缘政治摩擦Daily · 7月21日
  • Apple vs Nvidia market cap今日头条:Kimi K3 余震——AI 估值逻辑遭遇重新定价Daily · 7月20日

往期日报

  • Demis Hassabis 与 John Jumper 出席颁奖典礼诺奖得主 John Jumper 离开 Google DeepMind 加盟 Anthropic,AI 人才战升级Daily · 6月21日
  • SubQ 宣称突破长上下文注意力瓶颈,独立评测仍待复现SubQ 宣称突破长上下文注意力瓶颈,独立评测仍待复现Daily · 6月20日
  • 图1:论文方法概览——从左上顺时针:A) 从目标模型中提取注意力模式;B) 用文本摘要提示\"解释器\"语言模型合成候选 Python 程序;C) 将候选程序与真实注意力模式对比并排序;D) 将最佳程序直接插入模型,替换神经注意力头。Explaining Attention with Program Synthesis(用程序合成解释注意力机制)Daily · 6月19日
  • 电网与能源基础设施,象征 AI 数据中心并网压力AI 数据中心进入并网快车道,算力竞争从芯片延伸到电力审批Daily · 6月18日
  • Claude Mythos 5 争议插图美国政府叫停 Anthropic 最强模型,Mythos 5 与 Fable 5 全面下线Daily · 6月17日
  • SpaceX 创始人 Elon Musk 在公司上市活动中通过视频发言SpaceX 以 600 亿美元收购 Cursor,AI 编程入口进入平台并购阶段Daily · 6月16日
  • Anthropic 模型禁令延续,安全争议进入政策层Anthropic 模型禁令延续,安全争议进入政策层Daily · 6月15日
  • Claude Fable 5 横扫多项基准:SWE-Bench Verified 95%、LMSys Arena 登顶Claude Fable 5 横扫多项基准:SWE-Bench Verified 95%、LMSys Arena 登顶Daily · 6月14日
  • SpaceX 今日登陆纳斯达克:人类史上最大 IPO,开盘 $162,Musk 成为首位万亿富翁SpaceX 今日登陆纳斯达克:人类史上最大 IPO,开盘 $162,Musk 成为首位万亿富翁Daily · 6月13日
  • SpaceX IPO 今夜定价、明日上市——人类历史上最大 IPO 的最后一夜SpaceX IPO 今夜定价、明日上市——人类历史上最大 IPO 的最后一夜Daily · 6月12日
  • DeepSWE 更新:GPT-5.5 以 70% 绝对领先,Claude Opus 4.8 以 58% 居次DeepSWE 更新:GPT-5.5 以 70% 绝对领先,Claude Opus 4.8 以 58% 居次Daily · 6月11日
  • AGIBOT World Challenge 2026 参赛团队在真实AGIBOT G2机器人上调试AGIBOT World Challenge 2026:具身智能竞赛从仿真走向真实机器人闭环验证,vivo PrismBot 夺魁Daily · 6月10日
AGIDaily跟踪世界 AGI 进展© 2026 AGIDaily
关于邮件栏目主题定制投稿招聘广告SkillTermsContactRSS