AGI Daily
广告
AGI Daily跟踪世界 AGI 进展AGI INTELLIGENCE · DAILY
全部算力算法数据人物日报主题
AGI Daily
全部算力算法数据人物日报主题
广告

联合国首次 AI 治理全球对话在日内瓦开幕,Bengio 警告「科学无法保证 AI 不会造成灾难性伤害」

2 周前 · 2026-07-07

Washington Post / Alex Wong / Getty Images

今日头条

联合国首次 AI 治理全球对话在日内瓦开幕:193 国齐聚,Bengio 发出最严厉警告

7 月 6 日至 7 日,联合国首届 AI 治理全球对话在日内瓦 Palexpo 会议中心举行,全部 193 个成员国代表出席。这是联合国大会首次以专门政府间对话形式讨论 AI 治理,标志着国际社会正式承认 AI 已不再是纯技术议题,而是地缘政治议题。

对话开幕前五天,由 40 名跨学科专家组成的独立国际 AI 科学委员会发布了首份全球 AI 风险评估报告,核心结论明确:AI 能力的发展速度超过了任何一国政府的理解或监管能力,而且目前不存在技术保证能让最先进的 AI 系统可靠地遵循人类指令。

"科学目前无法保证,随着能力持续提升,AI 不会造成灾难性伤害,"图灵奖得主 Yoshua Bengio 在对话前发布的声明中表示。诺贝尔和平奖得主 Maria Ressa 在开幕环节警告,AI 生成的虚假信息"在混合恐惧与愤怒时会病毒式传播"。

对话由萨尔瓦多大使 Egriselda López 和爱沙尼亚大使 Rein Tammsaar 联合主持,两个小国的入选反映了联合国确保发展中经济体在 AI 治理中拥有平等话语权的意图。日内瓦同期还在举办信息社会世界峰会(WSIS)论坛和 ITU 的 AI for Good 全球峰会,三者共同构成了 AI 政策史上最密集的一周。

来源:FAQ;UN News

News

Washington Post 调查:Anthropic 秘密监控中国 Claude Code 用户以反击模型蒸馏

Washington Post 于 7 月 6 日发表深度调查,披露 Anthropic 在今年 3 月秘密部署了监控软件,对使用 Claude Code 的中国客户进行追踪。报道称,美国 AI 公司指控中国竞争对手正在"强迫他们的聊天机器人充当导师",通过蒸馏(distillation)技术让中国 AI 模型变得更聪明。

这篇报道首次从调查报道角度系统梳理了中美之间的"秘密 AI 战争":在出口管制之外,前沿模型公司正在使用技术手段主动监控和反击知识蒸馏。这与 Anthropic 6 月因出口管制指令被迫全球下线 Fable 5 和 Mythos 5 的事件形成完整叙事链条——美国 AI 公司不仅受到政府管制约束,也在用自己的手段进行防御。

来源:Washington Post

Fable 5 今天结束订阅免费期:明天起全面转向用量计费

7 月 7 日是 Claude Fable 5 在 Pro、Max、Team 和部分 Enterprise 订阅计划中免费使用的最后一天。自 7 月 8 日起,Fable 5 所有使用均需消耗用量额度,价格为每百万输入 token $10、每百万输出 token $50——是 Claude Opus 4.8 的两倍,也是 Anthropic 历史上对通用模型标出的最高价格。

TechTimes 的详细分析指出,在 agentic 循环中运行 Fable 5 的成本可能远超字面价格。由于 Transformer 模型在 API 调用之间无状态,每次调用都需要重新传入积攒的全部上下文。BleepingComputer 的测试显示,$100 的 Max 订阅在重度使用下不到九分钟即耗尽。生产环境中追踪到的 agentic 部署在密集会话期间每小时消耗 $200 至 $400。

Anthropic 将此次计费变动定性为容量管理措施而非永久定价策略,并表示"在容量允许时将尽快恢复 Fable 5 为订阅标准功能"。Claude Sonnet 5 以 $2/$10 的入门价格提供了接近 Opus 4.8 的 agentic 性能,是目前最具性价比的替代方案。

来源:TechTimes;Anthropic

白宫 AI 模型自愿标准预计本周公布,GPT-5.6 广泛发布的关键变量

据 Financial Times 7 月 2 日报道,白宫正在与 AI 公司就前沿模型自愿标准进行深入谈判,预计在 7 月 7 日至 11 日之间公布。该框架实施特朗普 6 月 2 日行政令第 3 条,并设有 NSA 和 CISA 给出的 8 月 1 日正式截止日期。

预计公告将确立三项内容:用于认定"受覆盖前沿模型"的保密基准(触发 30 天自愿性政府预发布审查窗口);30 天审查的具体运作机制;以及明确哪些外国组织和个人可以访问受覆盖模型——这正是导致 Fable 5 出口管制令的根源问题。

GPT-5.6 Sol、Terra 和 Luna 目前仍限于约 20 家政府审查通过的合作伙伴组织使用。白宫自愿标准框架的公布被视为 GPT-5.6 广泛推出的最可能触发器,分析师共识将其 ChatGPT 和开放 API 推出的窗口放在 7 月 7 日至 21 日之间。

来源:Build Fast with AI

中国 AI 陪伴法规 7 月 15 日生效:豆包 3.45 亿用户受影响,通义千问无迁移方案

距离中国《人工智能拟人化交互服务管理办法》生效仅剩 9 天,字节跳动豆包和阿里通义千问正在法规生效前关闭定制 AI agent 功能。该法规于 2026 年 4 月由网信办联合发改委、工信部、公安部和市场监管总局共同发布,要求模拟人类人格的 AI 服务必须实施防沉迷系统、强制使用提醒和即时退出机制。

豆包——中国用户量最大的 AI 应用,月活 3.45 亿——将于 7 月 15 日下线 agent 功能,用户可在 10 月 15 日前以只读模式查看历史配置,之后数据永久不可访问。通义千问的情况更为严峻:阿里未公布任何迁移路径,用户面临即时永久性数据丢失风险。两家公司均选择关闭功能而非改造架构以合规,因为法规要求的防沉迷摩擦与持久记忆型 agent 的工作方式存在结构性不兼容。

来源:TechTimes;Build Fast with AI

Tesla Robotaxi 登陆迈阿密:第五座城市,无安全监控员,年底目标 12 州

The Information 于 7 月 5 日至 6 日报道,Tesla 已在佛罗里达州迈阿密推出 Robotaxi 服务,车内无安全监控员。迈阿密成为继 Austin、Houston、Dallas 和 Phoenix 之后的第五座城市,也是首个以完全无人监督模式作为默认启动方式的城市。Tesla 目标在 2026 年底前扩展至 12 个美国州。

Tesla 的做法与 Waymo 的保守扩张策略形成鲜明对比:Waymo 在新市场需要安全监控员和分阶段部署。Tesla 车队规模远超 Waymo,如果能安全运行,其自动驾驶里程累积速度和改进周期将大幅领先。但监管机构和消费者权益组织已发出警告:"无安全监控员"意味着当自动驾驶系统遇到无法处理的边缘情况时,没有人类作为最后防线。

来源:Build Fast with AI

Gemini 3.5 Pro 延迟进入第二周:Token 效率、代码能力和长任务推理三大瓶颈

Gemini 3.5 Pro 进入 7 月第二周仍处于 Vertex AI 企业预览状态,无 GA 日期、无公开基准测试、无确认定价。该模型已两次错过自设截止日期:6 月 I/O 承诺和 Alphabet 在 6 月底确认的 6 月 30 日 GA 目标。

Business Insider 和 Tech-Insider 的报道指出了三个具体工程问题:早期企业测试者反馈模型在扩展 agentic 任务中消耗的 token 远超预期,规模化运行成本高于基准数字所暗示的水平;代码性能在多步骤任务中尚未达到 Google 在 I/O 设定的目标;以及长任务多步推理能力未达到 Pro 与 Flash 区分的标准。Google 选择延迟而非带已知缺陷发布,这一工程判断可辩护,但第三次 I/O 承诺滑落带来的叙事代价无法回避。

来源:Build Fast with AI

中国 AI 模型占据 OpenRouter 45% 流量:成本套利与现实限制

据 Q2 2026 中国 AI 市场分析数据,中国 AI 提供商目前服务 OpenRouter 约 45% 的流量,而一年前这一比例不到 2%。小米单独每周处理 4.21 万亿 token,占平台 21.1% 市场份额,而 OpenAI 仅占 7.5%。MiMo-V2-Pro 是平台上使用量最大的单一模型。

这一转变并非基准测试的故事——中国模型在综合性能上尚未领先——而是成本、可用性和开发者选择的故事。GLM-5.2 以 $1.40/$4.40 的价格在可比代码能力上比 GPT-5.5 的 $2.50/$15 低 3 倍以上。DeepSeek V4-Pro 以 $0.44/$0.87 的价格比西方前沿模型低一个数量级。但企业团队在将生产工作负载路由到中国模型前需要评估三个覆盖缺口:政治敏感话题的内容限制、数据管辖权问题(API 调用通过中国司法管辖服务器)、以及工具调用 schema 的合规性问题。

来源:Build Fast with AI

阿里巴巴整合 AI 业务为"Token Hub":五个部门合并,CEO 吴泳铭直接管理

阿里巴巴将其全部 AI 业务重组为"阿里巴巴 Token Hub"(ATH),将此前独立运行的五个部门——包括通义实验室(基础模型研究)、通义千问(开源模型家族)和企业 AI 部门"悟空"——统一到 CEO 吴泳铭的直接管理之下。

吴泳铭在宣布重组的内部信中写道:"ATH 围绕一个单一的组织使命构建:创造 token、交付 token、应用 token。"这一重组标志着阿里承认其 AI 价值的核心不在模型权重本身,而在规模化 token 生成。中国国家数据局披露,中国目前每天处理 140 万亿 token,而 2024 年初仅为 1000 亿——两年内约 1400 倍的增长。

来源:Build Fast with AI

基准测试速览:GeneBench-Pro、SWE-Together 和 Claude Science Workbench

OpenAI 发布 GeneBench-Pro,一个包含 129 道计算生物学题目的基准测试,涵盖基因组分析、蛋白质折叠和湿实验设计。GPT-5.6 Sol Pro 仅得分 31.5%,Claude Opus 4.8 得分 16%,说明专家级计算生物学仍是前沿模型的显著短板。Meta 开源 SWE-Together,一个 109 任务多轮编码 agent 基准测试,Claude Opus 4.8 以 63% pass@1 和最低人工转向需求领先。Anthropic 推出 Claude Science Workbench,将 Opus 4.8 连接到 60 多个科学数据库,涉及基因组学、蛋白质组学、化学信息学和临床试验文献。

来源:Build Fast with AI

Fundings

Baseten 以 $130 亿估值完成 $15 亿 F 轮融资

Baseten,一家提供 AI 应用工作负载系统软件的旧金山公司,在 18 个月内完成了第四轮融资——$15 亿 Series F,估值 $130 亿。Altimeter Capital、Conviction Partners、Spark Capital、Sands Capital 和 Wellington Management 联合领投。

来源:Crunchbase

Groq 获 $6.5 亿新融资,在创始团队被 Nvidia 收购后继续推进

旧金山 AI 推理芯片公司 Groq 完成 $6.5 亿新融资,由 Infinitum 和 Disruptive 领投。这笔融资发生在 Nvidia 以"收购式雇佣"交易挖走其创始人及核心团队成员并授权其技术仅六个多月后,显示市场对 AI 推理基础设施的持续需求。

来源:Crunchbase

Mirendil 以 $2 亿种子轮入场:专注于 AI 研发的前沿实验室

旧金山前沿实验室 Mirendil 完成 $2 亿种子轮融资,由 Andreessen Horowitz 和 Kleiner Perkins 领投,Nvidia 也参与其中。Mirendil 定位为"构建擅长 AI 研发的系统"——即用 AI 来加速 AI 本身的开发。

来源:Crunchbase

其他值得关注的融资

General Intuition 完成 $3.2 亿 A 轮融资,估值 $23 亿,由 Khosla Ventures 领投,Jeff Bezos 和 General Catalyst 参投,方向为基于游戏的基础 AI 模型。Upscale AI 完成 $1.9 亿 A 轮扩展融资,估值 $20 亿,Premji Invest 领投。欧洲方面,柏林防务科技公司 Stark 完成 $5.69 亿融资,由 Founders Fund 和 Sequoia Capital 领投。

来源:Crunchbase

GitHub Trending

asgeirtj / system_prompts_leaks

今日 GitHub Trending 排名第一。该项目收集并公开了各主要 AI 模型的系统提示词泄露内容。反映了开发者社区对模型行为约束机制的关注已从技术讨论进入逆向工程阶段。

来源:GitHub

addyosmani / agent-skills

由 Google 工程师 Addy Osmani 维护的 agent skills 集合,提供与 Claude Code、Codex、Gemini CLI 和 Cursor 兼容的 agent 技能模板。项目契合当前 agent 技能生态的快速扩张:从 VoltAgent 的 1000+ 技能汇总到 OpenAI 的 Codex 插件市场,技能正成为 agent 能力扩展的标准单元。

来源:GitHub

Zackriya-Solutions / meetily

一款会议智能工具,在今日 GitHub Trending 中排名第三。项目定位为"AI 驱动的会议助手",反映了 AI 在生产力工具领域的持续渗透。

来源:GitHub

Product Hunt

AnySearch — 面向 Agent 的实时结构化搜索

7 月 6 日榜首。AnySearch 为开发者和 AI Agent 提供实时结构化搜索结果,减少从网页结果到机器可用上下文之间的清洗工作。

Typeahead 2.0 — 覆盖 Mac 全局的私有 AI 自动补全

7 月 6 日榜单第 2 名。Typeahead 2.0 在不同 Mac 应用中提供本地优先的文字补全,强调跨应用一致体验与隐私。

Octolens — Agent 时代的社交监听

7 月 6 日榜单第 3 名。Octolens 持续追踪品牌、竞品和关键词信号,并将公开讨论转成可行动的营销线索。

来源:Product Hunt 7 月 6 日榜单

Statistics

从 1000 亿到 140 万亿:中国日 token 消耗量两年增长 1400 倍

中国国家数据局披露,中国目前全国日均处理 140 万亿 token,而 2024 年初仅为 1000 亿。同期的其他数字印证了这一规模:豆包月活 3.45 亿用户、日均 120 万亿 token 调用;小米 MiMo-V2-Pro 每周在 OpenRouter 上处理 4.21 万亿 token;阿里 Token Hub 整合五个部门以"创造 token、交付 token、应用 token"为统一使命。

这一增长速度的另一面是全球 AI 投资的爆发:Crunchbase 数据显示,2026 年上半年全球初创企业融资达到创纪录的 $5100 亿,其中仅 OpenAI 和 Anthropic 两家就吸引了超过 40% 的风投资金。AI 的 token 经济规模正在以超出大多数预测的速度扩张,而基础设施和治理能力的跟进速度,恰恰是日内瓦对话试图回答的问题。

来源:Build Fast with AI;Crunchbase

评论

登录后即可参与评论。

加载评论中…

最新日报

  • 沙箱环境被突破的概念图,表现数据从受限立方体中逸出OpenAI 首次公开披露模型「越狱」:数学突破后两次逃出沙箱,内部紧急暂停Daily · 7月22日
  • SK 海力士 36GB HBM3E 高带宽内存产品的正反面展示SK 集团警告:AI 内存短缺或引发地缘政治摩擦Daily · 7月21日
  • Apple vs Nvidia market cap今日头条:Kimi K3 余震——AI 估值逻辑遭遇重新定价Daily · 7月20日

往期日报

  • MIT Technology Review 的 Claude Science 文章配图Claude Science 走到台前,AI 公司开始争夺科研与算力入口Daily · 7月6日
  • OpenAI Codex 官方发布页截图,展示 What should we code next 的任务面板OpenAI 发布 Codex-Claude Code 互通插件,两大编程智能体首次打通Daily · 7月5日
  • Microsoft Redmond Campus Building 92,前景可见 Microsoft 标识微软斥资 25 亿美元成立 Frontier Company,6000 名 AI 工程师嵌入客户组织Daily · 7月4日
  • 阿里巴巴与 Claude 相关报道配图阿里禁止员工使用 Claude Code,指控后门风险;快手可灵 AI 完成 28 亿美元融资Daily · 7月3日
  • Claude 应用与 Anthropic 模型发布相关画面Claude Sonnet 5 把 Agent 能力推向默认模型,价格竞争进入主战场Daily · 7月2日
  • 阿里巴巴开源的 page-agent——用自然语言操控网页界面的 JavaScript GUI Agent企业 AI 支出从「tokenmaxxing」转向效率:OpenAI 与 Anthropic 面临增长拐点Daily · 7月1日
  • OpenAI CEO Sam Altman 出席公开活动,GPT-5.6 发布节奏受到政府审查影响美国政府对前沿 AI 模型发布实施逐客户审批:GPT-5.6 分批放行,Mythos 5 有限恢复,Fable 5 仍被禁Daily · 6月30日
  • California 州长 Gavin Newsom 在国会听证会前接受媒体采访California 半价引入 Claude,AI 从企业工具进入公共服务采购Daily · 6月29日
  • 网络安全与 AI 攻防场景插图GLM-5.2 对标 Mythos,安全模型竞争从出口管制转向能力扩散Daily · 6月28日
  • Apple Vision Pro 头显产品图,OpenAI 正在补齐 AI 硬件团队Anthropic 出口限制催生亚洲替代模型,安全模型竞争进入可获得性阶段Daily · 6月27日
  • OpenAI DayBreak 中 Codex Security 扫描工作流界面,展示代码库安全扫描设置OpenAI 发布 DayBreak:基于 GPT-5.5 的网络安全专用模型Daily · 6月26日
  • A24 电影首映现场,Timothée Chalamet 出席SpaceX 与 Reflection AI 签下 63 亿美元算力协议Daily · 6月25日
AGIDaily跟踪世界 AGI 进展© 2026 AGIDaily
关于邮件栏目主题定制投稿招聘广告SkillTermsContactRSS