Washington Post 调查:Anthropic 秘密监控中国 Claude Code 用户以反击模型蒸馏
Washington Post 于 7 月 6 日发表深度调查,披露 Anthropic 在今年 3 月秘密部署了监控软件,对使用 Claude Code 的中国客户进行追踪。报道称,美国 AI 公司指控中国竞争对手正在"强迫他们的聊天机器人充当导师",通过蒸馏(distillation)技术让中国 AI 模型变得更聪明。
这篇报道首次从调查报道角度系统梳理了中美之间的"秘密 AI 战争":在出口管制之外,前沿模型公司正在使用技术手段主动监控和反击知识蒸馏。这与 Anthropic 6 月因出口管制指令被迫全球下线 Fable 5 和 Mythos 5 的事件形成完整叙事链条——美国 AI 公司不仅受到政府管制约束,也在用自己的手段进行防御。
来源:Washington Post
Fable 5 今天结束订阅免费期:明天起全面转向用量计费
7 月 7 日是 Claude Fable 5 在 Pro、Max、Team 和部分 Enterprise 订阅计划中免费使用的最后一天。自 7 月 8 日起,Fable 5 所有使用均需消耗用量额度,价格为每百万输入 token $10、每百万输出 token $50——是 Claude Opus 4.8 的两倍,也是 Anthropic 历史上对通用模型标出的最高价格。
TechTimes 的详细分析指出,在 agentic 循环中运行 Fable 5 的成本可能远超字面价格。由于 Transformer 模型在 API 调用之间无状态,每次调用都需要重新传入积攒的全部上下文。BleepingComputer 的测试显示,$100 的 Max 订阅在重度使用下不到九分钟即耗尽。生产环境中追踪到的 agentic 部署在密集会话期间每小时消耗 $200 至 $400。
Anthropic 将此次计费变动定性为容量管理措施而非永久定价策略,并表示"在容量允许时将尽快恢复 Fable 5 为订阅标准功能"。Claude Sonnet 5 以 $2/$10 的入门价格提供了接近 Opus 4.8 的 agentic 性能,是目前最具性价比的替代方案。
来源:TechTimes;Anthropic
白宫 AI 模型自愿标准预计本周公布,GPT-5.6 广泛发布的关键变量
据 Financial Times 7 月 2 日报道,白宫正在与 AI 公司就前沿模型自愿标准进行深入谈判,预计在 7 月 7 日至 11 日之间公布。该框架实施特朗普 6 月 2 日行政令第 3 条,并设有 NSA 和 CISA 给出的 8 月 1 日正式截止日期。
预计公告将确立三项内容:用于认定"受覆盖前沿模型"的保密基准(触发 30 天自愿性政府预发布审查窗口);30 天审查的具体运作机制;以及明确哪些外国组织和个人可以访问受覆盖模型——这正是导致 Fable 5 出口管制令的根源问题。
GPT-5.6 Sol、Terra 和 Luna 目前仍限于约 20 家政府审查通过的合作伙伴组织使用。白宫自愿标准框架的公布被视为 GPT-5.6 广泛推出的最可能触发器,分析师共识将其 ChatGPT 和开放 API 推出的窗口放在 7 月 7 日至 21 日之间。
来源:Build Fast with AI
中国 AI 陪伴法规 7 月 15 日生效:豆包 3.45 亿用户受影响,通义千问无迁移方案
距离中国《人工智能拟人化交互服务管理办法》生效仅剩 9 天,字节跳动豆包和阿里通义千问正在法规生效前关闭定制 AI agent 功能。该法规于 2026 年 4 月由网信办联合发改委、工信部、公安部和市场监管总局共同发布,要求模拟人类人格的 AI 服务必须实施防沉迷系统、强制使用提醒和即时退出机制。
豆包——中国用户量最大的 AI 应用,月活 3.45 亿——将于 7 月 15 日下线 agent 功能,用户可在 10 月 15 日前以只读模式查看历史配置,之后数据永久不可访问。通义千问的情况更为严峻:阿里未公布任何迁移路径,用户面临即时永久性数据丢失风险。两家公司均选择关闭功能而非改造架构以合规,因为法规要求的防沉迷摩擦与持久记忆型 agent 的工作方式存在结构性不兼容。
来源:TechTimes;Build Fast with AI
Tesla Robotaxi 登陆迈阿密:第五座城市,无安全监控员,年底目标 12 州
The Information 于 7 月 5 日至 6 日报道,Tesla 已在佛罗里达州迈阿密推出 Robotaxi 服务,车内无安全监控员。迈阿密成为继 Austin、Houston、Dallas 和 Phoenix 之后的第五座城市,也是首个以完全无人监督模式作为默认启动方式的城市。Tesla 目标在 2026 年底前扩展至 12 个美国州。
Tesla 的做法与 Waymo 的保守扩张策略形成鲜明对比:Waymo 在新市场需要安全监控员和分阶段部署。Tesla 车队规模远超 Waymo,如果能安全运行,其自动驾驶里程累积速度和改进周期将大幅领先。但监管机构和消费者权益组织已发出警告:"无安全监控员"意味着当自动驾驶系统遇到无法处理的边缘情况时,没有人类作为最后防线。
来源:Build Fast with AI
Gemini 3.5 Pro 延迟进入第二周:Token 效率、代码能力和长任务推理三大瓶颈
Gemini 3.5 Pro 进入 7 月第二周仍处于 Vertex AI 企业预览状态,无 GA 日期、无公开基准测试、无确认定价。该模型已两次错过自设截止日期:6 月 I/O 承诺和 Alphabet 在 6 月底确认的 6 月 30 日 GA 目标。
Business Insider 和 Tech-Insider 的报道指出了三个具体工程问题:早期企业测试者反馈模型在扩展 agentic 任务中消耗的 token 远超预期,规模化运行成本高于基准数字所暗示的水平;代码性能在多步骤任务中尚未达到 Google 在 I/O 设定的目标;以及长任务多步推理能力未达到 Pro 与 Flash 区分的标准。Google 选择延迟而非带已知缺陷发布,这一工程判断可辩护,但第三次 I/O 承诺滑落带来的叙事代价无法回避。
来源:Build Fast with AI
中国 AI 模型占据 OpenRouter 45% 流量:成本套利与现实限制
据 Q2 2026 中国 AI 市场分析数据,中国 AI 提供商目前服务 OpenRouter 约 45% 的流量,而一年前这一比例不到 2%。小米单独每周处理 4.21 万亿 token,占平台 21.1% 市场份额,而 OpenAI 仅占 7.5%。MiMo-V2-Pro 是平台上使用量最大的单一模型。
这一转变并非基准测试的故事——中国模型在综合性能上尚未领先——而是成本、可用性和开发者选择的故事。GLM-5.2 以 $1.40/$4.40 的价格在可比代码能力上比 GPT-5.5 的 $2.50/$15 低 3 倍以上。DeepSeek V4-Pro 以 $0.44/$0.87 的价格比西方前沿模型低一个数量级。但企业团队在将生产工作负载路由到中国模型前需要评估三个覆盖缺口:政治敏感话题的内容限制、数据管辖权问题(API 调用通过中国司法管辖服务器)、以及工具调用 schema 的合规性问题。
来源:Build Fast with AI
阿里巴巴整合 AI 业务为"Token Hub":五个部门合并,CEO 吴泳铭直接管理
阿里巴巴将其全部 AI 业务重组为"阿里巴巴 Token Hub"(ATH),将此前独立运行的五个部门——包括通义实验室(基础模型研究)、通义千问(开源模型家族)和企业 AI 部门"悟空"——统一到 CEO 吴泳铭的直接管理之下。
吴泳铭在宣布重组的内部信中写道:"ATH 围绕一个单一的组织使命构建:创造 token、交付 token、应用 token。"这一重组标志着阿里承认其 AI 价值的核心不在模型权重本身,而在规模化 token 生成。中国国家数据局披露,中国目前每天处理 140 万亿 token,而 2024 年初仅为 1000 亿——两年内约 1400 倍的增长。
来源:Build Fast with AI
基准测试速览:GeneBench-Pro、SWE-Together 和 Claude Science Workbench
OpenAI 发布 GeneBench-Pro,一个包含 129 道计算生物学题目的基准测试,涵盖基因组分析、蛋白质折叠和湿实验设计。GPT-5.6 Sol Pro 仅得分 31.5%,Claude Opus 4.8 得分 16%,说明专家级计算生物学仍是前沿模型的显著短板。Meta 开源 SWE-Together,一个 109 任务多轮编码 agent 基准测试,Claude Opus 4.8 以 63% pass@1 和最低人工转向需求领先。Anthropic 推出 Claude Science Workbench,将 Opus 4.8 连接到 60 多个科学数据库,涉及基因组学、蛋白质组学、化学信息学和临床试验文献。
来源:Build Fast with AI