AGI Daily
广告
AGI Daily跟踪世界 AGI 进展AGI INTELLIGENCE · DAILY
全部算力算法数据人物日报主题
AGI Daily
全部算力算法数据人物日报主题
广告

Fable 5 正式开启付费:$10/$50 的「AI 法拉利」能否撑起 Anthropic 的 IPO 叙事

2026-07-09 / 2026年7月9日 · 共 2,795 字

TechTimes

7 月 8 日,Anthropic 旗下最强模型 Fable 5 的 50% 免费使用额度正式到期。所有 Claude Pro、Max、Team 和 Enterprise 用户如需继续使用 Fable 5,必须购买使用积分,价格为每百万输入 token 10 美元、每百万输出 token 50 美元。这是当前市场上公开可用的最昂贵 AI 模型定价——恰好是 Opus 4.8 的两倍,也是 Anthropic IPO 前最关键的一场商业模式压力测试。

一条计费线,三种价格标签

Anthropic 当前的产品矩阵形成了一个清晰的三层价格阶梯。

中端主力 Claude Sonnet 5 定价为每百万输入 token 2 美元、输出 10 美元(推广价,有效期至 8 月 31 日),在 SWE-bench Pro 上的 Agent 编码得分为 63.2%。高端定位的 Opus 4.8 为 5 美元/25 美元,得分 69.2%。旗舰 Fable 5 为 10 美元/50 美元,得分约 80% 以上。

价格差距远比性能差距悬殊。一次处理 200 万输出 token 的 Agent 编程会话,在 Fable 5 上花费 100 美元积分,Sonnet 5 仅需 20 美元,Opus 4.8 为 50 美元。企业客户需要用 5 倍的价格,换取 6 到 17 个百分点的性能提升。

更复杂的现实是:据 AI 评测平台 BridgeMind 在 BridgeBench TypeScript 调试基准上的独立测试,Fable 5 在 7 月 1 日重新部署后新增的安全分类器存在显著的误报——12 项 TypeScript 调试任务中仅 3 项在 Fable 5 上完成,其余 9 项被自动路由到 Opus 4.8。用户支付的可能是 Fable 的价格,实际跑的是 Opus。

一场被出口管制打乱的六周

7 月 8 日的收费节点,实际上是 Fable 5 计费路线图的第三版。

Fable 5 于 6 月 9 日发布,最初作为订阅内置功能免费提供至 6 月 22 日。6 月 12 日,美国商务部发出出口管制指令,要求 Anthropic 暂停向任何外国公民提供 Fable 5 和 Mythos 5 访问权限。由于无法在消费级规模实时验证用户国籍,Anthropic 在约 90 分钟内全球下线了两款模型。

此后 19 天的停摆彻底改写了经济账:大多数用户从未体验到原定的免费窗口。6 月 30 日,商务部长 Howard Lutnick 致函撤回出口管制要求。Fable 5 于 7 月 1 日恢复,附带一个 7 天的 50% 免费额度过渡期,至 7 月 7 日午夜截止。

Anthropic 将此次计费模式描述为「容量管理工具」而非永久定价策略。公司正在通过 SpaceX 的 Colossus 1 数据中心部署超过 300 兆瓦、超过 22 万块 Nvidia GPU 的算力。一位 Claude Code 首席工程师在 X 上确认,公司计划在容量允许后恢复 Fable 5 的标准订阅模式,但未给出时间表。

Agent 循环中的成本复利

Fable 5 的标价只是故事的一半。真正让成本失控的,是 Agent 循环中 Transformer 架构的无状态特性。

Transformer 模型在每次 API 调用之间不保留记忆。每一轮交互都需要将整个累积上下文——项目状态、计划、历史摘要、工具定义——重新传递。在单轮对话中,这笔开销几乎不可见。在跨越数十甚至数百轮的 Agent 循环中,上下文逐轮膨胀,每次都被计为输入 token,而模型的推理输出以 50 美元/百万 token 的主导费率结算。

实际数据印证了这个效应。BleepingComputer 在 Fable 5 最初发布时测试发现,一张 100 美元的 Max 订阅在不到 9 分钟的重度使用下耗尽。Scrimba CEO 在 7 分钟内记录了 130 万 token——约每小时 160 美元的消耗速度。生产环境中的 Agent 循环,密集时段达到每小时 200 到 400 美元。

Anthropic 指出 Fable 5 可以用更少的轮次和 token 完成任务——合理的任务上,翻倍的单价可能低于直观比较。但关键词是「合理的任务」。将所有工作默认路由至 Fable 5 而非按需选择性调用,产生的成本飙升没有对应的质量回报。

三种成本控制手段可用:提示缓存将稳定上下文的输入成本降低 90%(从 10 美元降至 1 美元/百万 token);Batch API 将两项费率减半至 5 美元/25 美元;按需路由——仅将真正需要长程一致性和 100 万 token 上下文窗口的复杂任务交给 Fable 5。

IPO 前的定价权赌局

Fable 5 的计费结构是 Anthropic 10 月 IPO 之前最关键的收入信号。

Anthropic 于 6 月 1 日秘密提交了 S-1 注册声明,在完成 650 亿美元的 H 轮融资后,估值达到 9650 亿美元。公司需要在 IPO 路演中证明的叙事是:前沿模型性能可以支撑可持续的「溢价」——企业客户不仅愿意为了最强的模型付钱,而且会付很多钱。

Fable 5 的定价策略定义了这门生意的上边界。如果企业客户愿意为 6 个百分点的 SWE-bench Pro 提升支付 5 倍价格,Anthropic 的 IPO 叙事就成立。如果大多数客户选择将 Fable 5 仅用于零星的关键任务,日常负载转向 Sonnet 5 或第三方替代品,溢价逻辑就薄弱得多。

外部环境并不友善。CNBC 于 7 月 7 日发表的调查显示,通过 OpenRouter 和 Vercel 等平台,中国 AI 模型已占美国企业 token 用量的 30% 至 46%。GLM-5.2 以 62.1% 的 SWE-bench Pro 得分(接近 Opus 4.8),定价仅 1.40 美元/4.40 美元每百万 token——大约是 Fable 5 的七分之一。在 Vercel 上,GLM-5.2 上线首周客户数增长 80 倍、日 token 量增长 27 倍。Vercel Agent 基础设施负责人 Harpreet Arora 直言:「价格在起作用。当任务不需要最好的模型时,团队开始把它路由到最便宜且够用的那个。」

与此同时,OpenAI 将最强模型 GPT-5.6 Sol 定价为 5 美元/30 美元——显著低于 Fable 5。虽然 GPT-5.6 目前仅限约 20 个政府批准的合作伙伴使用,但一旦扩大开放,价格差将构成直接竞争压力。

廉价 AI 时代的终结并非偶然

Fable 5 转向计费制,表面上是一次性容量管理的权宜之计,背后却折射出前沿 AI 经济学的结构性转变。

2026 年上半年,西方前沿模型实验室几乎全面提价:GPT-5.5 定价较 GPT-5.4 翻倍,Gemini 3.5 Flash 较前代涨至 3 倍。在此过程中,中国企业推出的开源权重模型以接近前沿的性能和 60% 至 90% 的成本优势,系统性地拿下了中端企业负载市场。

这对 Anthropic 意味着一个清晰的战略十字路口:如果 Fable 5 的超额定价在 8 月底 Sonnet 5 推广价到期前产生了可观的收入贡献,Anthropic 就有底气向公开市场讲好「性能即护城河」的故事。如果企业客户普遍选择了更经济的选择,Fable 5 的高定价反而可能成为公司最显眼的脆弱点——一个技术上惊艳但没有足够买家的旗舰产品。

这不是价格更新新闻。这是 Anthropic 从「靠烧钱换性能的实验室」向「有真实定价权的商业公司」转型的正式起跑。

来源

  1. AI News Today July 8 2026: Fable 5 Usage Credits billing breakdown · Build Fast with AI
  2. Fable 5 Subscription Ends Tomorrow: Per-Token Costs and Who Gets Hit Hardest · TechTimes
  3. Claude Fable 5 Pricing: The July 7 Usage-Credits Switch · Digital Applied
  4. Anthropic Pricing Page · Anthropic
  5. Anthropic redeployment announcement (July 1) · Anthropic
  6. CNBC: Chinese AI Models Are Gaining Ground With US Companies · CNBC
  7. Anthropic IPO: Valuation, Timeline and Investment Options · SmartAsset

评论

登录后即可参与评论。

加载评论中…

相关文章

  • 西门子在 CES 2024 消费电子展的展台

    五部门警告:黑客正用 AI 生成的漏洞脚本攻击美国关键基础设施

    算法 · 2026-08-22

  • 冷冻电镜重构:一个由基因组语言模型设计出的功能性噬菌体颗粒

    Evo 2 首次生成 16 个可用噬菌体:'从零设计'的真实增量与边界

    算法 · 2026-08-19

  • Wccftech 为 Ox Alpha 配的插画:一只机械公牛站在科技实验室场景中,屏幕上显示「OX ALPHA: A STORY OF ARTIFICIAL AWAKENING」

    匿名模型 Ox Alpha 上线:stealth 发布正在成为中国实验室的发布前测试

    算法 · 2026-08-23

  • 一台人形机器人参赛者于 8 月 19 日在北京国家速滑馆进行第二届世界人形机器人运动会赛前测试

    跑得比博尔特快、却撞上电箱:人形机器人运动会的自主化考题

    算法 · 2026-08-22

  • ARC-AGI-3 交互推理基准中一个游戏的起始画面

    Nvidia AVO 让 Opus 5 在 ARC-AGI-3 满分:长程任务的关键变量是 harness

    算法 · 2026-08-21

  • Anthropic 地盘战实验的结局分布图:Mythos 5 约 98% 的试验以停战告终,而 Sonnet 4.6 与 Opus 4.6 多数以武力解决或悬而未决

    更强的模型不会自动带来协调:Anthropic 的多智能体失败实验

    算法 · 2026-08-13

AGIDaily跟踪世界 AGI 进展© 2026 AGIDaily
关于邮件栏目主题定制投稿招聘广告SkillTermsContactRSS