6 月 30 日,AI 推理芯片公司 Etched 正式出隐身模式,同时宣布:TSMC 已成功制造其首款芯片 Sohu;累计融资 8 亿美元(最近一轮为 2025 年 12 月以 50 亿美元估值完成的 5 亿美元融资);以及已锁定超过 10 亿美元的客户合同。
如果回到 2023 年——创始人 Gavin Uberti 和 Robert Wachen 拿着 30 页 memo 向几乎所有主流 VC 推销同一个论点,即 AI 的未来需要专门为 Transformer 推理设计的芯片而非通用 GPU——答案是一致的「不投」。公司当时按月计算剩余现金,离关门只差几周。
两年后,这家公司有了在 TSMC N4P 工艺上一次流片成功的 ASIC,一支 400 多人的团队(大部分来自 NVIDIA、Broadcom、Google TPU 和 SK 海力士),以及一份天使投资人名单:Geoffrey Hinton、Andrej Karpathy、李飞飞、Stanley Druckenmiller、Mistral CEO Arthur Mensch 和 Cognition AI 创始人 Scott Wu。
一颗只做一件事的芯片
Sohu 是一种 ASIC——将 Transformer 架构直接硬编码进硅片,其他什么都不做。这与 Nvidia GPU(通用计算)以及 Groq LPU 和 Cerebras WSE-3(对更广泛 AI 负载优化但架构更灵活)形成根本性区别。
根据公司公布的数据,一颗 8 芯片的 Sohu 服务器在 Llama-70B 推理上可替代 160 颗 H100 GPU,号称速度快 15 倍、成本低 10 倍、能效高 9 倍。关键技术包括「低电压推理」(LVI)架构——将计算单元电压控制在大多数 AI 芯片的一半以下,使万亿参数稀疏 MoE 模型能在 80% 以上峰值算力持续运行而不触发热节流;以及「集群级内存」(CSM)——结合 HBM 和 SRAM 的混合架构,通过专有低延迟互联实现跨芯片快速内存访问。
公司表示其「前沿推理集群」已在运行 DeepSeek、Qwen、Mamba 和 Llama 等模型,第一批机架将于 2026 年夏季发货。公司已在圣何塞建设数据中心、测试工厂和 NPI 原型实验室,在台湾设立工厂,目标是 2027 年达到千兆瓦级部署。
从被所有人拒绝到 Hinton 站台
融资故事是硅谷经典反转。2022 年由三位哈佛辍学生——CEO Uberti、总裁 Wachen 和 Chris Zhu——创立,三人共同获得 Thiel Fellowship。2024 年种子轮由 Primary VC 和 Positive Sum 领投,Peter Thiel 等天使加入。此后急剧加速:2025 年 2 月完成 1.2 亿美元 A 轮,12 月以 50 亿估值完成 5 亿美元融资。到 2026 年 6 月,累计融资达 8 亿美元。最新投资方包括 VentureTech Alliance(标志着与 TSMC 的深度代工合作)、Jane Street、Hudson River Trading、Jump Trading、Two Sigma、Ribbit Capital 和 Stripes。
Hinton、Karpathy 和李飞飞三人覆盖了 AI 学术界的核心圈层,Druckenmiller 和 Thiel 代表顶级资本背书——这些人的共同下注表明,至少有一批最懂 AI 的人认为专用推理芯片是真实需求。
内存带宽:20 倍的承诺撞上物理墙
但 Etched 的性能声明目前全部来自公司内部模拟,未经独立验证——没有 MLPerf 基准测试,没有客户生产部署数据。
技术分析师提出的最核心质疑来自内存带宽。Sohu 搭载 144GB HBM3E,带宽约 4TB/秒,与 H100 基本相当。如科技分析网站 byteiota 指出,Transformer 推理是内存密集型而非计算密集型任务——「当带宽没有显著提高时,20 倍的性能提升在物理上是否可能?」这一问题至今没有公开的第三方答案。
Luxor Technology 旗下研究机构 Hashrate Index 在 5 月的深度报告中将 Etched 描述为「独立 AI 芯片公司中最集中的架构赌注」,并列出了四项具体风险:性能声明未经证实、架构集中度(若行业转向非 Transformer 架构则芯片报废)、与 Nvidia 争夺 HBM 供应、以及从零建设软件生态对抗已有 15 年积累的 CUDA。
Uberti 本人曾在接受 TechCrunch 采访时坦承这一风险:「如果 Transformer 过时了,我们设计一颗新芯片。」但如 byteiota 所评论的,这是一个「多年的、数十亿美元的重来」——Nvidia 的 GPU 可以从一种架构切换到另一种,ASIC 不能。
Hashrate Index 对风险的表述尤为直白:「这些风险都不会使 Etched 的论点失效。它们只是意味着这 50 亿美元的估值假设 Etched 能在一个特定且狭窄的结果走廊中执行到位。」
推理芯片正在成为独立资产类别
Etched 并非孤例。2026 年上半年,推理芯片赛道正在集体验证一个投资逻辑:
- Groq 于 2025 年 12 月以约 200 亿美元被 Nvidia 收购(永久 IP 许可加人才引进),Nvidia 在 GTC 2026 上展示了整合 Groq LPU 与 Vera Rubin GPU 的 LPX 机架系统——全球最有价值的芯片公司实质承认了专用推理架构的必要性。Groq 此后以独立主体融资 6.5 亿美元转型推理 neocloud。
- Cerebras 于 5 月 14 日完成 2026 年最大科技 IPO,融资 55.5 亿美元,首日市值约 564 亿美元。其晶圆级芯片 WSE-3 已获得 OpenAI 超过 200 亿美元的算力承诺和 AWS 的硬件部署协议。
- OpenAI 于 6 月 24 日与 Broadcom 共同发布了首款定制推理芯片 Jalapeno。
投名状
Etched 的隐身模式出口代表的不是一家公司的里程碑,而是推理芯片市场从边缘走向核心的结构性信号。从 Groq 被 Nvidia 以 200 亿收购,到 Cerebras 以 560 亿上市——资本正在为一种共识定价:谁掌握更便宜的推理,谁就掌握 AI 的最后一公里。
但 Etched 是这一共识中最极致的表达。如果 Transformer 继续统治 AI 架构 5 到 10 年,Sohu 将成为定义性的推理芯片;如果一个新的架构范式出现,它可能成为硅谷最昂贵的赌注。目前,性能声明未经核实、客户身份未公开、生产部署尚未开始——10 亿美元的合同订单是一张支票,兑现日期在夏天。