8月6日,OpenAI宣布三项相互关联的ChatGPT更新:免费用户获得无限文本聊天权限,默认模型从GPT-5.5 Instant升级到GPT-5.6 Luna;免费用户新增Think按钮用于深度推理;付费用户获得一个可调节模型「思考强度」的滑块。三项变化指向同一个转折——当推理成本降到足够低,限制免费用户聊天次数不再是最优策略,真正的付费壁垒变成了「模型在回答时愿意花多少算力去思考」。
从限量到无限:GPT-5.6的成本曲线
这不是OpenAI第一次向免费用户开放更好的模型。2025年初o3-mini免费、2025年夏季GPT-5免费、2026年2月GPT-5.5-Instant默认——每一次都是模型效率提升后向下渗透。但「无限文本聊天」是第一次让免费层在文本这一核心能力上取消了用量天花板。
背后的成本变化是具体的。GPT-5.6家族于7月9日正式GA,Luna作为三档中最轻量的模型,API定价为每百万token输入$1、输出$6。三周后的7月30日,OpenAI将Luna的API价格再砍80%。按照这个定价,一个免费用户即使每天聊50轮、每轮2000个token,OpenAI的服务成本也不到几美分——而一个免费用户在生态内的留存价值和潜在的付费转化预期远超这个数字。
对照竞争格局,Luna的免费无限供应构成了一种防御性进攻。Anthropic的Claude免费层提供Sonnet 4.6模型,但每5小时仅约15至40条消息,高峰期优先保障付费用户。Google的Gemini免费层以3.6 Flash为默认,配合有限的3.1 Pro配额。只有DeepSeek走的是真正的免费无限路线,而其V4模型在中国以外市场的影响力和分发渠道无法与ChatGPT的10亿周活用户相比。OpenAI选择在文本这一最高频场景上拆除付费墙,等于是告诉竞品:别想用「免费」撬走我的用户。
Think按钮与思考滑块:新的付费逻辑
免费层无限制的边界在哪里?OpenAI的答案是:在「文本」和「思考深度」之间切开一条线。文件上传、图像分析、语音对话、图片生成——这些涉及多模态计算和更高推理开销的功能仍然受限。更关键的设计是Think按钮:免费用户可以在复杂问题上点击Think,让Luna花费更多推理token来给出更好的回答,但这个「更多」是系统预设的固定档位。
付费用户的思考强度滑块才是这个产品设计的完整形态。Plus和Pro用户可以从「快速回答」拖到「深度推理」,自主决定模型为每个问题投入多少算力。OpenAI同时还为付费用户提供了重新调优的GPT-5.6 Sol——它与免费层的Luna是同一代模型族,但经过了针对日常对话的特化训练,能给出更聚焦、更少冗余格式的回答,并且在OpenAI内部评估中事实错误比GPT-5.5 Instant低68%。
这意味着产品分层的轴线转了90度。过去是「不同模型→不同价」:免费用户用GPT-3.5,付费用GPT-4,后来是GPT-4o mini vs GPT-4o,GPT-5.5 Instant vs GPT-5.5。现在是「同一模型→不同思考深度→不同价」。Luna和Sol的代际相同(都是GPT-5.6家族),但思考算力的分配权从OpenAI手里交到了用户手里——前提是付费。
这个设计中有一个值得注意的细节:为Plus和Pro调优的GPT-5.6 Sol只用于ChatGPT的Chat体验,Work和Codex中的Sol版本保持不变。这意味着OpenAI将消费级对话和企业级编程场景的模型路线做了分离——Chat场景追求更简洁的交互体验,Work/Codex场景需要更完整的推理链和工具调用能力。两个场景的优化方向不同,不能再使用同一版模型。
未完成的地方
OpenAI声称GPT-5.6 Luna和Sol相比GPT-5.5 Instant,在金融、医疗和法律类prompts上的事实错误分别减少了62%和68%。这是OpenAI内部评估的结果,具体的测试集、基线设定和评估方法均未披露。在没有独立验证之前,这个数字只能理解为OpenAI自己设定的改善目标,而非已被证实的性能提升。
「无限」本身也有限定条件。OpenAI在公告中加入了一句「subject to abuse guardrails」——这意味着系统在检测到滥用模式时仍可施加限制。什么是滥用、触发阈值是多少,都没有明确定义。
更根本的不确定性在于经济可持续性。Luna目前的API定价(降价80%后)是面向开发者和企业客户的商业价格,OpenAI为免费用户提供无限文本聊天的实际服务成本可能高于或低于这个价格,取决于基础设施效率、负载分布和用户实际使用强度。短期内,以ChatGPT超过10亿的周活用户基数,即使只有一小部分免费用户因无限聊天而显著增加用量,新增的推理负载也可能吃掉预期的成本优势。
从「聊多少次」到「想多深」
这次调整的真正信号不在免费层本身,而在产品分层的演变方向上。2023年,ChatGPT免费用户面对的是模型代差(GPT-3.5 vs GPT-4)和严苛的用量限制。2024至2025年,模型代差逐步缩小,用量限制逐步放宽。2026年8月,文本聊天的用量限制归零,模型不再是隔代产品,付费的作用从「让你能用更好的模型」变成了「让同一个模型为你花更多时间思考」。
对于OpenAI的竞争对手,这个转变的意义超过了降价本身。当行业领头羊把免费层的核心竞争力从「有限使用一个好模型」升级为「无限使用一个当前代模型」,所有还在用量限制上做文章的免费层策略都显得落后了一个代际。下一个需要回答的问题是:当文本聊天的边际成本趋近于零,多模态交互——语音、视觉、实时视频——的免费化还有多远。

