OpenAI 今天更新了 ChatGPT 的模型矩阵,包含两个重要变化:GPT-5.6 Sol 调优了回复风格和事实准确性,GPT-5.6 Luna 对免费用户开放了无限文本聊天和一个"Think"按钮。
先说重点数据。
在新的内部评估中,金融、医疗和法律三类需要事实准确性的 prompt 上,GPT-5.6 Luna 的回复包含至少一个事实错误的概率比 GPT-5.5 Instant 低了 62%,GPT-5.6 Sol 低了 68%。这个评估的门槛是"至少一个事实错误"——也就是说,在需要精确引用的场景下,错误率大幅下降。
Sol 的更新围绕三个方向:更聚焦的回复、更可靠的事实、以及更一致的体验。具体来说,Sol 现在会根据问题的复杂度自适应回复的详细程度,避免不必要的格式和冗余信息。对于快速提问,给直接答案;对于多步规划、研究或写作,给完整回复但保持主线清晰。

Plus 和 Pro 用户还会在 ChatGPT 界面上看到「effort slider」——一个滑块,可以调节模型投入的思考量。快问快答拨到左边,需要深度推理解码或写作时拨到右边。底层的模型都是同一个 Sol,不再区分 Instant 和 Thinking 两个体验。
但免费用户这边才是真正的大变化。
GPT-5.6 Luna 成为免费用户的默认模型,文本聊天不再有次数限制。更难的问题上,免费用户可以用一个 Think 按钮让 Luna 投入更多推理时间。

虽然 OpenAI 把最好模型下放到免费版获得了许多好评,但不少用户表示模型选择复杂度失控了。"模型和推理级别的可能组合大约有 15 种,但对于任何具体任务该用哪个,没有一个令人满意的解释。"
这确实是个问题。当 OpenAI 把模型矩阵越铺越密——Terra、Sol、Luna,加上不同的 effort level,再加上 Codex、Work 等专用版本——用户面对的不再是"选哪个模型好",而是"我到底该选哪个"。
回到 OpenAI 的公告本身。有一句话值得注意:"因为这一版 GPT-5.6 Sol 为日常对话优化,它只在 ChatGPT 的 Chat 体验中可用。驱动 Work 和 Codex 的 Sol 版本不受此次更新影响。"
这意味着 OpenAI 在明确切分模型的产品线:Chat 内的 Sol 是"对话优化版",Work 和 Codex 里的 Sol 是"任务优化版"。同一个模型名,不同的调优方向。这解释了为什么要有 15 种组合——不是模型多,是同一个模型在不同场景下的调优版本不同。
参考来源: