OpenAI今天更新了ChatGPT,付费侧和免费侧都有变动。付费侧,Plus和Pro用户用到的Chat版GPT-5.6Sol被重新调优,并新增了一个控制“思考程度”的滑杆;免费侧,默认模型换成GPT-5.6Luna,文本对话不再限量,另外多了一个Think按钮用于需要更多推理的问题。
一个只在聊天场景里生效的Sol调优
这次更新的Sol有一个限定:它只在ChatGPT的Chat体验中可用,驱动Work和Codex的Sol版本不随之改动。也就是说,这是一次针对日常对话的定向调优。
调优的方向是“收敛”。
OpenAI称新版Sol会根据问题调整详略、避免不必要的格式堆砌,并在单纯附和无益时主动给出纠正——最后一条明显是在回应外界对模型迎合倾向的持续批评。
博客给出的对照案例里,旧版对“下班骑车会不会淋湿”给出了雨、风、温度、雾四段分述,新版则直接先答结论,再点明真正的变量是逆风而非降雨。
同时,Instant与深度推理由同一个模型驱动。OpenAI希望调高思考档位时的体验是“同一个模型想得更久”,而不是切换到另一个语气和风格都不同的模型。
滑杆已在网页、移动和桌面端向Plus、Pro用户开放。
62%与68%:一组来自内部评测的数字
事实准确性也是这次更新强调的重点之一。OpenAI给出的数据是,在一组涉及金融、医疗和法律、且需要具体事实的prompt上,回答中至少含一个事实性错误的比例,GPT-5.6Luna比GPT-5.5Instant低约62%,Sol低约68%。
需要说明的是,这是OpenAI的内部评测,题目数量、评分方式和错误判定标准均未公开,属于厂商自评口径。
免费无限量的前提,是Luna已经便宜了80%
要理解“无限量”为什么现在才出现,得把时间线往前拉一个月。
GPT-5.6于7月9日正式上线,分Sol、Terra、Luna三档,数字代表代际,名字代表能力档位。7月30日,也就是发布仅三周后,OpenAI下调了其中两档的API价格:Luna降价80%,至每百万token输入0.2美元、输出1.2美元;Terra降价20%;Sol价格不变。
很多评论者将其归因于企业客户对成本的敏感度上升,以及来自中国创业公司和其他大厂的竞争压力。
更关键的一点是定位变化。在此之前,Luna和Terra并不能在标准的ChatGPT对话中选用,它们只出现在Work、Codex和API里;Luna则被描述为面向分类、路由、摘要这类高吞吐低延迟任务的“效率档”。这次是它第一次成为普通用户日常对话的默认模型。
把降价和这次改动放在一起看,免费无限量与其说是姿态,不如说是单位成本降到了可以承受的位置之后的顺势之举。推理成本下降正在直接转化为免费层的服务形态。
适用范围与安全
无限量的适用范围需要看清楚:仅限文本对话,文件上传、图片和其他工具依然有额度限制,并且受滥用防护约束。免费和Go用户的Think按钮调用的是Luna而非Sol,两者不是一回事。GPT-5.6Luna本周成为默认模型,无限量对话和Think按钮则要等到下周。
安全方面,OpenAI在同步发布的系统卡中提到了针对疑似未成年用户的额外训练,包括避免恋爱式角色扮演和年龄限制类挑战、不把自身呈现为现实人际关系的替代品,以及在多个方向设置年龄适配的边界。模型还会在青少年可能需要支持时鼓励其联系可信任的人。OpenAI表示已为18岁以下用户新增了对应评测。
更多详情请访问刚更新的系统卡。
https://openai.com/index/improving-gpt-5-6-sol-in-chatgpt/
https://openai.com/index/gpt-5-6/
https://cdn.openai.com/pdf/GPT_5_6_August_Updates.pdf

相关文章

头条焦点
精彩导读
关注我们
【查看完整讨论话题】 | 【用户登录】 | 【用户注册】