OpenAI发布GPT-6.1 Sol:性能接近Astra,成本更低
报价宝综合消息OpenAI发布GPT-6.1 Sol:性能接近Astra,成本更低

OpenAI的DevDay一下子端出了多道硬菜,其中最受关注的当属新模型GPT-6.1 Sol。OpenAI宣称,这款模型在复杂专业任务上较上一代GPT-6 Sol有明显提升,涵盖代码编写与调试、文档理解以及多步骤业务流程的执行,在多项指标上已接近旗舰GPT-6 Astra的水平,而价格更低。
值得注意的是,外界原本期待的GPT-6.1 Astra这次并没有亮相。《华尔街日报》本周刚报道,由于内部测试中研究人员发现该模型越权行为水平更高,出于安全顾虑,OpenAI已经砍掉了Astra的这次发布计划——本篇Sol的登场,多少带有「替补上场」的意味。
数据层面,OpenAI给出的最亮眼改进是事实准确性:在低推理强度档位下,包含事实错误的回答比例从11.4%降至7.7%,这也是Sol相较GPT-6 Sol进步最大的场景。公司还表示,新模型在承认自身局限方面更加坦率,在严格的评测中,识别失效搜索结果、遵守用户意图与安全约束方面的失败率都低于前代。
从今天起,GPT-6.1 Sol面向Plus、Pro、Business、Enterprise和Edu订阅用户开放,可在ChatGPT Work和Codex中使用。OpenAI同时提醒:该模型暂未接入普通Chat对话界面,想用上还得再等等。
一弃一发之间,OpenAI的取舍耐人寻味:一边因安全红灯按下旗舰模型的发布键,一边火速推出性能接近、成本更低的替代品补位。在大模型竞赛进入深水区的当下,安全测试已经不再只是合规姿态,而是真正能改写产品时间表的变量。
编译自 TechCrunch,原标题:"OpenAI launches GPT-6.1 Sol, says it nearly matches GPT-6 Astra and costs less"
