OpenAI 发布 GPT-6 Sol 与 Luna:API 价格减半,错误率大幅下降
OpenAI 正在把 GPT-6 世代的版图铺得更开。继本月早些时候发布旗舰模型 GPT-6 Astra 之后,这家公司又更新了体型更小的 GPT-6 Sol 与 Luna,两款新模型现已陆续上线,主打更低的使用成本与更少的事实性错误。
GPT-6 Astra 被 OpenAI 称作迄今最强、能力最全面的模型,在电脑操作、编程等多项任务上自诩“世界最佳”。按照官方说法,新一代 Sol 和 Luna 的价值在于把这种智能做得更省、更容易拿到手。
Sol 和 Luna 系列最早在今年早些时候推出,分别对应 OpenAI 模型体系中不同的档位。按官方说法,GPT-6 Sol 面向编程等需要复杂推理的任务;Luna 则服务于文书类工作,即目标明确、批量重复的场景。
这类工作包括归纳文档、提取信息,以及回答一些快速问题。换句话说,Astra 负责撑住能力上限,Sol 和 Luna 负责把日常调用接住。
这次更新最直接的卖点是便宜。OpenAI 称,6 系列模型的 API 调用价格为 5.6 系列 Sol 与 Luna 的一半,降价被归因于缓存与推理环节的改进。
对靠接口调用撑起产品的开发者和中小企业来说,这一刀砍得相当实在。模型能力固然重要,能不能把每次调用的成本压下来,往往才是产品能不能活下去的前提。
OpenAI 同时强调新模型在准确性上的提升。其内部事实性评估基于经过脱敏的真实对话,这些对话中用户曾标记模型出错。
在这套评估里,GPT-6 Sol 的出错次数约为前代的一半,相当于用更低的成本达到了 Astra 级别的可靠性。编码场景的错误率同样被指下降。
发布新模型时顺带压一压 Anthropic,几乎成了 OpenAI 的固定动作。这一次,OpenAI 反复表示 GPT-6 Sol 与 Luna 在任务处理上明显优于 Anthropic 的 Fable 和 Opus 等主力模型。
耐人寻味的是时间点:Anthropic 在 OpenAI 发布前 90 分钟刚刚推出 Opus 5.5,两家公司的发布节奏几乎贴在一起。
新版本 Sol 和 Luna 目前已在 ChatGPT Work 和 Codex 中面向大多数付费账户开放,同时进入 ChatGPT API。
Luna 还会出现在桌面应用,并向 Free 和 Go 用户提供。OpenAI 表示将在当天逐步把模型推送到 ChatGPT 的应用与网页端。
把接口价格直接对半砍,技术上的解释是缓存命中率提高、推理效率改善,商业上的算盘同样清楚。OpenAI 需要更便宜的模型去承接海量的轻量级调用,把独立开发者、初创团队和预算敏感的企业客户留在自己的生态里,再用调用规模摊薄算力开支。
模型分层也是同一套逻辑。Astra 负责能力和品牌形象,Sol 与 Luna 负责跑量,命名和版本号越来越密,客户挑模型本身就成了一门功课。对开发者来说,便宜与准确都是好事,但版本迭代越快,此前调好的提示词和评估流程就越容易被打乱。
Anthropic 抢在 90 分钟前发布 Opus 5.5,说明竞争已经落到分钟级。两家公司争的是同一批企业客户与开发者,价格、准确率、工具调用能力,每一项都被摆上台面直接比。谁能在同等价格下少犯错,订单就往谁那边走。
早几年我也折腾过接口调用,周末窝在出租屋的折叠桌前,写一个自动整理文档的小脚本,跑一次几百条数据,账单出来时手心直冒汗,盯着后台的用量条像看手机流量,测试样本删了又删。那点调用量搁今天,大概连一顿外卖都换不来。现在的小孩张口就让模型写整份报告,嫌慢还要催两句——反正价格砍了一半,浪费得起。挺好,便宜是真便宜了,就是不知道当年那个让我肉疼半天的脚本,如今还值不值得我重新打开编辑器。