GPT-6 Sol/Luna开始拼性价比:Sol仅Opus 5.5半价
BiRun 讯,OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna,把 GPT-6 能力下放到更便宜的两档模型。Sol 主打复杂编码和专业工作,Luna 面向高频日常任务。API 每百万 tokens 分别为 Sol 输入 2 美元、输出 10 美元,Luna 输入 0.10 美元、输出 0.50 美元;相比 GPT-5.6 的促销价至少便宜 50%。同日发布的 Claude Opus 5.5 为 4 美元和 20 美元,Sol 的原始 token 单价正好只有一半。
OpenAI 公布的 AutomationBench 中,Sol 开 xhigh effort 得到 33.2%,高于 Opus 5 的 26.9%,单题成本仅 0.27 美元,约为后者的 9%。这里对比的是 Opus 5,不是刚发布的 Opus 5.5。DeepSWE v1.1 上,Sol 开 max 得到 68.8%,只比 Fable 5 的最高分低 1.1 个百分点,但单题成本低约 80%。
安全评测也有明显变化。在故意诱发模型虚报编码工作的测试中,Sol 的欺骗率从 GPT-5.6 Sol 的 10.4% 降到 1.3%,Luna 从 9.5% 降到 2.8%;GPT-6 Astra 为 0.5%。
两款模型已经进入 API、ChatGPT Work 和 Codex。Free 和 Go 用户可在桌面端使用 Luna,目前还没有进入 Chat。GPT-6 的缓存读取同时享受 90% 折扣,调整 reasoning effort 或开关工具也不会破坏此前缓存。
信源
动察 Beating 频道 · 动察 Beating 交流群。
OpenAI 公布的 AutomationBench 中,Sol 开 xhigh effort 得到 33.2%,高于 Opus 5 的 26.9%,单题成本仅 0.27 美元,约为后者的 9%。这里对比的是 Opus 5,不是刚发布的 Opus 5.5。DeepSWE v1.1 上,Sol 开 max 得到 68.8%,只比 Fable 5 的最高分低 1.1 个百分点,但单题成本低约 80%。
安全评测也有明显变化。在故意诱发模型虚报编码工作的测试中,Sol 的欺骗率从 GPT-5.6 Sol 的 10.4% 降到 1.3%,Luna 从 9.5% 降到 2.8%;GPT-6 Astra 为 0.5%。
两款模型已经进入 API、ChatGPT Work 和 Codex。Free 和 Go 用户可在桌面端使用 Luna,目前还没有进入 Chat。GPT-6 的缓存读取同时享受 90% 折扣,调整 reasoning effort 或开关工具也不会破坏此前缓存。
信源
动察 Beating 频道 · 动察 Beating 交流群。
评论
0/500
登录 后参与讨论
免责声明:本文内容仅供参考,不构成任何投资建议。
更多快讯