返回滚动近30天 Top30第013期 / 02
全球 / 大模型
GPT-6 Sol / Luna 发布,提示缓存与云交付同步扩展
Introducing GPT-6 Sol and Luna
Sol / Luna 进入 API、Codex 与 ChatGPT Work;Chat 内开放仍分阶段推进。
一分钟读懂
- Sol / Luna 进入 API、Codex 与 ChatGPT Work;Chat 内开放仍分阶段推进。
- 标准 API 每百万输入/输出 token:Sol 2/10 美元,Luna 0.10/0.50 美元;新增合格前缀的30分钟缓存。
- Sol标准API
- 输入2 / 输出10美元
- Luna标准API
- 输入0.10 / 输出0.50美元
- 计价单位
- 每百万token
发生了什么
OpenAI 于9月22日发布 GPT-6 Sol 和 Luna,提供不同成本与能力定位的选择。公告覆盖 API、Codex 和 ChatGPT Work;聊天入口仍按计划分批开放,不能把品牌下所有入口视为同一时间、同一权益。
标准 API 每百万输入/输出 token,Sol 为2/10美元,Luna 为0.10/0.50美元。同期缓存更新将符合条件的前缀缓存延长至30分钟,最高折扣需要满足相应条件,并不适用于全部请求。
AWS 随后确认这两个模型在 Bedrock 的交付。模型首发、缓存机制和新增云渠道属于同一轮进展;不同平台的价格、限额和地区需要分别核对。
为什么值得关注
更细的模型档位让同一工作流可以按任务难度选择成本。缓存只有在上下文能够复用、请求满足条件时才会带来收益。
我的观察
同时比较模型价格、缓存命中率与任务完成质量,才能判断真实成本。
可能带来的影响
按真实工作流比较成本
先区分输入、输出和缓存用量,再比较完成同一任务的总成本;模型标价不能直接代替成功完成任务的价格。
还不知道什么
不同账户、地区与渠道开放范围及实际任务成本需要分别核对。
发布方主张
官方称成本与工作表现改善;缓存最高90%折扣需要符合条件。
时间线
原始发布
Sol / Luna 进入 API、Codex 与 ChatGPT Work;Chat 内开放仍分阶段推进。
原始来源与查证用途 3 篇
OpenAI · 原始材料 · 2026-09-22Introducing GPT-6 Sol and Luna核对本文的发布、交付范围与限制;性能主张单列。OpenAI · 原始材料 · 2026-09-22Better prompt caching for GPT-6核对本文的发布、交付范围与限制;性能主张单列。aws.amazon.com · 原始材料 · 2026-09-22OpenAI GPT-6 Sol and GPT-6 Luna are now generally available on Amazon Bedrock - AWS核对本文的发布、交付范围与限制;性能主张单列。原始资料仅标注日期,不推定日内时刻。
收录:2026年9月27日 21:28 · 核验:2026年9月27日 21:46(UTC+8)
