AI前沿 | 2026年9月23日:GPT-6 Sol + Luna 腰斩定价 + 缓存工程化 + DeepSeek 腹地
AI前沿 | 2026年9月23日GPT-6 Sol Luna 腰斩定价 缓存工程化 DeepSeek 腹地首屏导读 · 本教程配套付费专栏《大模型工程师修炼手记》19.9 元AI 编程 · Agent 实战 · 本文同主题系统课程· 《AI时代程序员的自我提升》49.9 元AI 时代成长方法论单篇不过瘾订阅解锁全量源码、实战与答疑文末附资料包领取方式 ↓本期导读9 月 22 日美西周二在 Anthropic 发布 Claude Opus 5.590 分钟后OpenAI 发布 GPT-6 家族两位新成员GPT-6 Sol 和 GPT-6 LunaAPI 价格较 GPT-5.6 促销价直接腰斩 50%Sol $2/$10、Luna $0.10/$0.50官方口径为永久价并亮出三大工程杀手锏——缓存输入读取 90% 折扣、默认缓存命中率提升、推理强度/工具中途可调而不丢缓存。更重要的是Luna 的普通请求价$0.10/$0.50已经打进国产开源低价王 DeepSeek V4.1 Flash 的现金价格区间约 $0.14/$0.55闭源第一次在『白菜价』主场向开源发起正面对攻。本期拆五讲事件、产品分工、缓存经济学、独立评测与回撤、对工程团队的判断。一、事件Opus 5.5 发布 90 分钟后OpenAI 的『腰斩价』双模型落地美西时间 9 月 22 日Anthropic 先发 Claude Opus 5.5仅仅 90 分钟后OpenAI 宣布 GPT-6 Sol 与 GPT-6 Luna 上线——这是 GPT-6 世代首次成对发布也是 OpenAI 把『单任务成本』抬进发布会标题的第一次。关键事实关键项GPT-6 SolGPT-6 LunaAPI 名称gpt-6-solgpt-6-luna输入价每百万 Token$2原 $4$0.10原 $0.20输出价每百万 Token$10原 $20$0.50原 $1.20相对 GPT-5.6 促销价-50%-50%输出 -58%缓存读取折扣90%缓存写入溢价 1.25×90%定位复杂推理 / 编程 / 长程 Agent高频吞吐 / 规模化任务可用入口ChatGPT Work Codex付费用户 桌面应用 Free/Go 用户是否进入普通 Chat当日逐步放开当日逐步放开Altman 的定性『真正重要的指标是完成一项任务要花多少钱这一维度上市场没有产品能匹敌 Sol 和 Luna。』OpenAI 口径称降价源于缓存与推理底座架构的改进且是永久价格对比 GPT-5.6 是限时促销价、只保障到 11 月 21 日。二、分工Astra 守天花板Sol 走专业线Luna 走白菜线三款模型规则清晰Astra$10/$50守能力上限适合高价值、不可妥协任务Sol$2/$10承接主流专业任务与 Agent 工作流Luna$0.10/$0.50主打高频、专注型、规模化任务。三者共享 Astra 的训练方法论专业工作、事实准确性、编程、计算机操作、对齐能力同源下放。OpenAI 自测账本vendor-reported基准GPT-6 Sol最佳档GPT-6 Lunamax关键参照DeepSWE v1.168.8%max$2.74/任务66.6%$0.22/任务GPT-5.6 Sol 72.7%Claude Fable 5 69.9%AutomationBench33.2%xhigh$0.2720.7%max$0.04Claude Opus 5 max 26.9%成本高 11 倍Agents Last Exam56.4%max$2.9350.9%max$0.15Opus 5 最高 55.9%Sol 成本低约 60%OSWorld 2.0离线64.4%max$3.2552.7%max$0.27Opus 5 medium 60.3%Sol 成本约 1/6FrontierCode 1.149.3%max$2.1442.4%max$0.11Opus 5 medium 53.4%内部事实错误率约为 GPT-5.6 Sol 一半7.6%max—Luna max 在 DeepSWE 上 66.6% 追平 Sol 的 xhigh66.6%成本却只有其约 1/5——厂商自己给出的同门内卷都在暗示高吞吐 Agent 先去试 Luna max。三、缓存工程化比单价更值钱的是『命中率』这轮发布最容易忽略、却对 Agent 团队最值钱的部分是缓存体系升级缓存输入读取 90% 折扣Sol 缓存输入 $0.20、Luna 低至 $0.01配合默认缓存命中率提升长系统提示/Schema/历史上下文的复用成本趋近于零推理强度与工具中途可调不丢缓存调推理档位、开/关工具都保留此前缓存前缀开发者可设显式断点决定前缀在哪结束以优化复用范围可观测控制台能看到缓存比例、命中情况、哪些提示词没命中诊断工具解释 miss 原因外部佐证GitHub 称这些改进让Copilot 需要新鲜处理的提示词占比下降超过 50%。独立分析Digital Applied算得更细在 7:2:1 混合费率下 Luna 每百万 Token 约 $0.08但对库存缓存命中的工作负载有效输入价其实贴着 1 美分/百万。单价降 50%但 AA 观察到 Sol 的单任务输出 token 从 2.9 万升到 3.1 万、Luna 从 4.1 万升到 5.1 万——新品平均啰嗦两成任务级省钱约 60%还是要靠『更少的失败重试 更高的缓存』双引擎。四、独立评测视角智能分持平真正的进步是『每任务成本』Artificial Analysis 同日给出的独立读数比厂商口径克制得多指标AAGPT-6 SolGPT-6 LunaIntelligence Indexmax与 GPT-5.6 Sol大致持平48 分档与 GPT-5.6 Luna 持平37 分Coding Agent Index572Codex harness41-2 回撤单任务成本AA 智力指数$1.06上代 $1.99好近一半$0.07上代 $0.18好约 60%AA-Omniscience 幻觉率92%→60%拒答率 99%→83%93%→77%GDPval-AA v2.1-约100 Elo回撤-约75 Elo回撤Terminal-Bench 4.037→43—两个必须警惕的信号① 编码索引上 Luna 反而退 2 分SWE-Atlas-QnA 44% vs 49%、DeepSWE 64% vs 66%说明『便宜』与『顶级编码』不是同一件事②知识工作GDPval、AA-Briefcase两类回撤源于交付物更短、常漏 rubric 元素——OpenAI 自己把『回答略短、少价值低的细节』当卖点但对要『交报告』的严肃场景可能是减分项。把这两条记进迁移评估表。五、对工程团队的实战判断先测 Luna max 再做 Sol 路由在 OpenAI 自己的图表上Luna max 在四项 agentic 基准上都压过 Sol low且 DeepSWE 60.5-66.6% 区间内成本仅为 Sol 的 1/5 上下——你的第一版多模型路由可以直接『Sol高推理档→ Lunamax→ 批处理档』三档起步把『缓存命中率』提成一个 KPI90% 折扣 断点 可观测已齐主动设计『前缀复用策略』系统提示/Schema/长文档拆成稳定前缀的团队推理账单会出现两位数百分比以上的改善——这是纯工程红利不需要换模型DeepSWE 高分 ≠ 你们业务的满分独立评测显示知识工作效率回撤、Luna 编码分退步迁移前一定先在自己 20 条黄金业务用例上跑一遍对比尤其报告/合规/长文档类价格壁垒失效锁定换评估Luna 打赢的是『现金价』DeepSeek V4.1 Flash 的缓存命中价闲时低至 ¥0.02/百万输入仍是护城河——采购/选型必须把『我们工作负载的实测缓存命中率』写进价格比较表任何只比现金价的表格都是错的。启示GPT-6 Luna 的发布把『低价』从开源阵营的标志性资产重新定价成了『所有人都得做的必答题』——竞争的重心正式从『谁的分数高』漂移到『谁让完成任务的单位成本更低』。对创业者① 别急着换型号先做缓存与路由工程——它带来的账单降幅30-60%可能比你从 Sol 换 Luna 更多② 但独立评测的编码回撤与知识工作回撤提醒你『便宜』的底座必须配『贵的护栏』校验、拒答、审计才能用于严肃交付③ OpenAI 用『永久价 缓存可观测』重新定义了 API 经济学ToB 的你在对外报价 AI 能力时也值得把『命中率/路由/失败重试』写进你的 SLA 定价模型——这是下一个可以赢的差异化维度。来源OpenAI 官方公告2026-09-22/ TechCrunch2026-09-22/ AppSo2026-09-23/ 新智元2026-09-23/ Artificial Analysis2026-09-22/ Digital Applied2026-09-22/ The Decoder2026-09-22/ MacObserver2026-09-23/ Wccftech2026-09-22。本文为 AI 辅助整理的前沿解读事实以官方与权威媒体口径为准不构成任何投资建议。 延伸阅读 · 我的付费专栏觉得这篇文章对你有帮助我把同类主题的系统化内容沉淀成了付费专栏欢迎订阅支持持续输出专栏定价内容大模型工程师修炼手记19.9 元AI 编程 / Agent 深度实战AI时代程序员的自我提升49.9 元AI 时代成长方法论 一杯咖啡的价格换来系统化的知识体系你的订阅是我持续创作的最大动力。本文配套代码 / 资料包欢迎在评论区留言「求代码」我会私信发送完整资源