8月21日OpenAI下调GPT-5.6 Sol价格,输入降20%、输出降33%并设期限

不错!点赞

简介

2026年8月21日,OpenAI将GPT-5.6 Sol的价格从每百万token输入5美元、输出30美元下调至输入4美元、输出20美元,缓存输入降至0.40美元,官方称该促销价至少持续到2026年11月21日。

2026年8月21日,OpenAI下调GPT-5.6 Sol的API价格:输入从每百万token 5美元降至4美元,输出从30美元降至20美元,缓存输入同步降到0.40美元。官方明确这是促销价,至少持续到2026年11月21日。输出端的降幅尤为关键,因为智能体应用的主要开销恰恰来自长回答与多轮工具调用。对正在评估是否把AI嵌入研发流程的团队来说,这是一次实打实的成本松绑,也让价格调整成为模型能力之外最直接的竞争手段。

一、事件速览

这次降价发生在GPT-5.6 Sol上线后不久,时间点选在8月21日,与OpenAI同日开放的可视化能力形成组合动作。降价覆盖输入、输出与缓存输入三类计费项,其中输出端的降幅最大。官方设定了明确期限:该促销价至少持续到2026年11月21日,而非永久性调整。同期市场上也有其他动作,Google的Gemini 3.7 Flash在OpenRouter上的价格下调约75%。多家厂商在同一时间窗口内压缩价格,说明这一轮并非个别产品的促销策略,而是行业性的成本重估。

二、关键数据与技术细节

  • 输入价格由每百万token 5美元降至4美元,降幅为20%,直接压低长提示词的边际成本。
  • 输出价格由每百万token 30美元降至20美元,降幅达到33%,是本次调整中力度最大的一项。
  • 缓存输入价格下调至每百万token 0.40美元,与常规输入的价差进一步拉大,鼓励复用上下文。
  • 官方称该价格为促销价,至少持续到2026年11月21日,之后是否延续尚未公布。
  • 同期Google的Gemini 3.7 Flash在OpenRouter上降价约75%,两家的动作形成直接对照。
  • 降价适用于GPT-5.6 Sol这一档位,与其面向Plus与Pro用户的定位相配合。

三、行业影响与解读

8月的普遍降价,让团队第一次有充分理由把AI更广泛地嵌入构建流水线、代码评审、客服自动化与内部工具。过去这些场景并非不能用AI,而是高频调用下的账单难以向上交代;当输出价格下降三分之一,许多原本被搁置的方案可以重新排期。更值得注意的是措辞上的变化:成本本身正在成为AI的产品特性。当一个模型既便宜又足够好,价格就不再只是财务问题,而是被写进产品宣传的卖点。对开发者来说,缓存输入低至0.40美元意味着合理的上下文复用设计能省下大笔费用,提示词工程的一部分工作,正在转向上下文缓存与复用策略。

四、值得关注的信号

  • 促销价带有明确期限,团队在排期时需为价格回摆预留预算空间。
  • 缓存输入与输出价格的差距拉大,上下文复用会成为标准优化手段。
  • 降价将推动AI从试点项目进入高频、常态化的工程与业务流程。
  • 价格竞争会向中低端档位蔓延,模型厂商的利润结构面临重塑。

小结:GPT-5.6 Sol的降价幅度并不温和,输出端33%的下调直接击中了智能体应用最花钱的部分。但促销价有截止日期,理性的做法是在窗口期内完成验证与迁移,同时把成本模型做成可调参数,而不是押注在某一个价格上。可以确定的是,成本正在从后台走到台前,成为AI产品竞争力的一部分。