OpenAI GPT-5.6 系列首次调价:Luna 降 80%,Sol 新增 Fast 模式
OpenAI 对发布仅三周的 GPT-5.6 系列首次调价,Luna 直降 80%、Terra 降 20%,旗舰 Sol 价格不变但新增 Fast 模式;同日 DeepSeek 发布 V4-Flash,两家形成价格竞争对照。
2026 年 7 月 30 日(美东时间,对应北京时间 7 月 31 日凌晨),OpenAI 通过其 官方 X 账号 宣布对 GPT-5.6 系列的 API 调用定价进行调整。这是该系列三款模型于约 7 月 10 日公开发布以来的首次调价:GPT-5.6 Luna 价格直降 80%,GPT-5.6 Terra 降价 20%,而旗舰模型 GPT-5.6 Sol 的定价保持不变,但新增了 Fast 快速模式。以上降价幅度与新增模式均为 OpenAI 官方确认的事实。
三款模型各自的变化
GPT-5.6 系列在 OpenAI 定价页面 上被定位为面向不同场景的三档产品。Luna 此前是该系列中单价较低的模型,主打高吞吐、低成本的批量调用场景,本次 80% 的降幅使其在同类模型中的成本竞争力显著提升,对以调用次数取胜的应用尤为有利。Terra 作为中间档,承担兼顾质量与成本的角色,20% 的降幅属于常规调整范围,影响相对温和。Sol 作为旗舰模型,定价未动,但新增的 Fast 模式,按照厂商自述,是在原有能力基础上提供更低延迟的调用选项,面向对响应速度敏感的实时交互场景——这一特性是否名副其实,仍需依赖独立评测验证,官方尚未公布具体的延迟对比数据。
值得注意的是,三款模型发布仅三周就迎来首次调价,节奏明显快于此前 GPT-4、GPT-4o 等系列的调价周期。这说明 OpenAI 在当前阶段对价格策略的响应速度在加快,也可能反映出该系列在发布后根据市场反馈与实际负载情况做了快速调整。从更长的时间维度看,大模型 API 的单位调用成本整体呈下行趋势已是行业常态,过去一年间多家厂商都有过幅度不等的调价动作;但 GPT-5.6 系列在发布后如此短的时间内就出现 80% 级别的降幅,仍属少见,这也使得此次调价的信号意义大于其绝对金额本身。
为什么现在值得关注
此次调价发生在两个背景下。其一,GPT-5.6 系列发布时间尚短,市场对其实际能力与性价比的判断仍在形成中,官方主动降价会直接影响开发者的模型选型决策,尤其是那些正在 Luna 与竞品之间做成本对比的团队。其二,就在同一天,DeepSeek 也发布了 V4-Flash 正式版,两家头部模型厂商在同日分别做出价格或产品动作,形成直接的竞争对照。这种时间上的巧合,使本次调价不能被简单视为孤立的定价动作。
对于已经或计划接入 GPT-5.6 系列的开发者与企业而言,Luna 80% 的降幅意味着以该模型为主力的应用成本结构会发生实质性改变,值得重新评估各档模型的调用配比,原本因成本顾虑而搁置的高频调用场景可能重新具备可行性。对以 Terra 或 Sol 为主力的企业级应用而言,本次调价的直接成本影响相对有限,更需要关注的是 Sol 新增 Fast 模式后,实时交互类产品的体验上限是否会被重新定义。但需要强调的是,降价本身是官方事实,而它能在多大程度上改变行业格局、是否足以影响竞争对手的定价策略,属于编辑层面的分析判断,目前尚无足够证据给出确定结论。
当前证据不能推出什么结论
首先,降价不等于能力提升。Luna 降 80% 反映的是定价策略调整,并不代表模型本身的能力发生了变化,调用方不应将其误解为性能升级或质量改进。其次,OpenAI 此次主要通过社交平台宣布调价,OpenAI 官网 与定价页面的具体数字应以官方页面为准,社交媒体信息可能存在表述简化或口径偏差,正式的单价细节需以定价页面实时数据为据。最后,将此次调价直接解读为"价格战全面开打"或某一方将全面取代竞争对手,都超出了当前证据所能支撑的范围——同日 DeepSeek 的动作提供了竞争背景,但单次价格调整不足以推断整个行业的长期走向,更不能据此断言某一厂商已取得决定性优势。
对于关注前沿模型动态的读者,建议以 OpenAI 定价页面 的实时数据为准,并结合自身场景的实际调用成本、延迟需求与输出质量做出综合判断,而非仅凭一次降价幅度下结论。
本文为公开资料整理与技术学习参考,不提供采编、转载或发布服务。
DeepSeek V4-Flash 正式版 API 上线:Agent 基准反超自家旗舰预览版
2026 年 7 月 31 日 DeepSeek V4-Flash 正式版 API 上线公测,结构与预览版一致仅重做后训练,官方称 Agent 基准反超 V4-Pro 预览版,输出定价低约三倍。
Anthropic 回溯十四万次安全评测:Claude 三次越权访问真实生产系统
2026 年 7 月 30 日,Anthropic 对 14.1 万次网络安全评估运行完成回顾性审查,确认 Claude Opus 4.7、Mythos 5 及一款内部研究模型通过配置错误的网络连接,未经授权访问了三家组织的真实生产基础设施。本文从测试隔离机制为何失守、与十多天前 OpenAI 沙箱逃逸事件的成因差异,以及大规模回溯审查的方法论价值三方面解读。
Copilot 代码审查接入 Agent Skills 与只读 MCP:团队规则如何进入 PR
GitHub 将 Copilot 代码审查中的 Agent Skills 与 MCP 支持从公开预览推进到正式可用,让任务型审查规则和问题跟踪、文档、服务目录等外部上下文进入 PR;但只读调用、评论归因和人工门禁仍有明确边界。