OpenAI于7月31日宣布大幅下调GPT-5.6系列模型价格,其中GPT-5.6 Luna价格下调80%,GPT-5.6 Terra价格下调20%,此举引发AI行业价格战新格局。这是OpenAI通过提升系统效率实现的技术红利,缓存命中率从24%提升至90%,推理成本显著降低。

此次降价涉及GPT-5.6系列三档模型的定价调整:GPT-5.6 Luna输入价格从每百万token 1美元降至0.2美元,输出价格从6美元降至1.2美元,降幅达80%;GPT-5.6 Terra输入价格从2.5美元降至2美元,输出价格从15美元降至12美元,降幅20%;GPT-5.6 Sol价格不变,但新增Fast模式。
一、降价详情与技术支撑
OpenAI此次大幅降价的背后是系统效率的显著提升。通过优化推理架构和缓存机制,缓存命中率从24%提升至90%,大幅降低重复计算成本。这一技术突破使得Luna版本能够在保持智能水平的同时实现80%的降价。
GPT-5.6 Luna是该系列中速度最快、成本最低的模型,适合大规模、高频率任务处理。结合下调后的价格,智能体工作流的运行成本显著降低。OpenAI预计,ChatGPT和Codex中的自动审查成本将降至原来的约十分之一。
值得注意的是,旗舰型号GPT-5.6 Sol虽然价格不变,但新增Fast模式。该模式下推理速度最高可达标准模式的2.5倍,价格为标准模式的两倍,智能水平保持不变。Fast模式取代了此前的Priority Processing服务。
二、行业影响与竞争态势
此次降价对AI行业产生深远影响。首先,企业级AI应用的成本门槛显著降低,特别是需要高频调用的客服、数据分析等场景。其次,智能体应用的开发成本大幅下降,有利于Agent生态的快速发展。
然而,OpenAI也面临激烈的市场竞争。国产大模型如DeepSeek、Qwen等在价格和性能上持续追赶,部分模型已实现更低的token价格。OpenAI此次降价也被视为应对竞争压力的战略举措。
对于开发者而言,GPT-5.6系列的三档定价提供了更灵活的选择。Luna适合成本敏感型应用,Terra适合平衡性能与成本的日常工作,Sol适合需要顶级推理能力的复杂任务。Fast模式则为实时性要求高的应用提供了加速选项。
三、应用场景与使用建议
GPT-5.6 Luna的大幅降价使其成为高频调用场景的首选。企业客服系统、代码自动审查、数据分析报告生成等任务可充分利用Luna的成本优势。结合工具调用能力,可构建复杂的多步骤工作流。
对于需要深度推理的研究和策略分析任务,GPT-5.6 Sol仍是最佳选择。Fast模式适合紧急情况下需要快速响应的场景,但需承担双倍成本。建议在关键决策点使用Sol,常规任务交给Luna或Terra。
OpenAI表示,让先进智能变得更充裕、更易于负担,是其确保AGI惠及全人类这一使命的核心。此次降价是这一使命的具体体现,预计将推动更多企业和开发者接入GPT-5.6系列模型。


