昨天,我们分享了GPT‑5.6⁠如何帮助自身更高效地运行⁠。今天,我们将这些成果传递给客户,通过降低GPT‑5.6 Luna⁠(在新窗口中打开)Terra⁠(在新窗口中打开)的价格,以及提升API中GPT‑5.6 Sol⁠的性能,让客户受益。这些更新共同帮助客户从投入AI的每一美元中获得更多价值,并在时间紧迫时更快行动。

从今天起,我们最快且最经济的模型GPT‑5.6 Luna将降价80%,而面向日常工作的均衡模型GPT‑5.6 Terra将降价20%。Luna和Terra的降价也反映在使用Codex和ChatGPT Work时,付费订阅的用量计算方式上。Luna为企业提供了一种更具成本效益的方式,以极高的质量处理大批量工作。它可以使用工具并完成多步骤工作流,使更广泛的AI应用能够大规模实际运行。

让先进智能更丰富、更实惠,是OpenAI确保AGI惠及全人类使命的核心。这些变化将这一承诺付诸实践。它们反映了我们在模型构建、服务和部署方式上多年来的改进。

我们还在API中推出了快速模式,取代了此前的优先处理服务。对于GPT‑5.6 Sol,快速模式现在比标准处理速度快达2.5倍,价格为两倍,智能水平不变。快速模式向后兼容:标记为优先的请求将自动使用快速模式。

1 / 6

将智能与结果匹配

高效使用AI始于结果。风险程度、错误成本、紧迫性和规模决定了智能、速度、可靠性和成本之间的正确平衡。这种平衡可能在工作流的每一步之间发生变化。

GPT‑5.6为企业优化这一等式提供了更大的空间。Luna提供的性能与一年前的尖端模型相当,而每项任务的成本约为其6%,速度则接近其九倍。根据Agents’ Last Exam的衡量,在专业工作上,Luna的表现优于Fable 5,而每项任务的估计成本低近99%。

在实践中,企业可以定义所需的结果和质量标准,然后使用评估来确定额外的智能在何处能显著改善结果,以及更快速、更低成本的处理在何处能提供相同的质量。例如,编码工作流可能使用Sol来解决不确定性并定义计划,然后使用Luna来实现明确指定的更改、编写和运行测试,并评估结果。另一个工作流可能需要不同的平衡。

GPT‑5.6系列扩展了这些选择的范围。企业可以在每个阶段应用最大限度的有用智能,同时为其创造的价值支付合适的价格。

实现这种灵活性始于让模型背后的每一层都更高效。

我们如何推进效率前沿

我们的效率优势来自于改进模型、运行模型的推理系统,以及将模型与工具和上下文连接起来的智能体框架。GPT‑5.6模型通过工作采取更直接的路径。更好的路由保持硬件高效运转,优化的生产软件更高效地生成令牌,更智能的上下文管理帮助智能体避免重复已完成的工作。这些改进共同使我们能够用相同的计算资源完成更多有用的工作,减少每个结果所需的时间、令牌和成本。

GPT‑5.6 Sol正越来越多地帮助我们找到并交付下一轮收益。在人类主导的流程中,Sol自主重写并优化了生产内核,设计并运行了数百次实验以改进令牌生成,并监控训练过程,在出现问题时进行干预。内核工作帮助将模型服务的端到端成本降低了20%,而其实验将令牌生成效率提高了超过15%。这项工作仍在继续,形成了一个更紧密的反馈循环:随着我们的模型改进并能够更自主地工作,我们提高效率的能力也在加速。了解更多⁠关于GPT‑5.6背后的工程细节。

为规模化构建的计算策略

满足对丰富智能的需求需要更多的计算资源和更高效的计算资源。我们正在构建一个有弹性的基础设施组合,并将每个工作负载匹配到最适合运行它的系统。这种方法支持性价比曲线的两端。在低成本端,新的Luna和Terra价格使大批量工作在更大规模上变得经济实惠。在前沿端,快速模式为API客户在响应时间重要时提供更快的Sol访问。

企业可以将更多AI融入日常运营,而不会在最重要的工作上牺牲速度。大规模文档分析、客户互动分类和常规实施可以变得经济实惠地广泛运行,而复杂的Sol工作负载在溢价合理时可以更快运行。

收益可以累积。在人类主导的流程中,更强大的模型帮助我们的技术团队找到下一代的改进,缩短了通往更好性能和更低成本的道路。我们的策略仍然专注于推进能力和效率,使每一代智能都能以更低的成本完成更多工作。

可用性和定价

GPT‑5.6 Terra和Luna仍然在ChatGPT Work、Codex和OpenAI API中可用。在ChatGPT Work和Codex中,Free和Go用户可以使用Terra,而Plus、Pro、Business和Enterprise用户可以选择Terra和Luna。

从7月30日起,API定价为Terra每百万输入令牌2美元,每百万输出令牌12美元;Luna每百万输入令牌0.20美元,每百万输出令牌1.20美元。Sol定价保持不变。ChatGPT和Codex的订阅价格和配额预算保持不变,而Terra和Luna的使用现在消耗更少的积分。定价变更将于今天晚些时候开始在AWS中推出。

GPT‑5.6 Sol的快速模式取代了API中的优先处理,并与Codex中的/快速对齐。现有的标记为优先的API请求将继续工作。查看完整的API定价详情。⁠

本文内容采集自官方网站,排版和翻译可能与原页面存在差异。

阅读官方全文