返回文章中心

HUANLING EDITORIAL

GPT‑5.6 推动性价比迈向新前沿

Advancing the price-performance frontier with GPT-5.6

昨天,我们分享了具体方法GPT-5.6帮助自己形成运行更高效.如今,我们将这些收益转化给客户,提供GPT-5.6的更低价格 Luna以及Terra以及 GPT-5.6 的更快性能太阳系在 API 中。这些更新共同帮助客户从每一美元投入的人工智能中获得更多收益,并在时间紧迫时加快行动速度。

从今天起,我们最快且最实惠的模型GPT-5.6 Luna价格将降低80%,而我们日常工作的平衡模型GPT-5.6 Terra价格将降低20%。Luna和Terra的较低价格也反映在使用Codex和ChatGPT Work时,使用量与付费订阅的计入方式。Luna为企业提供了一种更具成本效益的方式,以高质量处理大量工作。它可以使用工具并完成多步骤工作流程,使得更广泛的人工智能应用能够实现大规模运行。

评价:

“我们专注于在所有工作中最大化每美元的成本,GPT-5.6系列在这方面是重要的进步。Terra和Luna在内部编码基准中引领成本效益,Luna现已成为我们后台代理自动化的默认模型。”------Shaiyon Hariri,Ramp SWE-Bench的创始人

“GPT-5.6 Luna是我们迄今为止最接近廉价无法衡量的智能。我从未见过如此实惠的型号却如此强大——它正在为我们长久未曾预料到的Replit开启了更多应用场景。”------Michele Catasta,Replit 人工智能总裁兼负责人

“GPT-5.6 Terra 非常适合 Notion 个人代理中的日常工作,包括工作区问答和延迟重要的任务范围。在我们的评估中,它以每项任务一半的成本和60%的时间,交付了与GPT-5.5相当的质量。”------Hoda Noorian,人工智能产品,Notion

“GPT-5.6 Luna 是自从 GPT-4o mini 投入生产以来,我们在智能行为方面最大的一次转变。Luna将我们从单一的结构化输出调用转变为完整的工具调用代理循环,将提示缓存的重用率从24%提升到90%。在数千次生产调用中,Luna处理了更多的上下文×但输出令牌数减少了8.5×——成本比GPT-5.4 mini低了87%。”------Sid Pardeshi,技术官 + Blitzy 联合创始人

“GPT-5.6 Luna 是大型模型的理想配对程序员,处理大部分常规工作,同时在成本与智能之间取得理想平衡。我们将Luna整合进Devin Fusion,旨在为用户带来显著的成本节约,同时不牺牲质量。”------Walden Yan,Cognition联合创始人兼首席产品官

“自从 GPT-5.6 Luna 采用以来,我们已经见证了显著的运营改进。在相同的代理任务下,GPT-5.6 Luna 比我们之前的默认模型快了 40%,成本降低了 40%,从而为用户带来了更灵敏的体验。它在质量、速度和效率之间取得了极佳的平衡。”------斯坦尼斯拉斯·波卢,Dust联合创始人兼首席技术官

将智能与结果匹配

高效使用人工智能始于结果。风险、错误成本、紧迫性和规模决定了智能、速度、可靠性和成本之间的平衡。这种平衡可能会随着工作流程的每个步骤而变化。
GPT-5.6为企业提供了更多空间来优化这一等式。Luna的性能可与一年前的Frontier级车型相当,每项任务约6美分,速度几乎是前者的九倍。在专业工作中,根据特工最后考试,露娜的表现优于《寓言5》,每任务成本估计低近99%。
实际上,企业可以定义所需的结果和质量标准,然后通过评估判断哪些地方需要额外情报实质性提升结果,哪些地方能通过更快、更低成本的处理实现相同质量。例如,一个编码工作流程可能用 Sol 解决不确定性并定义计划,然后用 Luna 实现明确指定的更改,编写和运行测试,并评估结果。另一种工作流程可能需要不同的平衡。
GPT-5.6家族扩展了这些选择的范围。企业可以在每个阶段应用最大有用的智能,同时为其创造的价值支付合理价格。
实现这种灵活性始于让模型背后的每一层都更加高效。

我们如何推进效率前沿

我们的效率优势来自于改进模型、运行它们的推理系统,以及将模型与工具和上下文连接起来的智能动力。GPT-5.6模型通过工作走得更直接。更好的路由保持硬件高效,优化的生产软件更高效地生成令牌,更智能的上下文管理帮助代理避免重复完成的工作。这些改进让我们能够用相同的计算完成更有价值的工作,减少每个结果所需的时间、代币和成本。
GPT-5.6 Sol 正越来越多地帮助我们发现并实现下一轮收益。在人类主导的过程中,Sol 自主重写和优化生产内核,设计和运行数百个实验以提升令牌生成,并监控训练,在出现问题时介入。内核工作帮助将模型的端到端成本降低了20%,而其实验则使令牌生成效率提升了15%以上。这项工作持续进行,形成更紧密的反馈循环:随着模型的改进和更自主的工作,我们提升效率的能力也会加快。

一种为规模设计的计算策略

满足对丰富智能的需求既需要更多的计算量,也需要更高的生产力计算。我们正在构建一个有弹性的基础设施组合,并将每个工作负载与最适合运行的系统匹配。这种方法支持了性价比曲线的两端。在较低成本端,新的Luna和Terra价格使得大规模大量工作变得经济实惠。在前沿端,快速模式为API客户在响应时间重要时更快访问Sol。
企业可以在不牺牲最重要工作速度的前提下,将更多人工智能引入日常运营。大规模文档分析、客户交互分类和常规实施可以变得经济且广泛运行,而复杂的Sol工作负载在溢价合理时也能更快处理。
收益可以累积。在人主导的流程中,更强大的模型帮助我们的技术团队寻找下一代改进,缩短了实现更好性能和降低成本的路径。我们的战略依然专注于提升能力和效率,使每一代智能都能以更低的成本完成更多工作。

供应与定价

GPT-5.6 Terra 和 Luna 仍可在 ChatGPT Work、Codex 和 OpenAI API 中使用。在 ChatGPT Work 和 Codex、Free 和 Go 用户可以访问 Terra,而 Plus、Pro、Business 和 Enterprise 用户可以选择 Terra 和 Luna。
从7月30日起,Terra的API定价为每百万输入代币2美元,输出代币12美元,Luna每百万输入代币0.20美元,输出代币1.20美元。Sol价格保持不变。ChatGPT和Codex的订阅价格及配额预算保持不变,而Terra和Luna的使用现在消耗的信用点也减少了。AWS的定价变更将于今天晚些时候开始推送。
GPT-5.6 Sol的快速模式取代了API中的优先处理,并与Codex中的/fast对齐。标记为优先级的现有API请求将继续正常工作。
出自 OpenAI 官方网站的 News 栏目,不是第三方媒体。
GPT‑5.6 推动性价比迈向新前沿 内容图片 1

继续阅读

更多来自幻灵AI的文章

2026年07月23日

经典模式定档7月30日,经典·战斗之夜 8月2日登场

阅读全文 →
2026年07月23日

《蜘蛛侠:崭新之日》定档7月29日 全球领先上映彼得·帕克被世界遗忘后孤身重生

阅读全文 →
2026年07月23日

Grok 又多了一個中間訂閱層級:SuperGrok Plus

阅读全文 →