---
格式版本: 2
标题: "以 GPT-5.6 推进性价比前沿 | OpenAI"
原文链接: "https://openai.com/zh-Hans-CN/index/advancing-the-price-performance-frontier-with-gpt-5-6/"
发布日期: "2026-07-23"
发布时间校准状态: "provisional"
发布时间需复核: "是"
发布时间来源: "fallback:local:strict_original_body"
发布时间证据: "2026年7月23日"
发布时间校准原因: "LLM 仲裁服务异常，按现有强证据临时采用 2026-07-23，后续需复核"
发布时间校准置信度: "medium"
发布时间候选数量: 16
发布时间严格候选数量: 4
发布时间原页读取状态: "source template page reused from URL open"
发布时间未找到原因: ""
发布时间校准时间: "2026-08-10T16:21:33+08:00"
发布时间仲裁状态: "service-error"
发布时间仲裁尝试次数: 2
发布时间仲裁耗时毫秒: 45856
发现时间: "2026-08-10T16:18:32+08:00"
入库时间: "2026-08-10T08:22:19.311Z"
来源平台: "固定入口"
搜索渠道: "fixed_url"
搜索词: "https://openai.com/news/"
匹配关键词:
  - "performance"
  - "计算"
  - "部署"
  - "性能"
相关厂家:
  - "OpenAI"
  - "AWS"
相关专家:
  []
内容类型: "网页"
抓取工具: "CDP Render"
清洗工具: "CDP Text + Defuddle/Readability 正文提取"
原始附件:
  []
AI优质: "否"
AI打分: 45
AI分档: "非优质"
AI质检状态: "不通过"
AI打分理由: "内容为GPT-5.6模型定价与效率，不涉及超节点/AI Rack等硬件基础设施，与项目主题无关。"
AI质检模型: "deepseek-v4-flash"
AI质检时间: "2026-08-10T16:22:25+08:00"
AI主题相关性: 0
AI来源权威性: 15
AI新颖性: 20
AI技术细节: 0
AI商业部署信号: 0
AI完整性: 10
采集批次: "2026年8月10日15点37分56秒"
采集批次ID: "20260810-153756-703"
去重键: "https://openai.com/zh-Hans-CN/index/advancing-the-price-performance-frontier-with-gpt-5-6"
---

2026年7月30日

[产品](https://openai.com/zh-Hans-CN/news/product-releases/)

## 以 GPT‑5.6 推进性价比前沿

通过提高每一层的效率，OpenAI 正在为更多企业工作负载带来更高的单位成本性能。

昨天，我们介绍了 [GPT‑5.6⁠](https://openai.com/zh-Hans-CN/index/gpt-5-6/) 如何帮助自身 [提高运行效率⁠](https://openai.com/zh-Hans-CN/index/gpt-5-6-frontier-intelligence-efficiency/) 。今天，我们将这些收益回馈给客户：降低 API 中 GPT‑5.6 [Luna⁠](https://developers.openai.com/api/docs/models/gpt-5.6-luna) 和 [Terra⁠](https://developers.openai.com/api/docs/models/gpt-5.6-terra) 的价格，并提升 GPT‑5.6 [Sol⁠](https://openai.com/zh-Hans-CN/index/gpt-5-6/) 的性能速度。这些更新共同帮助客户提高每一美元 AI 投资的回报，并在时间紧迫时更快推进工作。

从今天起，我们速度最快、价格最低的模型 GPT‑5.6 Luna 将降价 80%；兼顾各方面、适合日常工作的 GPT‑5.6 Terra 将降价 20%。在 Codex 和 ChatGPT 工作中使用 Luna 和 Terra 时，付费订阅的用量计算方式也会相应体现此次降价。Luna 为企业提供了一种更具成本效益的方式，能够以极高质量处理大批量工作。它可以使用工具并完成多步骤工作流，让更多 AI 应用能够切实实现规模化运行。

让先进智能更加充裕且普惠，是 OpenAI 确保 AGI 惠及全人类这一使命的核心。这些调整将这一承诺付诸实践。它们体现了我们多年来在模型构建、部署服务和实际应用方面取得的改进。

我们还将在 API 中推出 **快速模式** ，以取代“优先处理”服务。对于 GPT‑5.6 Sol，快速模式现在能以标准处理两倍的价格提供最高 2.5 倍的速度，同时智能水平保持不变。快速模式向后兼容：标记为 priority 的请求将自动使用快速模式。

1 条/ 共 6 条

> “GPT‑5.6 Luna 让我们前所未有地接近“智能成本低到无需计量”的愿景。我从未见过价格如此低廉却又如此强大的模型——它正在帮助 Replit 解锁一些我们原以为很久以后才会开发的用例。”

Michele Catasta，Replit 总裁兼 AI 负责人

## 让智能水平与成果相匹配

高效使用 AI，要从预期成果出发。任务的重要程度、出错成本、紧迫性和规模，决定了智能、速度、可靠性与成本之间的适当平衡。这种平衡可能随工作流中的不同步骤而变化。

GPT‑5.6 为企业优化这一平衡提供了更大空间。Luna 的性能可媲美一年前的前沿模型，但每项任务的成本仅约为其 6%，速度则接近其九倍。根据 Agents’ Last Exam 对专业工作的评测，Luna 的表现优于 Fable 5，预计每项任务的成本低近 99%。

在实践中，企业可以先明确所需成果和质量标准，再通过评估判断哪些环节增加智能水平能显著改善结果，以及哪些环节可以使用速度更快、成本更低的处理方式达到同等质量。例如，编码工作流可以先使用 Sol 消除不确定性并制定计划，再使用 Luna 实施定义明确的变更、编写并运行测试，以及评估结果。其他工作流可能需要不同的平衡。

GPT‑5.6 系列进一步拓宽了这些选择。企业可以在每个阶段运用最具实用价值的最高智能水平，并为其创造的价值支付合理价格。

要实现这种灵活性，首先要提高模型背后每一层的效率。

## 我们如何推进效率前沿

我们的效率优势来自对模型、运行模型的推理系统，以及将模型与工具和上下文相连接的智能体执行框架的持续改进。GPT‑5.6 模型能以更直接的方式完成工作。更好的路由机制让硬件保持高效利用，经过优化的生产软件能更高效地生成 Token，而更智能的上下文管理则帮助智能体避免重复已完成的工作。这些改进共同帮助我们用相同的算力完成更多有价值的工作，减少取得每项成果所需的时间、Token 和成本。

GPT‑5.6 Sol 正越来越多地帮助我们发现并实现下一轮效率提升。在由人主导的流程中，Sol 自主重写并优化了生产内核，设计并运行了数百项实验以改进 Token 生成，还会监控训练并在出现问题时介入。内核方面的工作帮助模型端到端服务成本降低了 20%，相关实验则将 Token 生成效率提高了 15% 以上。这项工作仍在继续，并形成更紧密的反馈循环：随着模型不断改进并能更自主地工作，我们提升效率的速度也随之加快。 [详细了解⁠](https://openai.com/zh-Hans-CN/index/gpt-5-6-frontier-intelligence-efficiency/) GPT‑5.6 背后的工程技术。

## 面向规模化需求的算力战略

满足对充裕智能的需求，既需要更多算力，也需要提高算力产出。我们正在构建具有韧性的基础设施组合，并为每项工作负载匹配最适合运行它的系统。这种方法能够兼顾性价比曲线的两端。在低成本端，Luna 和 Terra 的新价格让大批量工作能以经济可行的方式实现更大规模运行。在前沿端，响应时间至关重要时，快速模式让 API 客户能够更快地使用 Sol。

企业可以将更多 AI 引入日常运营，同时不牺牲最关键工作所需的速度。大规模文档分析、客户互动分类和常规实施工作可以更经济地广泛运行；对于复杂的 Sol 工作负载，如果额外成本合理，则可以更快处理。

这些收益可以不断叠加。在由人主导的流程中，能力更强的模型可以帮助我们的技术团队发现新一代改进，缩短实现更高性能和更低成本的路径。我们的战略仍将专注于同步提升能力与效率，让每一代智能都能以更低成本完成更多工作。

## 可用性与定价

GPT‑5.6 Terra 和 Luna 将继续在 ChatGPT 工作、Codex 和 OpenAI API 中提供。在 ChatGPT 工作和 Codex 中，Free 和 ChatGPT Go 用户可以使用 Terra；ChatGPT Plus、ChatGPT Pro、Business 和 Enterprise 用户可以选择 Terra 和 Luna。

自 7 月 30 日起，Terra 的 API 价格为每百万输入 Token 2 美元、每百万输出 Token 12 美元；Luna 则为每百万输入 Token 0.20 美元、每百万输出 Token 1.20 美元。Sol 的价格保持不变。ChatGPT 和 Codex 的订阅价格与配额预算保持不变，但使用 Terra 和 Luna 现在会消耗更少的额度。定价调整将于今天晚些时候开始在 AWS 中逐步推出。

GPT‑5.6 Sol 的快速模式将在 API 中取代“优先处理”，并与 Codex 中的 /fast 保持一致。现有标记为 priority 的 API 请求将继续正常工作。 [查看完整的 API 定价详情。⁠](https://openai.com/zh-Hans-CN/business/pricing/#api)

## 继续阅读[Improving GPT‑5.6 Sol in ChatGPT—and expanding access to GPT-5.6 Luna for free users](https://openai.com/index/improving-gpt-5-6-sol-in-chatgpt/)

[

产品

](https://openai.com/index/improving-gpt-5-6-sol-in-chatgpt/)[New ways to learn and teach with ChatGPT Work and Codex](https://openai.com/zh-Hans-CN/index/learn-teach-chatgpt-work-codex/)

[

产品

](https://openai.com/zh-Hans-CN/index/learn-teach-chatgpt-work-codex/)[在 ChatGPT 中推出“健康”功能](https://openai.com/zh-Hans-CN/index/health-in-chatgpt/)

[

产品

](https://openai.com/zh-Hans-CN/index/health-in-chatgpt/)
