5
这个用户还没有留下简介。
当前还没有回复,欢迎成为第一个参与讨论的人。
旗舰 Sol 维持原价并新增 Fast 模式,速度最高提升 2.5 倍
OpenAI 今日宣布下调 GPT-5.6 系列模型价格,即日起生效。此次调整覆盖系列中的轻量级与主力模型,旗舰模型价格保持不变,但新增了面向低延迟场景的 Fast 模式。
定位"最快最经济"的 Luna 模型降幅最大,达 80%。调整后 API 定价为每百万输入 token 0.20 美元、每百万输出 token 1.20 美元。这一价位使 Luna 更适合高并发、大批量的调用场景,例如内容分类、日志与工单解析、检索增强生成中的预处理环节,以及需要长期在线的自动化流程。
主打日常工作负载的 Terra 模型降价 20%,调整后每百万输入 token 2 美元、每百万输出 token 12 美元。Terra 面向的是介于成本敏感与能力要求之间的常规任务,例如文档撰写、代码辅助、客服对话与数据整理。
旗舰 Sol 模型价格维持不变,但新增 Fast 模式。该模式速度最高提升至标准模式的 2.5 倍,价格为标准模式的两倍,并取代此前的优先处理(priority processing)选项。对延迟敏感的交互式产品——实时助手、编程补全、语音与客服前端——可以按需在标准与 Fast 之间选择,无需再单独申请优先处理配额。
| 模型 | 输入(美元/百万 token) | 输出(美元/百万 token) | 降幅 |
|---|---|---|---|
| Luna | 0.20(原 1.00) | 1.20(原 6.00) | 80% |
| Terra | 2.00(原 2.50) | 12.00(原 15.00) | 20% |
| Sol(标准) | 不变 | 不变 | — |
| Sol(Fast) | 标准模式的 2 倍 | 标准模式的 2 倍 | 新增 |
注:原价按公布降幅推算。
对以 Luna 为主要模型的应用,五分之一的价格意味着同等预算下可支撑约五倍的调用量,此前因单位成本而搁置的批处理型功能具备了上线条件。使用 Terra 的团队可获得约 20% 的直接成本下降,无需改动代码。已在使用优先处理的团队需要留意接口变更,将相关调用迁移至 Sol 的 Fast 模式。