8 月 6 日,OpenAI 在官方博客宣布两件事,一是更新 ChatGPT 中的 GPT-5.6 Sol,Plus/Pro 用户当天就能用上新的推理力度滑块;二是 GPT-5.6 Luna 将在本周内成为免费版和 Go 用户的默认模型,下周起取消文字对话额度限制。Sam Altman 也在 X 上同步发了消息。(来源:OpenAI 官方博客,2026-08-06)
今早打开 X,Sam Altman 发了一条中文动态,「5.6 版本中,Sol 在聊天中的表现好多了,免费用户还能享受无限量文字聊天!」
OpenAI 官方账号也同步发了公告视频,配文写得很直白,GPT-5.6 Sol 已为 Plus 和 Pro 用户同时提供即时推理与深度推理,Free 和 Go 用户从明天起可以用 Luna 进行无限次文本对话。

GPT-5.6 系列在 7 月 9 日发布,7 月 31 日 Luna 降价 80%、Terra 降价 20%,到 8 月 6 日 Sol 更新、Luna 分阶段免费开放,不到一个月内连续两轮大动作。如果你在用 GPT-5.5 或更早的模型,或者正在评估 API 成本,这几轮更新直接关系到选型和账单。但降价不等于「现在最便宜」,本文也会把 GPT-5.6 和 DeepSeek 的实际成本摆在一起看。

GPT-5.6 三款模型,分别干什么
OpenAI 把 GPT-5.6 拆成三档,不是简单的「大中小杯」,而是按任务类型分工。名字也起得有意思,Sol、Terra、Luna,太阳、大地、月亮,大小关系一目了然。


GPT-5.6 Sol 是旗舰,定位复杂推理、专业编程和高难度分析。8 月 6 日起,Plus 和 Pro 用户可以在 ChatGPT 中使用更新后的 Sol 和新增的推理力度滑块,在快速回答和深度思考之间切换,事实错误率较 GPT-5.5 Instant 降低约 68%(数据来源:OpenAI 官方博客,2026-08-06)。需要注意的是,这次更新只针对 ChatGPT 里面向日常聊天的 Sol,Work 和 Codex 里的 Sol 版本不受影响(OpenAI 原文:「The version of GPT‑5.6 Sol that powers Work and Codex is not changing as part of this release.」),也就是说通过 API 调用的 gpt-5.6-sol 同样不受此次 ChatGPT 端更新影响,价格和能力仍以 7 月 31 日的调价为准。Sol 同时新增 Fast mode,速度最高提升 2.5 倍,价格为标准模式的 2 倍(数据来源:OpenAI 官方公告,2026-07-31)。
GPT-5.6 Terra 是日常主力,适合常规开发、内容生成、数据处理。7 月 31 日降价 20% 后性价比进一步提升。Notion 把 Terra 用在个人智能体的日常问答和延迟敏感任务上,实测以 GPT-5.5 一半的单任务成本、少 60% 的耗时做到相当质量(数据来源:OpenAI 官方博客客户证言,2026-07-30)。
GPT-5.6 Luna 是轻量版,速度最快、价格最低,但并非传统「小模型」。Luna 能调用工具、处理长上下文、执行多步工作流,事实错误率较 GPT-5.5 Instant 降低约 62%(数据来源:OpenAI 官方博客,2026-08-06)。7 月 31 日降价 80% 后,API 输入价格降至 $0.20/百万 token。按 OpenAI 公告的节奏,Luna 将在本周内(8 月第一周)成为 ChatGPT 免费版和 Go 用户的默认模型,下周起取消文字对话数量限制,但仍受防滥用机制约束,文件上传、图片等功能限额不变(数据来源:OpenAI 官方博客,2026-08-06)。Ramp 已经把 Luna 设为后台智能体自动化的默认模型,Blitzy 则把成本压到了上一代 mini 模型的约 13%(数据来源:OpenAI 官方博客客户证言,2026-07-30)。
Luna 免费开放,哪些不限、哪些照旧
不限量听着很爽,但有一件事要说清楚。
从 8 月 6 日起,Luna 成为 Free 和 Go 的默认模型,直接替掉 GPT-5.5。全球十亿人,直接免费用。
除此之外,OpenAI 还为 ChatGPT 免费版增加了一个「Think」新按钮。遇到难题按一下,让模型多想一会儿再回答,这是免费档第一次能主动调用更高的推理力度。

不过这个「免费」,不限的只有文本对话。文件上传、图片生成、语音这些,额度照旧,一样会撞墙。如果你需要把 GPT-5.6 接入自己的应用、Agent 或工作流,仍然需要走 API。通过 apito.ai 调用 Luna,输入价格降至 $0.14/百万 token,比官方再低 30%。

Sol 全新升级:一根滑块统一快慢
以往在 ChatGPT 中,快答的 Instant 和慢想的 Thinking 简直像双重人格,语气不一样,格式不一样,切过去像换了个模型。
现在统一由 Sol 接管,快慢自如,唯一的区别只是思考时间的长短,再也没有割裂感。之前 ChatGPT Work 专属的五档思考滑块功能,这次直接下放到普通聊天界面了,人人都能自由调节 AI 的思考深度。
新版 Sol 最直观的变化,就是话变少了,回答更加精简干练。OpenAI 官博里举了个例子,「下班从 Mission 骑车到海边会不会被淋成落汤鸡」。
旧版 GPT-5.5 Instant 的回答拉了一长串,降雨、风速、气温、海雾、海滩危险警示,外加一句「你穿棉 T 恤可能会觉得黏」。

新版 GPT-5.6 Sol 第一句就给结论,不会淋湿,真正的麻烦是逆风,西风 10 到 20 英里每小时,带件轻薄防风外套就行。追问五点半出发,新版只更新了结论,还附了一个简洁的天气表格。

这就是 GPT-5.6 Sol 更新的全部气质,把「详尽」换成「抓重点」。
错误率,暴降 68%
还有一件更重要的事,GPT-5.6 全家桶事实准确率这次大幅提升了。
这次评判标准非常严格。OpenAI 专挑金融、医疗、法律这三大领域,最容不得胡说八道的问题做了内部评测。只要一条回答里出现一处事实错误,就整条算错。
结果,GPT-5.6 Sol 比 GPT-5.5 Instant 错误率少了 68%,Luna 少了 62%。对于涉及日期、数字、来源的场景,减少返工本身就是省钱。
价格对比,官方 vs apito.ai
7 月 31 日调价后的 OpenAI API 定价(数据来源:OpenAI 官方公告,2026-07-31):
| 模型 | 官方输入($/百万token) | 官方输出($/百万token) |
|---|---|---|
| GPT-5.6 Sol | 5.00 | 30.00 |
| GPT-5.6 Terra | 2.00 | 12.00 |
| GPT-5.6 Luna | 0.20 | 1.20 |
通过 apito.ai 调用 GPT-5.6 全系列,享受官方价格 7 折:
| 模型 | apito.ai 输入($/百万token) | apito.ai 输出($/百万token) | 相比官方节省 |
|---|---|---|---|
| GPT-5.6 Sol | 3.50 | 21.00 | 30% |
| GPT-5.6 Terra | 1.40 | 8.40 | 30% |
| GPT-5.6 Luna | 0.14 | 0.84 | 30% |
价格可能随官方调整而变动,以 apito.ai 控制台 实际显示为准。

实际场景成本测算
光看单价不够直观,拿一个真实场景算笔账。假设你有一个客服 Agent,每天处理约 5000 次对话,每次对话平均输入 1200 token、输出 600 token,月调用量约 15 万次。
按官方定价使用 GPT-5.6 Luna(降价后)的月成本:
| 项目 | 计算 | 月费用 |
|---|---|---|
| 输入 token | 150000 次 × 1200 token ÷ 1000000 × $0.20 | $36.00 |
| 输出 token | 150000 次 × 600 token ÷ 1000000 × $1.20 | $108.00 |
| 官方合计 | $144.00/月 |
通过 apito.ai 调用同一模型(7 折):
| 项目 | 计算 | 月费用 |
|---|---|---|
| 输入 token | 150000 次 × 1200 token ÷ 1000000 × $0.14 | $25.20 |
| 输出 token | 150000 次 × 600 token ÷ 1000000 × $0.84 | $75.60 |
| apito.ai 合计 | $100.80/月 | |
| 每月节省 | $144.00 - $100.80 | $43.20(省 30%) |
如果是同样的调用量跑 GPT-5.6 Sol(旗舰),官方月费约 $3150,通过 apito.ai 约 $2205,每月节省近 $945。规模越大,7 折的差额越明显。
和 DeepSeek 比,Luna 降价后便宜了多少
Luna 降价 80% 确实是大新闻,但拿它和 DeepSeek 放在一起看,差距依然明显。DeepSeek 目前的 API 定价(数据来源:DeepSeek 官方定价页),deepseek-v4-flash 缓存未命中输入价 $0.14/百万 token、输出价 $0.28/百万 token,deepseek-v4-pro 缓存未命中输入价 $0.435/百万 token、输出价 $0.87/百万 token。凭借 MoE 架构(2840 亿参数仅激活约 130 亿)和高达 98% 的缓存命中折扣,DeepSeek 单任务成本比降价后的 Luna 还要低约 60%(数据来源:新浪财经分析,2026-08-04)。
也就是说,7 月 31 日这轮降价让 Luna 从「贵好几倍」变成「贵不了太多」,但还没有真正反超 DeepSeek 的价格。选型时如果场景对成本极度敏感、且任务复杂度不高,DeepSeek 仍值得放进对比清单。如果更看重工具调用稳定性、长上下文表现或生态一致性,Luna 降价后的性价比已经足够有竞争力。需要提醒的是,DeepSeek 官方在其定价页脚注中提到计划近期上调 API 整体定价,具体方案以官方后续通知为准(数据来源:DeepSeek 官方定价页脚注,未标注具体生效日期),这也是一升一降之间,GPT-5.6 性价比窗口正在打开的原因。
该不该换
如果你在用 GPT-5.5 或更早版本,建议换。事实错误率降低 60% 以上不是小数目,尤其是涉及日期、数字、来源的场景,减少返工本身就是省钱。
如果你在用 Claude Sonnet 4.6 做编程任务,GPT-5.6 Sol 在部分 benchmark 上表现接近,但两者各有强项,建议按实际任务测试后再决定,不要只看跑分。
如果你主要做高频 Agent 工作流(代码审查、后台监控、自动验证),Luna 降价 80% 后是最务实的选择之一。Ramp 已经把 Luna 设为后台智能体自动化的默认模型(数据来源:OpenAI 官方博客客户证言,2026-07-30),说明便宜模型已经能胜任需要判断和工具调用的环节。但如果你的场景对成本极度敏感、任务复杂度又不高,也应该把 DeepSeek 放进对比清单,降价后的 Luna 更有性价比,不代表它是全场最低价。
如果你只是偶尔聊天,ChatGPT 免费版会在本周内让 Luna 成为默认模型。但如果你需要 API 接入自己的应用、工作流或 Agent,通过 apito.ai 调用可以享受 7 折价格,接入配置简洁。
从 GPT-5.5 迁移到 GPT-5.6 的检查清单
| 步骤 | 检查内容 | 完成 |
|---|---|---|
| 1 | 备份现有代码和 prompt 模板 | ☐ |
| 2 | 将模型 ID 从 gpt-5.5-* 改为 gpt-5.6-*(如 gpt-5.6-luna) |
☐ |
| 3 | 确认 API 接口格式无需改动(OpenAI SDK 兼容) | ☐ |
| 4 | 用 5% 流量灰度验证输出质量,对比新旧模型回答 | ☐ |
| 5 | 检查是否有硬编码的模型名称(配置文件、环境变量、数据库) | ☐ |
| 6 | 监控首批调用的延迟和 token 用量,确认无异常 | ☐ |
| 7 | 逐步放量至全量,保留回滚机制(旧模型 ID 保留 72 小时) | ☐ |
经验提示,迁移最常见的坑不是代码报错,而是 prompt 里隐含的格式假设。GPT-5.6 的输出风格略有变化,如果你的下游解析逻辑对格式敏感(如 JSON 提取),务必在灰度阶段跑一遍端到端验证。
怎么接入 GPT-5.6 API
前置条件
- 注册 apito.ai 账号并创建 API Key
- 安装 Python 3.8+ 或 Node.js 18+
步骤一,获取 API Key
登录 apito.ai 控制台,在 API Key 管理页面创建新密钥。复制保存,密钥只显示一次。具体图文步骤可参考 Claude API Key 申请与配置指南(GPT-5.6 系列获取 Key 的流程与 Claude 模型一致)。
步骤二,配置 Base URL 和模型 ID
| 参数 | 值 |
|---|---|
| Base URL | https://gw.apito.ai/v1 |
| API Key | 你的 apito.ai API Key |
| 模型 ID(旗舰) | gpt-5.6-sol |
| 模型 ID(均衡) | gpt-5.6-terra |
| 模型 ID(轻量) | gpt-5.6-luna |
步骤三,写代码调用
Python 示例(使用 openai SDK):
from openai import OpenAI
client = OpenAI(
api_key="你的-api-key",
base_url="https://gw.apito.ai/v1"
)
response = client.chat.completions.create(
model="gpt-5.6-sol",
messages=[
{"role": "user", "content": "用一句话解释什么是推测解码"}
]
)
print(response.choices[0].message.content)
from openai import OpenAI
client = OpenAI(
api_key="你的-api-key",
base_url="https://gw.apito.ai/v1"
)
response = client.chat.completions.create(
model="gpt-5.6-sol",
messages=[
{"role": "user", "content": "用一句话解释什么是推测解码"}
]
)
print(response.choices[0].message.content)
Node.js 示例:
import OpenAI from "openai";
const client = new OpenAI({
apiKey: "你的-api-key",
baseURL: "https://gw.apito.ai/v1"
});
const response = await client.chat.completions.create({
model: "gpt-5.6-luna",
messages: [{ role: "user", content: "用一句话解释什么是推测解码" }]
});
console.log(response.choices[0].message.content);
import OpenAI from "openai";
const client = new OpenAI({
apiKey: "你的-api-key",
baseURL: "https://gw.apito.ai/v1"
});
const response = await client.chat.completions.create({
model: "gpt-5.6-luna",
messages: [{ role: "user", content: "用一句话解释什么是推测解码" }]
});
console.log(response.choices[0].message.content);
步骤四,验证连接
发送一条简单请求,如果返回正常文本且 response.model 显示正确的模型 ID,说明接入成功。常见报错及排查方法:
| 错误码 | 含义 | 排查步骤 |
|---|---|---|
| 401 Unauthorized | API Key 无效或过期 | 登录控制台重新生成 Key,确认复制时没有多余空格 |
| 404 Not Found | Base URL 或模型 ID 错误 | 确认 URL 为 https://gw.apito.ai/v1(含 /v1),模型 ID 用小写如 gpt-5.6-luna |
| 429 Rate Limit | 请求频率超限 | 降低并发或添加重试退避逻辑,apito.ai 默认速率限制可在控制台查看 |
| 500 Internal Error | 服务端临时故障 | 等待 30 秒后重试,持续报错可在控制台提交工单 |
| 超时无响应 | 网络或长文本生成耗时 | 设置 timeout 参数(建议 60-120 秒),Sol 深度推理模式可能较慢 |
| 返回内容为空 | 请求被安全过滤拦截 | 检查 prompt 是否触发内容审核,调整措辞后重试 |
如果你更习惯用图形化客户端,可以参考我们的 Cursor/Cline/Claude Code 接入配置指南,在客户端中配置 apito.ai 即可使用 GPT-5.6 全系列,无需写代码。
彩蛋,GPT-6 / Astra 下周要来?
免费,还只是开胃菜。
就在 8 月 6 日当天,圈内知名爆料客 leo 在 X 上放出独家消息,OpenAI 正准备近期发布下一代主力模型 Astra,目标定于下周。Astra 是一次全新的预训练,自 GPT-4.5 以来 OpenAI 训练过的最大模型。最新的内部检查点,代号 mewfour,已经是 Release Candidate,也就是发布前的最后一版。

其实这事早就有一串藏不住的痕迹。7 月 30 日,OpenAI 一段预览视频被火速删除,有网友手快截了图,画面里闪过一个词 mewthree。本周又有爆料跟进,mewfour 已在内部测试。从 mew、mewtwo 一路数下来,OpenAI 家的超梦,已经悄悄进化到第四形态了。
更有意思的是,官宣其实早就摆在明面上。8 月 1 日,OpenAI 发了一篇数学博客,说自家模型解决了 10 个悬置十年以上的开放问题。谁也没想到,下一代模型的官宣就藏在这篇博客里,「这些结果由 Astra 的一个内部版本取得,它是我们的下一个重要模型」。
Astra 到底是头什么怪物?综合目前的爆料,它的定位是长时程、多智能体协作,也就是一群 AI 协同跑上几小时、几天,去啃一个大问题。规格传闻有两个口径,有媒体爆料认为是 GPT-5.6 Sol 的两倍,知名开发者 Haider 则推算,GPT-4.5 约 5 万亿参数,Astra 可能到 7-10 万亿,总之是头巨兽。

Haider 还认为,OpenAI 的 post-training 全行业最强,GPT-5.5 的能力就是这么榨出来的。它唯一输给 Anthropic Mythos 的,是预训练的底子。这次短板直接补成了史上最大,最强调教配上最大底座,这就是 Astra 可能成为突破的全部逻辑。

Lumina 也整理了 Astra 的已知信息,包括大规模新预训练、mewfour 发布候选版、数学领域 10 项进展、有限受监控部署、上周向美国官员预展等,并判断「这将是一次史诗级的跨越,而非小升级」。

靠更强的基础设施和优化,加上今年大批算力上线,OpenAI 跑这头巨兽,服务成本可能比 Anthropic 的 Mythos 5 还便宜。换句话说,这会是 OpenAI 的 Mythos/Fable 级跳跃。而这一切只为一件事,把 Anthropic 的 Fable 5 从王座上掀下来。
至于 Astra 到底是断代碾压还是领先半个身位?答案可能一周内揭晓。
以上 Astra 相关信息均来自社交媒体爆料和 OpenAI 数学博客中的间接提及,尚未经官方正式发布确认,具体规格、发布时间和能力以 OpenAI 官方公告为准。
常见问题(FAQ)
Q1,GPT-5.6 Sol、Terra、Luna 怎么选?
复杂推理和编程选 Sol,日常任务选 Terra,高频调用和成本敏感场景选 Luna。如果不确定,先用 Terra 跑一轮测试,再根据质量和成本调整。想把 GPT-5.6 和 Claude 模型的价格放在一起比较,可以参考 Claude API 价格指南。
Q2,Luna 免费开放了,还需要付费 API 吗?
ChatGPT 免费版的 Luna 本周内成为默认模型,文字对话不再限量,但仍受防滥用机制约束,文件上传、图片等功能限额不变。如果你需要把 GPT-5.6 接入自己的应用、Agent 或工作流,仍然需要 API 调用。通过 apito.ai 调用 Luna,输入价格降至 $0.14/百万 token。
Q3,apito.ai 调用 GPT-5.6 和官方有什么区别?
apito.ai 兼容 OpenAI API 格式,代码无需修改即可切换。区别在于 apito.ai 提供 7 折价格、稳定接入体验和用量管理面板。apito.ai 是第三方服务,与 OpenAI 无隶属关系。
Q4,Sol 的 Fast mode 值得用吗?
Fast mode 速度提升 2.5 倍,价格翻倍。如果任务对延迟敏感(实时对话、交互式 Agent),值得用。如果离线处理批量任务,标准模式更划算。Fast mode 目前仅适用于 Sol。
Q5,从 GPT-5.5 迁移需要注意什么?
模型 ID 从 gpt-5.5 系列改为 gpt-5.6 系列(如 gpt-5.6-sol)。API 接口格式不变,代码中的 model 参数改一下就行。建议先用小流量验证输出质量,再全量切换。具体可参考上文的迁移检查清单。
Q6,8 月 6 日的更新会影响我现在用 API 调用的 Sol 吗?
不会。OpenAI 官方明确说明,这次更新只针对 ChatGPT 里面向日常聊天的 Sol,Work 和 Codex 场景使用的 Sol 版本不受影响(原文:「The version of GPT‑5.6 Sol that powers Work and Codex is not changing as part of this release.」)。通过 apito.ai 调用的 gpt-5.6-sol 属于 API/开发场景,价格和行为仍以 7 月 31 日的调价为准,不会因为这次 ChatGPT 端更新发生变化。
Q7,Astra 会替代 GPT-5.6 吗?
目前所有 Astra 信息都来自社交媒体爆料和间接提及,尚未经官方正式确认。从已知信息看,Astra 定位为下一代主力模型(可能命名为 GPT-6),与 GPT-5.6 是迭代关系而非替代关系。GPT-5.6 系列 API 仍会长期可用,建议按当前需求正常接入,无需等待 Astra。
数据与事实声明
- GPT-5.6 Sol/Terra/Luna 的发布时间、价格、降价幅度均来自 OpenAI 官方博客:7 月 30 日降价公告 和 8 月 6 日 Sol/Luna 更新公告。
- 事实错误率降低数据(Luna 62%、Sol 68%)来自 OpenAI 内部评估,测试范围为金融、医疗和法律领域的提示词,实际效果可能因场景而异。
- Notion、Ramp、Blitzy 等客户使用数据来自 OpenAI 官方博客收录的客户证言(2026-07-30),为厂商自述案例,不构成第三方独立测评结论。
- DeepSeek 成本对比数据(比降价后 Luna 低约 60%)来自新浪财经分析文章(2026-08-04),DeepSeek 当前定价另据 DeepSeek 官方定价页 核实。该页脚注提及计划近期上调整体定价,但未标注具体生效日期,实际调价时间和幅度以 DeepSeek 官方正式通知为准。
- Astra 相关信息来自 X 平台用户 @synthwavedd(leo)、@haider1(Haider)、@LuminaXspace(Lumina)的公开帖文及 OpenAI 2026-08-01 数学博客中的间接提及,均属未经官方确认的爆料和推测,具体规格、发布时间和能力以 OpenAI 官方公告为准。
- apito.ai 的 7 折价格为发文时政策,可能随官方定价调整而变动,以控制台实际显示为准。
- apito.ai 是独立第三方 API 服务,与 OpenAI 无隶属关系,不承诺与官方服务完全等价。
如果你正在评估 GPT-5.6 的接入方案,可以在 apito.ai 注册后免费试用,或者把你的使用场景发给我们,一起看看哪个模型最合适。



