GPT-6 全量发布!
GPT-6 Astra 已向 Pro、Business 和 Enterprise 用户全量开放,支持 ChatGPT 与 Codex 双平台;API 上线,上下文长度达百万 token,训练数据截止至 2026 年 4 月 30 日;定价与 Fable 一致,输入 $10/百万 token,输出 $50/百万 token,缓存 $1/百万 token。
GPT-6 Astra 全量开放
刚刚,GPT-6 Astra 全量发布了,Pro、Business 和 Enterprise 都可以使用,无论是在 ChatGPT 里面还是在 Codex 里面。
我在 Codex 里跑了任务,GPT-6 总能比 Fable 更快、更好、更省额度的完成。
API 上线与定价细节
并且,模型的 API 也上线了,一百万上下文,数据库截止到 26年4月30日,价格与 Fable 保持一致,每百万 token 的话:输入 $10,输出 $50,缓存 $1。
实测性能与额度消耗对比
这款模型我上手玩了,四个字:遥遥领先。并且这个模型十分的耐用,作为对比同样是 $200 的套餐,单任务执行:
- 使用 Fable 5.1,大概每小时消耗 30% 的周额度
- 使用 GPT-6,大概每小时消耗 6% 的周额度
同样的任务,感觉 GPT-6 会比 Fable 5.1 更快、更有效、更便宜的完成。
Claude 平台额度限制现状
虽说 codex 总是重置额度,但 Claude 也不差啊:
- 你可以有 50% 的额度能用在 Fable
- 你有坑爹的 5h 额度,蹬 Fable 的话,大概 1 小时多一点就能用完
- 20x 的套餐,比 5x 的套餐,只是在 5h 限额里多了,总量一点依然只是多一倍
- 并且 Anthropic 发了通告:本月中会下调所有人额度
诶...我只能说「Fable 你最近别来找我了,我怕 Astra 误会」(当然了,话不能说满,保不齐过两天 gpt-6 降智,fable 再度雄起)。
对此,dario 表示眩晕瘫坐,宛如原子弹在眼前爆炸,并默默重置了 Fable 额度,哎...

模型跑分表现
最后,再让我们感受下这款模型的跑分:


JOTO 企业落地观察
- RAG 知识工程中,训练数据截止于 2026 年 4 月 30 日这一事实,要求企业必须校准知识库更新节奏——若业务强依赖近实时信息(如政策、股价、漏洞公告),则需额外设计高频增量索引机制,而非默认信任模型内置知识时效性。
- AI 安全治理面临新变量:当模型输出效率与成本优势显著(如输出单价 $50/百万 token 且效果更优),团队可能绕过已审批的模型选型流程直接接入 GPT-6,导致策略执行断层;需将 API 调用行为纳入统一网关审计,而非仅依赖采购清单管控。
- 智能体工程中,'更省额度'的表述暗示 GPT-6 在推理路径压缩或 token 利用率上存在优化,这对需要高频调用子智能体的复杂工作流(如客服多跳查询、投研报告生成)尤为关键——但需实测验证其在多步骤状态维持与错误恢复上的鲁棒性,避免节省 token 以牺牲一致性为代价。
立即咨询 JOTO
JOTO 提供覆盖企业智能体规划与搭建、AI 平台私有化部署、RAG 知识工程、AI 安全治理、FDE 驻场共创及持续运营优化的全周期 AI 落地服务,帮助企业把验证中的 AI 能力转化为安全、可控、可持续迭代的生产力。 联系 JOTO 获取 AI 落地咨询
想把这些做法用到你的业务里?
留下你的场景和痛点,我们帮你判断从哪一步开始。
联系我们


