JOTO
Contact us
← AI 智库
多模态模型

GLM 5.3 Flash 这价格太离谱了,新的斩杀线

2026 年 8 月 27 日

GLM 5.3 Flash Vision 正式发布,国产芯片支撑日均超100T算力供应;AI指数达57分,与Opus 4.8持平;限时定价为Opus 4.8的1/40,原价亦低于ds flash;采用320B参数、18B激活参数新架构,宣称实现高性能与低成本兼顾;强调原生多模态能力,支持视觉环境感知与Blender自主建模。

GLM 5.3 Flash Vision 正式发布

x Alpha 牛来模型刚刚官宣了,正式模型名称为 GLM 5.3 Flash Vison。

国产芯片支撑大规模算力供应

国产芯片雄起,这几天全球每天超过 100T 的供应量,全部由国产芯片提供算力支持,低价管饱,改变行业格局,太牛了。

AI性能与Opus 4.8持平,价格大幅下探

Artificial Analysis Intelligence Index 57 分,和 Opus 4.8 打平,但价格非常离谱。

AI指数对比图表
AI指数对比图表

模型定价,现在限时半价,只要 Opus 4.8 的 1/40,新的性价比斩杀线已经形成...

价格对比图表
价格对比图表

即使是原价,也比 ds flash 的梁文谷便宜。

模型架构示意图
模型架构示意图

全新架构实现成本大幅优化

超低成本的全新架构,参数 320B,激活参数 18 B,价格做到了上一代 GLM 5.3 的十分之一,这代表了模型的未来,高性能,低价格,AI 应用的春天。

原生多模态能力升级

真正原生多模态模型,不止是能看见,还能感知环境,通过视觉迭代改进,可以自己在 Blender 画出一个厨房。。。比临时的 ds flash vision 要靠谱得多得多得多。

JOTO 企业落地观察

  • 该类高性价比大模型的出现,将加速企业从“试用API”转向“私有化部署+轻量微调”的工程实践,尤其利好对推理延迟不敏感、但对长期成本高度敏感的RAG知识服务场景。
  • 320B参数与18B激活参数的分离设计,意味着企业需重新评估显存预算与推理吞吐的平衡点——传统全参数加载方案可能不再必要,但配套的稀疏推理调度能力成为新门槛。
  • 原生多模态能力若属实,将推动企业智能体工程中“视觉-动作闭环”模块的标准化封装,但当前阶段仍需谨慎验证其在真实办公文档、工业图纸等非自然图像场景下的泛化稳定性。
  • 国产芯片支撑的规模化算力供应,为企业构建自主可控的AI基础设施提供了现实路径,但需同步关注芯片驱动、编译器、分布式推理框架等底层工具链的成熟度匹配。

立即咨询 JOTO

JOTO 提供覆盖企业智能体规划与搭建、AI 平台私有化部署、RAG 知识工程、AI 安全治理、FDE 驻场共创及持续运营优化的全周期 AI 落地服务,帮助企业把验证中的 AI 能力转化为安全、可控、可持续迭代的生产力。 联系 JOTO 获取 AI 落地咨询

想把这些做法用到你的业务里?

留下你的场景和痛点,我们帮你判断从哪一步开始。

联系我们
Contact Us

Start your enterprise AI rollout

Tell us your industry, team, and current pain points. We'll get back to you within one business day to help you decide what to tackle first, what data to prepare, and which platform fits.

WeChat
Scan to add us for a 1:1 chat
JOTO WeChat consultation QR code

Tell us what you need

Once we receive your details, we'll be in touch within one business day.