GLM 5.3 Flash 这价格太离谱了,新的斩杀线
GLM 5.3 Flash Vision 正式发布,国产芯片支撑日均超100T算力供应;AI指数达57分,与Opus 4.8持平;限时定价为Opus 4.8的1/40,原价亦低于ds flash;采用320B参数、18B激活参数新架构,宣称实现高性能与低成本兼顾;强调原生多模态能力,支持视觉环境感知与Blender自主建模。
GLM 5.3 Flash Vision 正式发布
x Alpha 牛来模型刚刚官宣了,正式模型名称为 GLM 5.3 Flash Vison。
国产芯片支撑大规模算力供应
国产芯片雄起,这几天全球每天超过 100T 的供应量,全部由国产芯片提供算力支持,低价管饱,改变行业格局,太牛了。
AI性能与Opus 4.8持平,价格大幅下探
Artificial Analysis Intelligence Index 57 分,和 Opus 4.8 打平,但价格非常离谱。

模型定价,现在限时半价,只要 Opus 4.8 的 1/40,新的性价比斩杀线已经形成...

即使是原价,也比 ds flash 的梁文谷便宜。

全新架构实现成本大幅优化
超低成本的全新架构,参数 320B,激活参数 18 B,价格做到了上一代 GLM 5.3 的十分之一,这代表了模型的未来,高性能,低价格,AI 应用的春天。
原生多模态能力升级
真正原生多模态模型,不止是能看见,还能感知环境,通过视觉迭代改进,可以自己在 Blender 画出一个厨房。。。比临时的 ds flash vision 要靠谱得多得多得多。
JOTO 企业落地观察
- 该类高性价比大模型的出现,将加速企业从“试用API”转向“私有化部署+轻量微调”的工程实践,尤其利好对推理延迟不敏感、但对长期成本高度敏感的RAG知识服务场景。
- 320B参数与18B激活参数的分离设计,意味着企业需重新评估显存预算与推理吞吐的平衡点——传统全参数加载方案可能不再必要,但配套的稀疏推理调度能力成为新门槛。
- 原生多模态能力若属实,将推动企业智能体工程中“视觉-动作闭环”模块的标准化封装,但当前阶段仍需谨慎验证其在真实办公文档、工业图纸等非自然图像场景下的泛化稳定性。
- 国产芯片支撑的规模化算力供应,为企业构建自主可控的AI基础设施提供了现实路径,但需同步关注芯片驱动、编译器、分布式推理框架等底层工具链的成熟度匹配。
立即咨询 JOTO
JOTO 提供覆盖企业智能体规划与搭建、AI 平台私有化部署、RAG 知识工程、AI 安全治理、FDE 驻场共创及持续运营优化的全周期 AI 落地服务,帮助企业把验证中的 AI 能力转化为安全、可控、可持续迭代的生产力。 联系 JOTO 获取 AI 落地咨询
想把这些做法用到你的业务里?
留下你的场景和痛点,我们帮你判断从哪一步开始。
联系我们


