最新消息:关注人工智能 AI赋能新媒体运营

智谱GLM-5.3-Flash发布:原生多模态能力加入大模型价格战

科技资讯 admin 浏览

智谱AI发布GLM-5.3-Flash:国产算力支撑的多模态模型挑战行业性价比极限

智谱AI日前正式发布GLM-5系列首个原生多模态模型GLM-5.3-Flash。该模型此前以"Ox-Alpha"代号在开源社区流传,因其性能表现与定价策略引发广泛关注。

在基准测试方面,GLM-5.3-Flash在Artificial Analysis Intelligence评分中获得57分,高于前代旗舰GLM-5.2及DeepSeek V4 Pro正式版(53分)。定价层面,该模型每百万Token输入0.8元、输出2.8元、缓存命中0.23元,官方称约为Claude Opus 4.8价格的四十分之一。

技术层面,GLM-5.3-Flash将视觉编码能力融入代码生成流程。据官方测试,模型可在Blender中持续运行16小时,自主完成约400平方米空间的三维场景搭建,实现"生成-观察-修正"的闭环迭代。

值得注意的是,该模型推理部署已全面采用国产芯片,通过SGLang推理引擎、ReplaySSM、混合缓存量化及EPD分离式架构等优化技术,在OpenCode和OpenRouter等平台承担真实线上流量。

目前GLM-5.3-Flash模型权重以MIT许可证在Hugging Face开源,API同步向全球开发者开放。