8月26日晚,智谱AI正式宣布上线并开源GLM-5.3-Flash(320B-A18B),同时官方确认其正是过去一周在海外开发者社区刷屏的匿名模型Ox-Alpha——国内网友戏称的”牛来”。
神秘模型”牛来”身世揭晓
过去一周,一个名为Ox-Alpha的匿名模型在海外Hugging Face和开发者社区引发热议。该模型以出色的推理速度和多模态能力惊艳众人,但由于发布者身份不明,被国内网友谐音称为”牛来”。随着智谱官方正式认领,这一悬念终于尘埃落定。
GLM-5.3-Flash采用混合专家(MoE)架构,总参数320B,每Token仅激活18B参数,在保持高性能的同时实现了极低的推理成本。这也是GLM-5系列首个原生多模态大模型,支持文本、图像等多种输入形式。
10万张国产算力卡支撑
据了解,GLM-5.3-Flash的训练和推理依托于超过10万张国产算力卡,这标志着国产大模型在算力自主化方面迈出重要一步。在全球智算资源供应偏紧的背景下,国产算力产业链正从”产品验证”加速迈向”批量交付”。
智谱方面表示,GLM-5.3-Flash在多个基准测试中表现优异,尤其在代码生成、逻辑推理和多模态理解方面达到国际一流水平。模型已全面开放API调用,并在GitHub和Hugging Face同步开源权重。
国产大模型加速崛起
值得关注的是,就在同一天,阿里通义千问也发布了Qwen3.8-Flash模型。两款高性价比国产模型同日发布,被业界视为国产大模型竞争进入新阶段的信号。
工信部最新数据显示,国产开源大模型全球累计下载量已突破100亿次,中国大模型周调用量达40.48万亿Token,连续17周超越美国。DeepSeek-V4-Flash更是连续三周位居全球大模型调用量第一。
分析人士指出,随着GLM-5.3-Flash、Qwen3.8-Flash等模型的相继开源,国产大模型在”效能比”和”性价比”两个维度持续突破,正在重塑全球AI大模型的竞争格局。对于开发者和企业用户而言,更多高质量开源模型意味着更低的AI应用门槛和更灵活的技术选型空间。
风腾网将持续关注GLM-5.3系列的后续迭代以及国产大模型的最新动态,为读者带来第一手的AI行业资讯。
风腾网 - 最新 AI 风向|AI 工具、大模型与人工智能行业资讯






