智谱「牛来」GLM-5.3-Flash开源:10万张国产芯片扛62T Token

智谱「牛来」GLM-5.3-Flash开源:10万张国产芯片扛62T Token

8月26日晚,智谱正式上线并开源GLM-5.3-Flash(320B-A18B),并以MIT协议面向全球开放权重。智谱同步确认,这就是过去一周刷屏海外开发者社区的匿名模型Ox Alpha——中文社区亲切称之为「牛来」。这是GLM-5系列首个原生多模态模型。

匿名霸榜六天,谜底揭晓

8月20日,Ox Alpha以匿名身份悄然登陆OpenRouter与OpenCode,首日即冲上OpenRouter榜首,单日Token处理量达平台历史峰值的4倍,并终结了DeepSeek连续56天的霸榜。六天内累计处理62T Token,成为两大平台当周最受欢迎模型。

跑分与定位

在Artificial Analysis Intelligence Index中,GLM-5.3-Flash拿下57分,追平Anthropic旗舰Claude Opus 4.8;智谱自研Z.ai Code Bench显示其编程能力同样对标Opus 4.8,DeepSWE得分63.4,较上代GLM-5.2的46.2大幅提升。

成本撕开新口子

该模型总参数320B、激活仅18B,依托30T Token多模态语料预训练。API价格仅为GLM-5.3的十分之一,限时折扣低至二十分之一,约为Opus 4.8的四十分之一;每百万Token输入0.8元、输出2.8元。上下文达1.05M,支持文本、图片、视频输入。

维度 GLM-5.3-Flash 对比参照
综合指数(AA) 57分 持平Claude Opus 4.8
总/激活参数 320B / 18B MoE轻量架构
相对价格 Opus 4.8的1/40 GLM-5.3的1/10
上下文 1.05M 支持图文视频

10万张国产芯片扛住全球真实负载

智谱披露,「牛来」测试期间及发布后的全部线上流量,均由超过10万张国产芯片承载,算力供应商包括华为、海光、摩尔线程。这是国产算力芯片首次大规模集体出海、直接服务全球真实负载。

核心要点

  • 匿名→登顶→认领→开源,中国大模型出海范式升级。
  • 320B参数MIT协议开源,API价格仅Opus 4.8的四十分之一。
  • AA指数57分追平Claude Opus 4.8,编程对标旗舰。
  • 10万张国产芯片承载62T Token,破解国产算力只能小流量测试偏见。

FAQ

Q1:Ox Alpha为何选择匿名发布?

先在海外以匿名身份接受全球开发者盲测,用真实高并发数据验证工程稳定性,再公开身份、开源权重、开放API,是中国大模型出海的一次范式升级。

Q2:开源对开发者意味着什么?

MIT协议开放权重后,开发者可在Hugging Face获取模型,自行私有化部署与二次开发,摆脱对公有API的依赖,大幅降低落地成本。

Q3:国产芯片能否支撑前沿推理?

62T Token的真实负载由10万张国产卡稳定承接,证明国产算力集群已可承载前沿大模型大规模推理,打破「国产算力只能做小流量测试」的固有印象。

Q4:资本市场如何反应?

8月27日,智谱(02513.HK)收涨12.62%,报1160港元/股,市值重返5000亿港元。

© 版权声明
THE END
喜欢就支持一下吧
点赞5 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容