智谱「牛来」GLM-5.3-Flash开源:10万张国产芯片扛62T Token
8月26日晚,智谱正式上线并开源GLM-5.3-Flash(320B-A18B),并以MIT协议面向全球开放权重。智谱同步确认,这就是过去一周刷屏海外开发者社区的匿名模型Ox Alpha——中文社区亲切称之为「牛来」。这是GLM-5系列首个原生多模态模型。
匿名霸榜六天,谜底揭晓
8月20日,Ox Alpha以匿名身份悄然登陆OpenRouter与OpenCode,首日即冲上OpenRouter榜首,单日Token处理量达平台历史峰值的4倍,并终结了DeepSeek连续56天的霸榜。六天内累计处理62T Token,成为两大平台当周最受欢迎模型。
跑分与定位
在Artificial Analysis Intelligence Index中,GLM-5.3-Flash拿下57分,追平Anthropic旗舰Claude Opus 4.8;智谱自研Z.ai Code Bench显示其编程能力同样对标Opus 4.8,DeepSWE得分63.4,较上代GLM-5.2的46.2大幅提升。
成本撕开新口子
该模型总参数320B、激活仅18B,依托30T Token多模态语料预训练。API价格仅为GLM-5.3的十分之一,限时折扣低至二十分之一,约为Opus 4.8的四十分之一;每百万Token输入0.8元、输出2.8元。上下文达1.05M,支持文本、图片、视频输入。
| 维度 | GLM-5.3-Flash | 对比参照 |
|---|---|---|
| 综合指数(AA) | 57分 | 持平Claude Opus 4.8 |
| 总/激活参数 | 320B / 18B | MoE轻量架构 |
| 相对价格 | Opus 4.8的1/40 | GLM-5.3的1/10 |
| 上下文 | 1.05M | 支持图文视频 |
10万张国产芯片扛住全球真实负载
智谱披露,「牛来」测试期间及发布后的全部线上流量,均由超过10万张国产芯片承载,算力供应商包括华为、海光、摩尔线程。这是国产算力芯片首次大规模集体出海、直接服务全球真实负载。
核心要点
- 匿名→登顶→认领→开源,中国大模型出海范式升级。
- 320B参数MIT协议开源,API价格仅Opus 4.8的四十分之一。
- AA指数57分追平Claude Opus 4.8,编程对标旗舰。
- 10万张国产芯片承载62T Token,破解国产算力只能小流量测试偏见。
FAQ
Q1:Ox Alpha为何选择匿名发布?
先在海外以匿名身份接受全球开发者盲测,用真实高并发数据验证工程稳定性,再公开身份、开源权重、开放API,是中国大模型出海的一次范式升级。
Q2:开源对开发者意味着什么?
MIT协议开放权重后,开发者可在Hugging Face获取模型,自行私有化部署与二次开发,摆脱对公有API的依赖,大幅降低落地成本。
Q3:国产芯片能否支撑前沿推理?
62T Token的真实负载由10万张国产卡稳定承接,证明国产算力集群已可承载前沿大模型大规模推理,打破「国产算力只能做小流量测试」的固有印象。
Q4:资本市场如何反应?
8月27日,智谱(02513.HK)收涨12.62%,报1160港元/股,市值重返5000亿港元。
本网站的文章部分内容来源于网络,仅供大家学习与参考,如有侵权,请联系站长 QQ:24844 进行删除处理。本站一切资源不代表本站立场,不代表本站赞同其观点和对其真实性负责。本站一律禁止以任何方式发布或转载任何违法的相关信息,访客发现请向站长举报。本站资源大多存储在云盘,如发现链接失效,请联系我们我们会第一时间更新。














![修愚分享推广计划正式上线,推广可获高额奖励[限时推广]-修愚](https://xiuyu.com/wp-content/uploads/2025/05/愚你同乐-1024x410.jpg)


暂无评论内容