8月20日深夜匿名上架OpenRouter的模型Ox Alpha(中文社区称”牛来“),终于水落石出——智谱8月28日正式确认其真实身份为GLM-5.3-Flash。OpenRouter数据显示,仅Hermes Agent、Claude Code等前五大应用对其累计调用就已超过4万亿Token,刷新平台单日模型用量纪录,热度正从社区尝鲜迅速扩散到全球开发者的真实工作流。

“牛来”是谁?五天盲测谜底揭晓
Ox Alpha以”隐身模型”身份免费上线一周,提供方每天准备了100万亿Token的服务能力,近乎”无限量免费”的测试方式让它在几天内获得大量真实用户。Stripe联合创始人Patrick Collison亲自上手后评价”非常令人印象深刻”。开发者通过tokenizer指纹、报错码、审查口径等五条技术证据指向智谱,最终官方认领验证了这一猜测。
性能与成本:逼近Claude Opus 4.8,任务成本约0.045美元
在智谱Z.ai Code Bench v1.0测试中,GLM-5.3-Flash在最高推理强度下取得29.0分,接近Claude Opus 4.8的29.5分;第三方机构Artificial Analysis给出的综合智能指数为57分。优惠口径下平均每项任务成本仅约0.045美元,智谱称过去需要约十倍成本才能获得相近水平的综合表现。
国产芯片撑起全部推理流量
值得关注的是,Ox Alpha匿名测试期间的全部推理流量均运行在国产AI芯片集群上。智谱基于SGLang为其开发了专用推理引擎,采用线性注意力、W8A8量化、Encode-Prefill-Decode分离架构等多项优化,解决了单颗国产芯片算力与显存受限的问题。
常见问题(FAQ)
即智谱最新发布的GLM-5.3-Flash,是GLM-5系列新成员,8月20日以Ox Alpha代号匿名上架OpenRouter进行公开盲测,8月28日被智谱正式认领。
OpenRouter数据显示,仅Hermes Agent、Claude Code等前五大应用对其累计调用已超过4万亿Token,并刷新了平台单日模型用量纪录。
在Z.ai Code Bench v1.0最高推理强度下得29.0分,接近Claude Opus 4.8的29.5分;Artificial Analysis综合智能指数57分。优惠口径下平均每项任务成本约0.045美元。
© 版权声明
文章版权归作者所有,未经允许请勿转载。
相关文章
暂无评论...












