牛来模型揭秘了!灵犀首发接入智谱GLM-5.3-Flash,牛!

闵鑫
闵鑫 WPS资深用户Lv.3 优质创作者WPS产品体验官KVP

Lv.3优质创作者

牛来模型揭秘了,原来是智谱GLM-5.3-Flash,牛!

大约一周前,在OpenCode和OpenRouter上,一款名为Ox-Alpha的开源模型,迅速走红,成为当周最受欢迎的模型,并创下双平台的调用量新高。

中文社区给Ox-Alpha取了一个中文名:牛来

OpenRouter,是全球最大的LLM API聚合平台,上面聚集了超过500个AI大模型,供全球的爱好者和用户调用。

Opencode社区主要聚集的是全球的程序开发者,大模型在这个平台上盲测可以很好的检测模型的代码生成能力。

Ox-Alpha大模型“牛来”,上线这两大平台后,获得了来自全球开发者和AI使用用户的大量好评,口碑一度炸裂。

由于当时是匿名测试,大家也都不知道牛来模型,到底出自何方神圣?

只是有人猜测,可能来自国内的某一模型厂商。

昨天,牛来模型的身份正式揭晓,牛来模型=智谱GLM-5.3-Flash

看了模型参数、架构细节和价格,不得不说,智谱这次是真的:牛!

320B的模型总参数,能力超过GLM-5.2,综合智能评分与与Anthropic最受欢迎的模型Claude Opus 4.8得分持平,编程表现更是与Claude 4.8相当。

能力方面确实很能打,如果价格高了,那用起来也不是那么香!

让人惊喜的是,智谱的5.3-flash,价格方面相当给力!

GLM-5.3-Flash定价为GLM-5.3的1/10,限时折扣内为GLM-5.3的1/20,为Opus 4.8的1/40

按照智谱自己说的:这一次,它要让前沿智能,进入普惠时代,不需要省着用了。

说真的,我昨晚看到这个消息,还是挺激动的!

要知道,即便是现在国产AI大模型不断出新,国内的AI应用日新月异,但是说真的,还是有非常非常多的人还没有机会接触到AI,没能用上AI。

不信,你可以看看身边的人,能每天任性的用AI来辅助工作和学习的有多少

AI,还没有普及!

这其中,有一个原因,一直是我比较关注的,那就是使用成本,也就是价格。

AI技术能否大面积的普及,进入人人能方便用起来的普惠时代,除了AI能力本身很重要,经济性也是一个非常重要的因素。

之前,在国内AI大模型,性价比这一块,Deepseek一直是天花板级的存在。

我也特别感激Deepseek,是它首先把AI大模型的价格给打下来了。Deepseek也是我之前用得比较多的模型。

这次,智谱的5.3-flash,不仅在性能上更优,价格上相比调价后的Deepseek,也更便宜。

总结下来,智谱的GLM-5.3-Flash主要有两方面突出的优点:

1、模型的性能够强

同级模型对比来看Glm-5.3-flash,相比Deepseek的v4-flash,在模型参数的编码能力方面都略胜一筹。

GLM-5.3-flash的模型总参数在320B,并且使用的原生的输入多模态能力,能够非常方便的读懂图片、视频等输入信息。

上下文方面,二者都支持最大100Token的上下文

GLM-5.3-flash是Glm-5系列的首个原生多模态模型。

5.3-flash这次具备的原生多模态能力,不仅能够在用户输入信息的识别上,实现多模态内容的识别。

更值得关注的是,视觉编码能力的引入,使得模型的自我判断和测试改进能力,获得了大幅度的提升。这对于生成结果的质量,又多了一层保障。

比如,在我们AI办公中,用的比较多的各种格式文档的生成上,视觉理解能力使模型能够检查并优化自身的输出,并具备更强的审美判断。

模型还可以将自己的输出结果与视觉上下文以及预期的结果进行对比,从而实现更有效的自我验证和优化——包括更准确的呈现质量评估以及审美判断。

这无论是对于docx文档的排版,HTML网页的效果渲染,还是PPT演示文稿的生成,都是大有帮助的。

2、模型的价格是真的香

我刚才也说了,性能如果很强,但是价格不实惠,那么大范围的使用,也会面临经济成本上的困难。

特别是放在AI办公、组织提效,生产制造这种对成本比较敏感的领域里,价格香,才算是真的香!

GLM-5.3-flash这次给出的调用价格,说实话,确实是非常的香。

输入缓存未命中的情况下,正式价大概在1.07元,输出约为3.58元。输入缓存命中的价格低至0.21元。

这个价格,哪怕是和Deepseek V4-flash的峰谷价比较,也是有优势的。

不过需要注意的是:

在架构效率方面,目前GLM-5.3-flash的KV缓存大小虽然和自家的GLM-5.3相比,有了大幅的降低。但是和Kimi-k3、Deepseek-v4-flah相比,还显得略高。

kv缓存的大小,并不会直接影响到Token的消耗,它主要影响的,比如推理效率方面,以及对内存和显存的占用上。而这方面的影响主要是模型服务上考虑更多一些。

对于我们普通用户来说,日常的AI办公任务和开发任务,用GLM-5.3-flash是合适的。

一个好消息是:

灵犀首发接入了GLM-5.3-flash

现在只要打开灵犀桌面客户端,就可以切换到5.3-flash,直接用!

从实际任务消耗的灵点来看,感觉确实是立竿见影的省!

国产AI大模型,每一次的突破和带来的惊喜,都在为AI人工智能的全行业普及积蓄力量。

今天,点赞智谱,将前沿智能带进普惠时代!

🔔

1. 神秘模型“牛来”(Ox-Alpha)实为智谱GLM-5.3-Flash,320B总参数、GLM-5系列首个原生多模态模型,智能评分与Claude Opus 4.8持平

2. 价格极具普惠性:正式价仅为GLM-5.3的1/10、Opus 4.8的1/40,缓存命中输入低至0.21元

3. WPS灵犀已首发接入GLM-5.3-flash,打开灵犀桌面客户端即可切换使用

湖北省
浏览 313
收藏
9
分享
9 +1
+1
全部评论