终于,网络上备受瞩目的神秘模型“牛来”终于揭开了面纱。它正是智谱最新发布的GLM-5.3 Flash,作为5系列中的首个原生多模态模型,其表现令人瞩目。在“牛来”爆火期间,已有不少开发者用其完成了SpaceX猛禽发动机的3D网页复刻。有博主在多次测试后感叹,感觉该模型具备持续学习的能力。我们也拿到了内测资格,亲自体验了这一过程。在输入Prompt后,无需人工干预,GLM-5.3 Flash便在片刻间生成了3D猛禽引擎项目。与以往版本相比,其细节处理更加精湛。
多模态能力方面,它能精准识别视频中的说话人并配上高亮字幕,甚至能捕捉短暂出现的“名签”来对应人物关系。在电影解说任务中,它能理解整部《神话》的剧情,梳理人物关系并生成配音与字幕。在Coding能力上,它能根据UI设计稿还原出包含购物车、支付等完整功能的交互式App。甚至在长达12小时的3D Blender场景构建任务中,它也能独立完成,展现出强大的视觉与代码结合能力。
“牛来”为何如此火爆?它在OpenRouter首日即登顶,刷新单日Token使用纪录,并终结了DeepSeek在OpenCode连续56天的霸榜历史。尽管模型参数仅为320B,其能力却全面超越了体量高达753B的GLM-5.2。在AA榜单上,GLM-5.3 Flash以57分跻身前沿阵营,与Claude Opus 4.8得分持平。价格方面,它仅为GLM-5.3的1/20,Opus 4.8的1/40,且低于DS-V4-Flash。更令人骄傲的是,支撑这62T Tokens流量的全是国产芯片。
为何小身材有大能量?关键在于“Flash”二字。GLM-5.3 Flash采用全新的架构,总参数320B,激活参数仅18B,层数从92层精简至45层。它创新性地采用线性注意力与稀疏注意力混合架构,配合轻量级索引器,大幅降低了计算量。针对国产芯片,智谱优化了编码、预填充和解码流程,实现了性能的三倍提升,使单Token成本与英伟达GPU相当。
这款模型不仅能力过硬,更展现了中国科技的自豪感。在正式认领前,海外开发者只能通过体验感知其优秀,直到智谱揭开面纱,才发现其“纯血国产”的底色。GLM-5.3 Flash不仅开源,还接入了ZCode和开放API。它让前沿模型真正具备了“日常消耗品”的性价比。从模型、算力到开源生态,国产力量在这一刻真正汇聚。这便是“牛来”的寓意:吃得少,干得多,且牛是自己的,草也是自己的。
