7月19日傍晚,在Kimi K3发布仅两天后,阿里云便推出了Qwen3.8-Max预览版。这款模型被定位为“半成品”,承诺以“日更模式”持续进化。与Kimi K3的高定价形成鲜明对比,Qwen3.8-Max采取了激进的定价策略,白天调用仅需一折,夜间更是低至零点二折。不少用户反馈模型似乎每天都在变聪明,但也有付费用户担心模型的稳定性。
Qwen系列原本由林俊旸主导,3.5是其离职前发布的最后一个版本。相比去年9月曾进入LMArena前三的Qwen3-Max Preview,3.5版本的表现存在明显落差。据《晚点LatePost》报道,除夕夜发布的3.5被内部高管称为“半成品”。林俊旸坚持开源,后因组织架构调整离职。他的离去引发了外界对Qwen系列进化能力的担忧。
参数方面,Qwen3.8-Max拥有2.4万亿总参数,采用MoE架构,是阿里首个突破万亿参数的原生多模态模型。官方数据显示,其在代码和协同办公场景中,较前代Qwen3.7-Max分别提升了22.8%和44.4%。值得注意的是,在林俊旸离开140天后,Qwen3.8-Max再次回归开源路线。这表明阿里意识到,在闭源头部模型仍有差距时,开源是维护口碑和生态的最佳选择。
虽然官方宣传称其具备全球顶尖的综合能力,但实测表现喜忧参半。针对《具身智能发展报告(2025年)》的测试,模型能清晰作答,但在生成宇宙星系HTML页面时出现了常识性错误,如行星公转速度和位置完全一致。社交平台上,独立开发者Lonely展示了Qwen3.8-Max的惊艳视频生成能力,在明确指令下,17分钟内完成了Kimi K3需52分钟的任务。然而,也有用户将其形容为“裸奔式发布”,认为在创意编程等非标准化任务上仍有明显短板。阿里试图通过“日更”和“限时低价”换取真实反馈,这与此前视频生成模型HappyHorse的策略如出一辙。
一位游戏开发者分享道,Qwen3.8-Max在短周期高频次交互场景下的效率甚至优于GPT-5.6 Sol,性价比极高。但在长周期任务中,其稳定性和深度稍显不足。相比GPT-5.6 Sol和Kimi K3,Qwen3.8-Max在复杂逻辑和代码精度上处于第一梯队。对于开发者而言,“限时一折”的诱惑促使他们尝试新版本,但一旦恢复原价,留存率将面临考验。
林俊旸离职后,阿里大模型团队经历了多次调整,从技术驱动转向商业化驱动的“Token工厂”。过去一年,阿里主要发布微调和长文本优化版本,节奏相对克制。然而,面对Claude、Gemini、Llama等竞品密集发布“4系”甚至“4.5系”的激烈竞争,阿里必须在2026财年交出AI商业化成绩单的压力下做出改变。
开源生态的崛起迫使阿里重新审视策略。数据显示,开源模型与闭源模型的性能差距已缩至3.3%,开源模型在API调用中的占比大幅上升。尽管开源会削弱API付费墙,但阿里已将Qwen开发者生态转向官方统一运营。Qwen3.8-Max的回归开源,并非简单的路线回调,而是阿里在认清自身优势与市场竞争态势后,做出的务实商业选择。
