7月19日傍晚,在Kimi K3“炸榜”两天后,阿里云发布了Qwen3.8-Max预览版。尽管被定义为“半成品”,但阿里承诺将以“日更模式”持续迭代,并以极具竞争力的“骨折价”开路:白天调用仅需一折,夜间低至零点二折。部分用户反馈模型似乎每天都在变聪明,但也有付费用户担忧其稳定性,认为付费不应用于体验不稳定的模型。
Qwen系列是林俊旸在职期间主导的大模型,Qwen3.5是其离职前发布的最后一个版本。该版本相比去年9月曾进入大模型盲测榜单前三的Qwen3-Max Preview,落差明显,据《晚点LatePost》报道,阿里内部有高管对这款除夕夜发布的模型并不满意,甚至称之为“半成品”。林俊旸坚持开源后因组织架构调整离开,外界一直关注Qwen系列能力是否可以持续进化。此次发布的Qwen3.8-Max总参数量达2.4万亿,采用MoE架构,是阿里首个原生多模态万亿参数模型。官方数据显示,在代码和协同办公两大核心场景中,预览版较前代分别提升了22.8%和44.4%。
**日更版本体验:有亮点亦有短板**
据官方介绍,新模型在代码工程、专业办公等核心能力上实现显著提升,在全栈开发、数据分析、Office办公工作流等复杂长程任务中展现出全球领先的综合能力,并仍在持续进化中。为了测试其办公场景表现,我们向模型提供了《具身智能发展报告(2025年)》并提出了三个问题。Qwen3.8-Max预览版均经过约10秒思考,给出了清晰答案并辅以表格展示。在X平台上,独立开发者Lonely使用该模型生成了惊艳的昆虫纪录片视频。虽然初次模糊需求效果平庸,但第二次在清晰列出功能模块、交互逻辑等要求后,最终生成的昆虫效果非常写实,且具备学习卡片和自测功能。体验显示,即使在超长提示和多页面构建下,Qwen3.8-Max预览版生成过程流畅,仅耗时17分钟,远低于Kimi K3的52分钟。然而,在测试前端生成能力时,模型出现了常识性错误,如认为主要行星公转速度一致且相对位置不变。从社交反馈看,Qwen3.8-Max预览版在创意编程、3D交互、复杂叙事等非标准化任务上仍有明显不足,被形容为“裸奔式发布”——有参数没数据,有口号没证据。这种策略与阿里此前发布视频生成模型HappyHorse类似,旨在通过“日更”和“限时一折”换取用户反馈,完成打磨。
一位独立游戏开发者向Tech星球分享体验称,Qwen3.8-Max预览版在复杂逻辑生成与长上下文任务中尚未进入第一梯队,但在短周期、高频次交互场景下,单位时间产出效率优于GPT-5.6 Sol,性价比确实能打。但当任务周期拉长至30分钟级别的连续推理或大规模代码生成时,其后劲明显不足,稳定性也欠佳。在具体能力维度上,GPT-5.6 Sol处于第一梯队,Kimi K3与GLM 5.2归入第二梯队,Qwen3.8-Max预览版则需再降一档。其核心竞争点更多集中于上下文窗口容量、单位调用成本及响应延迟方面的综合平衡,适合高频辅助开发,但在复杂任务精度与深度上存在短板。比起大模型本身,“限时一折”的价格让不少开发者在主力模型外选择了Qwen系列,但若恢复原价,部分用户可能不再继续使用。
**阿里为何急于端上Qwen3.8-Max?**
林俊旸离职后,阿里大模型团队进入了一个微妙的调整期。离职后的一周内,阿里连续发布了三款闭源模型,这与过去两年“开源优先”的传统形成鲜明对比。然而,从发布节奏来看,在2025年底到2026年中这半年里,Claude、Gemini、Llama等头部玩家都在热火朝天地推“4系”甚至“4.5系”旗舰,而Qwen主要版本仍停留在3.x,更新节奏相对克制。相比之下,Claude一年内完成了从3.5到4.0再到4.5的跨越,Gemini发布了1.5改进版、2.0、2.5三代,Llama不到一年时间从3.3跨越到了4.1。
阿里2026财年财报显示,AI相关产品在阿里云外部收入中的占比首次突破30,达到89.71亿元,年化经常性收入超过358亿元,绝大部分来自百炼MaaS平台的API服务。CEO吴泳铭强调AI已进入商业化回报周期,未来五年基建投入资金会远超此前承诺的三年3800亿元。巨额投入决定了阿里必须在商业化上找到确定性收入来源。当“卖Token”成为最大收入来源时,开源旗舰模型本质上是在API付费墙外搭建免费替代品,每个能本地部署的开发者都天然减少了付费API需求。换言之,阿里越拥抱开源,越可能在商业化变现中亲手培养竞争对手。也正因如此,阿里大模型闭源边界持续扩大,“中小模型开源、大模型闭源”的双轨模式逐步成型。
但市场没有给阿里太多时间。进入7月,全球AI大模型进入密集发布窗口期,月之暗面发布了Kimi K3,DeepSeek V4推进性价比策略,OpenAI发布GPT-5.6系列,xAI推出Grok 4.5,Meta发布Muse Spark 1.1,谷歌Gemini 3.5 Pro也计划上线。当大模型进入按周迭代的竞速,在Kimi K3和DeepSeek V4双重压力下,阿里必须抢跑。在Kimi K3发布仅3天后,阿里迅速推出Qwen3.8-Max预览版,被视为抢占窗口期的关键动作。为了抢时间,Qwen3.8-Max的后训练尚未收尾,英文版宣称“仅次于Fable 5”,而中文版则加上了“可能”二字,并且明确承诺开源。
**林俊旸离开后,Qwen3.8-Max再度回归开源?**
林俊旸离职后,通义实验室经过三次组织架构调整。3月成立ATH事业群,将AI业务收拢至统一框架;4月设立集团技术委员会,通义实验室升级为通义大模型事业部;6月,通义大模型事业部与未来生活实验室合并,成立Token Foundry事业部。三次调整的核心主线是将AI业务从“技术驱动”逐步改造为“商业化驱动”的“Token工厂”。此前,林俊旸离职的导火索之一是通义实验室计划将Qwen团队拆分为预训练、后训练等水平分工团队。林俊旸的离职折射着阿里在“开源信仰”与“商业回报”的阶段性博弈,现在Qwen3.8 Max预览版上线,阿里选择重新许下开源承诺。
从时间节点来看,全球市场的开源与闭源力量对比正在发生根本性变化。Mozilla发布的《开源AI现状报告》显示,开源模型与闭源模型的平均性能差距已缩至3.3%,在编码、指令执行等核心能力上已基本持平。同时,OpenRouter数据显示,开源模型处理的Token占比从2026年1月的34%飙升至6月的65%,全球API调用月消耗量前五名已全部被开源模型包揽。中国大模型更是连续十一周领跑全球调用量,开源模型下载量占比已达41%。在开源生态上,7月22日,“阿里云开发者”公众号正式更名为“千问AI平台”,标志着阿里将Qwen开发者生态转移到了官方直接运营的统一平台上。
整体来看,Qwen3.8-Max正式版上线后选择回归开源,并非简单的路线回调,这也是阿里在经历内部路线分歧后,重新认清自身优势、并在当下激烈的市场竞争中做出的商业选择。
