模型大战,归根结底是入口与生态的较量。从今年6月到8月初,短短不到60天,阿里巴巴、腾讯和字节跳动这三家中国互联网巨头几乎同时做出了相似的整合动作。先是阿里将内部孵化的QoderWork、悟空、MuleRun合并为统一的「千问办公」;紧接着腾讯整合QClaw业务至WorkBuddy体系;随后字节跳动宣布飞书团队整体并入豆包。这种步调一致并非巧合,而是AI行业度过摸索期、进入“入口争夺阶段”背景下的必然选择。
过去,大厂需要多个团队并行验证桌面操作、云端执行和企业协作等不同路线。但现在,产品形态逐渐清晰,竞争焦点已从“能不能做出Agent”转向“谁能成为用户和企业的统一入口”。千问办公作为阿里阶段性能力重组的产物,将分散在模型、桌面端、云端和企业协作场景中的积累装进了一款新独立产品,使其成为观察企业级Agent竞争的最佳样本。
大厂为何同时收敛路径?
以阿里为例,年初同时保留三款产品是合理的,分别代表了本地执行、企业协作和云端运行三种判断。但随着行业认知变化,Anthropic推出Cowork,OpenAI将Codex并入ChatGPT,用户主动打破了聊天、编程与办公的边界。市场已无多余时间供大厂分散试错,技术路线逐渐确定,头部效应显现,分散反而成为资源分配的负担。整合是为了将分散的能力与反馈数据汇聚到一个入口、一套工程体系和一个迭代闭环中,避免重复劳动。
企业Agent的分水岭
目前大多数通用办公Agent解决的是个人生产力问题,侧重于个人上下文。但企业面对的是另一类问题,企业Agent不仅要处理信息,还需处理组织关系、权限和审批。个人上下文叠加不等于企业上下文。这是中美大厂行为逻辑产生区别的认知基础:OpenAI和Anthropic主要合并聊天、编程和桌面入口,而中国大厂则整合了钉钉、飞书等IM与企业云,将IM和云视为Agent的底层资产。
IM不仅是沟通工具,更是包含完整组织上下文、权限和信任体系的软件。Agent不仅要能“读”消息,更关键在于“写”回系统——创建待办、提交审批。这种基于企业信任的操作权限,是第三方Agent难以逾越的护城河。
模型与Agent,构建智能飞轮
阿里同时拥有一线大模型、企业协作平台和云计算基础设施,具备构建“智能飞轮”的条件。Agent能为模型提供比聊天记录更有价值的反馈,例如代码能否运行、任务是否真实完成。模型则通过强化学习解决Agent中的底层判断问题。Agent留下的完整行动轨迹(如理解目标、调用工具、失败原因)能反馈给模型,成为迭代动力。最终,Agent提供真实任务反馈,模型提供更强判断力,两者相辅相成,形成持续进化的闭环。
结语
千问办公的整合完成,并不意味着探索结束,但至少说明阿里已找到主线。随着To C类Agent的功能趋同,未来的竞争将取决于背后的系统能力:掌握多少企业上下文、获得多大执行权限,以及能否将真实任务转化为模型迭代的动力。IM上下文、基础设施与模型Agent的飞轮缺一不可。千问办公,已拿到了通往未来的半张门票。
