过去45天,Anthropic几乎从未停歇。Fable 5与Mythos 5同时落地,Sonnet 5降价抢占市场,Claude Code几乎每日更新。就在昨天Cowork刚完成迭代,今天Anthropic又在托管智能体平台CMA上一口气推出了六项更新:
技能上限从20激增至500:一个会话即可容纳整个企业知识库;
思考力度五档调速:简单路由节省token,深度推理火力全开;
种子会话一步创建:直接携带50条初始事件,实现冷启动归零;
子agent实时流下探至线程级:每个子agent运行到哪里、思考到哪里,均可实时可见;
新增7种webhook覆盖环境与记忆存储全生命周期:彻底告别轮询模式;
agent更新版本字段变为可选:单流程场景下省去版本管理开销。
一个会话能挂载500个技能、跑通整座企业知识库,Anthropic这是要给智能体装上一套操作系统啊!
01、技能上限暴涨到500,一个会话装下整个业务部门
CMA的技能是给agent注入专业指令的知识包,此前上限仅为20个。然而,一个金融客服agent,光是覆盖开户、KYC、反洗钱、投诉处理、合规免责、多语言切换就需要七八个。再加上监管差异和AB测试版本,直接撞上天花板。如今这一数字直接拉升至500。
这500个技能位由会话内的所有agent共享,运行在统一的托管沙盒中,agent之间共享内存和环境变量,由协调器统一调度——这足以对应一个完整的业务单元。甚至,可以直接将整套代码库规范、CI流水线配置、部署目标全部塞入一个会话,让agent从编写代码到上线部署全流程了然于心。
02、思考力度五档调速,简单题不烧满血token
思考力度参数在API层面早已存在,但此前CMA中的agent无法单独设置。这意味着整个会话统一运行默认档位,无论是问今天几号还是审计500页财报,都使用同一套深度推理。简单问题上的过度推理,纯粹是在浪费token。
现在,思考力度可以直接写入每个agent的模型配置中,提供五个档位:low / medium / high / xhigh / max。当你运行一个多agent客服系统时:分流协调器用low,产品答疑用medium,投诉升级用high,法律合规用max。同一个会话里,不同agent可以依据任务难度运行在不同档位上。在成本与质量之间,终于有了一个连续可调的旋钮。
03、冷启动归零,子agent黑盒也拆了
创建CMA会话以前需要两步:先发送一个空壳请求,再逐条塞入初始事件。在高并发场景下,往返延迟层层叠加,导致冷启动非常缓慢。现在一步到位。通过POST /v1/sessions直接携带initial_events(最多50条),会话生成之初就明确了自身任务。
同一批更新中,agent更新接口的version字段也变成了可选。以前每次更新都得传递版本号做并发控制,版本不匹配直接返回409错误。现在单流程场景可以直接省掉这一步。
子agent的可观测性也迈出了巨大一步。6月底CMA刚上线会话级的event_deltas,能实时预览主agent的文本输出。但子agent此前仍是黑盒,不管是跑偏了,还是卡死了,只能等超时才知道。此次直接下探到线程级。订阅子agent的独立线程流,想到哪里、写到哪里,实时看得一清二楚。
04、7种新webhook补位,轮询时代结束了
CMA在6月底已经上线了agent和部署生命周期的webhook。此次更新补齐了剩余的两大块:4种环境事件与3种记忆存储事件。至此,CMA的全生命周期——包括环境搭建、agent部署、运行状态及记忆管理——均可通过事件驱动与外部系统打通。环境暂停时自动触发告警,记忆存储更新时同步到自家数据库,新环境创建时自动挂上监控。从API产品到可运维平台,这是最后一块拼图。
05、Anthropic赌的是OS级深度
走到2026年7月,AI agent基础设施竞赛已进入深水区,更新频率几乎按天计算。OpenAI赌入口,将聊天、编程、自主工作全部塞入一个ChatGPT超级应用,利用庞大的用户基数锁定开发者;Google赌基础设施,依托GCP、TPU及协议标准构筑底层护城河;而Anthropic赌的是OS级深度,通过托管沙盒、全栈agent控制及思考力度调速,在单agent的能力密度上做文章。从20到500,Anthropic盘算的是如何将agent变成像操作系统一样基础的存在。速度已经给出了答案:很快。
