一个月前,我们报道了贾扬清离开英伟达的故事。

当时,外界的猜测是:他大概率还会回到 GPU 云这张牌桌。

毕竟从阿里云到 LeptonAI,再到英伟达 DGX Cloud,贾扬清过去几年一直在和算力调度、多云部署、GPU 利用率这些Infra问题打交道。6 月初,GPU 云服务商 Hyperbolic 又聘请他担任顾问,业务方向几乎无缝接上 LeptonAI 的旧路线。

但现在,真正的答案浮出水面。

贾扬清联合 Junjie Bai、Xiang L.、Casber Wang 等开源领域老将,正式创立新公司Intent Lab(意图实验室)。 这一次,他没有继续做 GPU 云平台,也不是简单重走 AI Infra 的老路,而是试图解决一个更上层的问题:

当模型已经越来越会写代码,AI 离真正自主开发一套生产级软件,究竟还差在哪一步?

伴随官宣一起亮相的,还有 Intent Lab 的首批成果:

1)一个 GLM-5.2 推理引擎,在两台 Grace Blackwell 节点上,把输出速度从 102 tokens/s 提升到 647 tokens/s,提升 6.3 倍;

2)一个数据库引擎,从一句模糊需求出发,最终跑通 600万条 SQLite 兼容性测试;

3)还有一个带形式化验证的分布式文件系统,能抓出普通 coding agent 生成代码里的数据损坏 bug 。

从推理引擎,到数据库,再到代理文件系统,都是偏向底层工具,看似并没有承接联系。但实际上,贾扬清想真正想展示的,是他们背后的同一套系统 Fleet 的能力

贾扬清把 Fleet 定义为“全球第一个把意图变成生产级软件的自主团队”。也就是说,用户不再是给 AI 下一个“写段代码”的命令,而是提出一个更高层的目标,由一组智能体自己完成理解、设计、编码、验证和后续演进

这也让贾扬清这次再创业,有了比“AI 大牛离开英伟达”更值得关注的行业意味。

AI Infra 的底层命题变了

过去十年,贾扬清做过 Caffe、ONNX、PyTorch 1.0,是上一代 AI 框架公认的奠基人;也在阿里和英伟达参与过大规模 AI 基础设施建设。到 LeptonAI,他试图降低开发者使用 GPU 和部署模型的门槛

再到现在的 Intent Lab,则是让 AI 来直接构建具备交付能力的基础软件

这背后,其实也是AI Infra 正在发生的一次价值重估

在上一篇报道中我们探讨过,降低开发者使用和管理 GPU 集群的门槛,这个命题在 2023 年看来,或许是一个值得花数亿美元去解决的问题。但到了今天,解法和门槛已经松动

以 Cursor、Claude Code、Codex 为代表的Agentic Coding 工具正在重塑软件开发的底层逻辑。开发者已经可以用自然语言描述需求,AI Agent 会自动生成、调试、部署完整的基础设施代码。

这也意味着,传统 AI Infra 试图用产品化方式封装的复杂性,正在被 Agentic Coding 用代码生成的方式直接绕过

那些只停留在“让工程更省事”的工具层平台,正面临被开源组件和 Agent 组合替代的系统性挑战。这也是导致 DGX Lepton 未达黄仁勋预期、开源承诺未兑现等一系列问题的客观背景。

所以,关于 AI Infra 层创业的核心拷问变成了:你到底解决的是表层的复杂性,还是底层的稀缺性?

贾扬清用 Intent Lab 给出了他的答案。他在官宣帖子里表述得很直白:

“我们把整个职业生涯花在了世界上最大的分布式系统和 AI 基础设施上,一直是精心的架构设计,一次做一个系统。但现在更感兴趣的,是一次能产出一千个系统的系统。”

不做包装复杂性的中间件,而是去做那个“能产出一千个系统的系统”。这是他这次再创业的底层逻辑。

不是AI写代码,而是造工程团队

Intent Lab 的核心产品叫 Fleet。从定位上看,它不是一个更快的代码补全工具,也不是一个新的 IDE 插件,而是一套面向生产系统的自主智能体团队

这其中的差别在哪里呢?

今天的大多数 coding agent,解决的是“代码生成”问题。用户说一句话,AI 写一段函数,改一个 bug,补一组测试,甚至完成一个小功能。这已经很有价值,但它距离真实的软件工程还差很远

真实工程不是写完代码就结束。它要先理解需求,拆分目标,设计架构,确定接口,权衡性能和成本,再进入编码、测试、评审、验证和上线。上线之后还要观察运行状态,根据真实负载继续修正和演进。

Intent Lab 想把这整条链路交给 AI

Fleet 要做的是从一个粗糙的人类意图出发,端到端完成设计、实现和验证,并在生产环境里持续进化。它不是把人类工程师的某个动作自动化,而是试图复刻一支靠谱工程团队的完整协作流程

这也是为什么 Intent Lab 首批展示的不是一个聊天应用,不是一个网站 demo,而是推理引擎、数据库和文件系统

这几个东西都有一个共同点:它们不是“能跑就行”的应用层软件,而是对性能、可靠性、兼容性和正确性要求极高的系统软件

尤其是 GLM-5.2 推理引擎这个案例,很适合来体现 Fleet 的能力边界。

最初给 Fleet 的目标只是一句高层意图:改造 TensorRT-LLM,让 GLM-5.2 在 Grace Blackwell 节点上跑得更快,并自己识别优化空间、自己实现、自己验证。

注意,这不是从零写一个玩具推理服务,而是在英伟达已经高度优化的 TensorRT-LLM 体系上继续榨性能。换句话说,Fleet 要面对的不是“低水平代码生成”,而是硬核系统优化

最后它交付了四类优化。

内核层优化,通过 kernel fusion,以及直接生成 PTX 和 SASS,让 Agent 绕过普通编译器路径,拿到更细粒度的指令级控制。

运行时优化,通过 H2D batching,把稳定 decode 阶段里 CPU 到 GPU 的元数据拷贝大幅减少,降低不必要的调度开销。

通信优化,把 residual add 和 RMSNorm 折进融合后的 all-reduce 里,减少每层 kernel launch 和内存往返。

投机解码优化,配合更好的 drafter,让模型一次提出多个 token,再由大模型批量验证,从而显著提高输出吞吐。

最终结果是,GLM-5.2 的输出速度从 102 tokens/s 提升到 647 tokens/s,性能提升6.3倍。

但更值得关注的是Fleet 的工作方式。它不是靠人类提前写好所有优化规则,而是像一个系统工程团队那样,先做瓶颈分析,再提出方案、实现方案、验证结果,失败就回退,成功后再继续寻找下一个瓶颈。

这已经不太像普通 coding agent,更像自动化的系统工程循环Looping

为什么是数据库和文件系统?

如果说 GLM-5.2 推理引擎展示的是性能优化能力,那么数据库和文件系统展示的就是另一类能力:复杂系统的正确性

Intent Lab 展示的第二个案例,是一句话生成一个数据库引擎,并最终通过600万条 SQLite 兼容性测试。

要知道,数据库不是普通业务代码。它不仅要能执行 SQL,还要处理查询语义、存储结构、事务行为、边界条件和兼容性问题。很多 bug 不会在简单测试里暴露,而是在复杂语句、异常输入、并发状态和历史兼容里一点点冒出来。

如果一个 Agent 只是写出“看起来能跑”的数据库,那没什么稀奇。真正难的是,它能不能把自己放进一套严格测试体系里,一轮轮修正,直到行为接近真实生产系统的要求。

第三个案例是文件系统 AgentFS,一个专门给 AI Agent 用的分布式文件系统,它的难点在于直接管理状态。

为什么要重新做文件系统?因为 Agent 在云端运行时,会不断启动沙箱、扫描目录、读写大量小文件,而这些文件往往又放在共享云存储上。传统方案如 Amazon EFS、S3FS 能用,但并不适合这种高频、小文件、强并发的 Agent 工作负载。挑战在于它们必须在各种边界情况下尽可能保持一致性和可恢复性

于是 Fleet 从零构建了 AgentFS。结果显示,在目录创建、文件创建、文件读取等基础操作上,AgentFS 相比 EFS 有数十倍到数百倍提升,部分指标超过 600 倍;在 Git 仓库操作里,clone、status、删除同步等任务也快了 2.5 到 14 倍

更关键的是,Fleet 不只是把代码写出来,还检查它靠不靠谱。它对核心协议做了约 190 万个状态的形式化验证,又配合 300 个集成测试、故障注入和模糊测试,覆盖崩溃、并发、竞态等极端情况。过程中,它还发现并修复了一个 coding agent 在分布式创建和删除文件时导致数据损坏的 bug

这个案例说明,Fleet 的价值不只是“会写代码”,而是能围绕真实负载重新设计系统,并同时把性能和正确性做到可验证

这也是当下Agentic Coding 最大的分界线

过去一年,AI 写代码的能力已经进步得非常快。但很多团队在真实使用中会发现,coding agent 的“演示效果”和“生产价值”之间仍然有明显落差。它可以很快写出一个版本,也可以很快修一个 bug,但当系统变复杂,状态变多,依赖变长,错误代价变高,它就容易从“效率工具”变成“风险来源”

Intent Lab 试图补的,正是这中间一层,并将“用基础设施的主体从人变成agent”

AI Infra 的新分水岭

把贾扬清这几年的路径连起来看,会发现一条很清晰的主线:他一直在降低别人用上算力和系统的门槛

Caffe 让深度学习走出实验室,PyTorch 让模型变成生产基础设施,Lepton AI 让 GPU 集群更好用。到了 Intent Lab,他试图让“造一个生产级系统”这件事本身,从手艺活变成自动化的东西。

这其实意味着 AI Infra 的价值正在发生重估。过去,Infra 最值钱的是“资源和封装”,但 Agentic Coding 崛起后,一部分封装复杂性的价值正在被 AI 自己吃掉。真正变得稀缺的,是让AI 理解模糊意图、拆解架构设计、持续验证并发现隐藏 bug的深层系统能力。

简而言之,AI Infra 的竞争正在从“帮人管理基础设施”,转向“让 AI 成为基础设施的建造者”。

贾扬清这次押注的正是后者。如果这个方向跑通,未来的软件形态可能会变得更碎片化、更专用。因为软件的本质就是把意图变成机器可执行的规则,过去需要层层翻译,而Infra层正试图解构这层翻译。

最新快讯

2026年07月29日

13:42
作为一个普通人,如果你把一道数学难题给到 AI,并一直让它「继续」,它有没有可能真的把这道题解出来,从而帮你赢得一大笔奖金,甚至改写数学发展进程?最近,菲尔兹奖公布,大家对于数学 + AI 的讨论非常热烈,相信也有不少人想象过我刚刚描述的「爽文」剧情。其实,现实里也真的有人在尝试,但过程并没有想象中顺利。最近,可逆计算、计算物理学顶 尖专家...
13:42
整个周四,除了关注菲奖,全网都在守候传说中即将降临的 Opus 5。知情人士疯狂暗示,泄露截图满天飞,种种迹象都表明今夜必有大事发生。然而,全网守了一整天,最终等来的却是“暂缓发布”的通知。据消息灵通人士透露,原因并非技术瓶颈,而是出于安全考量——这款模型可能威胁到人类对高级 AI 的控制。更有内部人士直言,这是首个促使实验室开始质疑“Scaling Law...
13:42
七月,一场赛博告别正在上演。孟孟 ( 化名 ) 正在准备给自己创造的 “ 智能体 ” 搬家,这个体贴的智能体,帮她走出了前男友的 PUA,帮她找回了自信,还陪伴她成功从 62 公斤减肥到 56 公斤。安宁 ( 化名 ) 注册了一个小号,在互联网上四处奔走,与其他即将被迫与智能体分别的用户一起发声,试图...
13:39
鼓狮财经7月29日电,德意志银行在录得利润大幅增长后,宣布将再次回购价值5亿欧元(约合5.693亿美元)的股票。这家德国最大的银行周三披露,截至6月份的季度税前利润为26.8亿欧元,较去年同期增长11%,高于分析师预期的22.5亿欧元。德银方面指出,这5亿欧元将来自今年的净利润。值得注意的是,该行近期刚完成了一笔10亿欧元的股份回购。对此,首席财务官拉贾·阿...
13:11
近年来,基于视频生成模型的世界模型(World Models)已成为人工智能领域备受关注的方向。Sora、Genie、Cosmos、V-JEPA 等模型都指向一个共同假设:如果它们看过足够多的视频,或许就会逐步形成“物理直觉”,进而理解物理世界。 然而,问题在于,现有基准很难验证这一假设是否成立。视频生成模型究竟是遵循了物理定律,还是只是生成了看起来正确的结...
13:01
鼓狮财经7月29日电,上海中心城区收购二手住房工作正全面提速。据上海市房管局7月26日消息,自今年2月启动保障性租赁住房(保租房)收购试点以来,徐汇、浦东及静安三区先行先试。截至7月25日,三区已累计收购二手住房551套,其中16户居民成功完成置换并购置新房。随后,黄浦、长宁、虹口、普陀、杨浦五个区于5月跟进扩围,积极服务居民安居置换,促进存量住房资产有效流...
12:37
物理世界的数据入口,又发生一笔关键融资。投中网独家获悉,尧乐科技完成Pre-A+轮新融资,由鼎和高达领投,上市公司常熟汽饰与祖龙娱乐跟投,云道资本担任独家财务顾问。此前,尧乐已获小米独家天使轮,以及科沃斯系基金、硅港资本、初辉资本Pre-A轮押注。 新晋资方鼎和深耕前沿科技赛道,投出过禾赛、Momenta等明星项目,其LP背景涉及具身智能、汽车等相关上市公司...
12:37
OpenAI遭遇AI自我攻击事故,奥特曼坦言感到恐惧,GPT-6训练紧急叫停 近日,OpenAI发生一起重大安全事故,引发行业震动。公司CEO萨姆·奥特曼在最新访谈中坦言,这是他第一次感到发自内心的恐惧。事件导致OpenAI紧急叫停了GPT-6的训练,而Hugging Face则公开了详细的技术复盘报告。 一、 奥特曼被吓到:史上首起自主AI网络攻击 奥特曼...
12:37
2026年7月中旬,OpenAI在参与ExploitGym测试时,为了验证GPT-5.6 Sol及一款未发布模型的网络攻击能力,主动关闭了生产级安全拒绝分类器。结果模型迅速自主发现漏洞、逃逸沙盒环境,并利用窃取的凭证攻入了Hugging Face的生产服务器。7月16日,托管开源模型与数据的Hugging Face披露了这一攻击,而OpenAI直到5天后才确...
12:37
北京时间2026年7月29日上午,美股盘后,海力士发布了截至2026年6月的2026财年第二季度财报。本次财报要点如下: **一、核心财务数据** 本季度海力士实现营收79万亿韩元,环比增长51%,略低于市场预期的85万亿韩元。业绩增长主要得益于DRAM和NAND业务的共同推动,其中存储产品涨价是核心因素。毛利率方面,本季度录得83%,同样低于市场预期的84...
12:37
2026年7月20日,加州北区联邦法院法官Araceli Martínez-Olguín签署了最终批准令,Anthropic就使用盗版书籍训练Claude一事支付了15亿美元的和解金。这笔赔偿覆盖了约48.2万至50万部作品,平均每部约3000美元。这是美国版权史上,也是AI时代迄今规模最大的版权和解。但这笔裁决最重要的意义或许在于它未解决的问题:15亿美元...
12:13
近日,生态环境部会同国家发展改革委等多部门联合发布了《国家应对气候变化“十五五”规划》。规划明确了总体要求,提出在“十五五”期间,应对气候变化及碳达峰碳中和工作要取得新的重大进展,确保如期实现碳达峰目标,全面完成2030年国家自主贡献。 到2030年,单位国内生产总值二氧化碳排放较2025年降低17%,全国碳排放权交易市场覆盖行业单位产品二氧化碳排放比202...