人工智能的飞速发展正在从根本上重塑我们对游戏价值的认知。过去,游戏曾为人工智能的算力基础设施和算法演进提供过关键助力。如今,随着AI迈入新阶段并面临智能体训练、具身智能以及应对数据枯竭等新挑战,游戏有望在更为核心的基础设施层面发挥不可替代的作用。

长期以来,社会公众及监管机构对游戏行业抱有审慎甚至负面的态度,这固然源于青少年沉迷、不良价值观导向及有争议的商业模式等问题,但更深层的原因在于产业定位:游戏长期被视为“不创造实体价值”的虚拟行业,难以与芯片、能源等“硬科技”相提并论。然而,人工智能的快速发展正在打破这一刻板印象,游戏正在从娱乐载体转变为AI发展的关键基础设施。

一、游戏对AI发展的历史贡献

游戏产业在多个关键节点上,为人工智能的飞跃提供了不可或缺的条件。

首先,算力层面的推动功不可没。20世纪90年代,玩家对实时渲染、复杂光影和高帧率的需求,催生了一种全新的计算架构——图形处理器。GPU的本质是大规模并行计算。到了21世纪初,AI研究者发现,原本为游戏画面服务的GPU非常适合高效训练深度神经网络,因为矩阵乘法这类深度学习的基本运算,在GPU上的执行速度比传统CPU快数十倍甚至上百倍。可以说,没有游戏产业持续数十年的图形计算投入,就没有今天AI大模型训练所依赖的GPU算力集群。英伟达财报清晰地记录了这一转变:2016财年,其游戏业务收入约28.2亿美元,是数据中心业务的8倍多;而到2025财年,数据中心已占总营收约88%,游戏仅剩8.7%。这条从游戏引擎到AI引擎的曲线,正是游戏为AI输送算力的最好注脚。

其次,算法层面的推动同样关键。2015年,DeepMind在《自然》杂志发表DQN研究,首次将深度学习和强化学习成功结合,让AI在几十款雅达利游戏中摸索出接近专业人类的操作策略,宣告了“深度强化学习”时代的到来。2016年,AlphaGo通过学习人类棋谱并辅以强化学习击败李世石,创造了AI史上的里程碑。特别是2017年的AlphaGoZero,完全抛弃人类棋谱,仅靠“自己和自己下棋”在几天内达到超越人类的水平,将“独立思考”的能力推向极致。这说明,游戏不仅能帮助AI模仿人类,还能在规则清晰、反馈明确的环境里,发现连人类都想不到的新策略。

可见,过去十来年游戏赋能AI算法发展的关键词是“强化学习”。两者的底层逻辑高度契合:游戏本质上是一个规则清晰、反馈及时、奖励明确的环境系统,恰好为强化学习提供了明确的目标、可重复的交互和清晰的奖励信号。

随着大模型、智能体、具身智能乃至世界模型的兴起,游戏对AI的赋能已经无法仅用算力和强化学习来定义,而是变得更加广泛和深入。其逻辑可以从两个维度来理解:一是环境维度,游戏及其引擎技术是一套高质量、低成本的环境系统,为AI提供训练场和实验室;二是数据维度,游戏通过人与游戏的互动、玩家博弈、AI自我对弈等方式,源源不断地产生海量、高质量、低成本的数据。这两个维度犹如工厂与产品:环境是生产数据的系统,数据是核心资产。

二、环境维度

今天的大模型主要依靠海量的静态数据训练,让AI学会“看懂”和“听懂”世界。但要让机器智能更进一步,具备“能决策、能动手”的能力,仅靠静态数据是不够的,必须在与世界的持续交互中学习。然而,让AI直接在真实世界里交互学习,代价极其高昂。游戏及其引擎技术所构建的虚拟环境,恰好提供了理想的替代方案。相比真实世界,它至少有五个方面的优势。

第一,成本极低。真实世界的试错既贵又危险。以理想汽车的智能驾驶测试为例:2023年实车路测每公里成本约18.4元,而到2025年上半年,借助世界模型进行仿真测试,单公里成本降至约0.53元,仅为实车路测的三十五分之一。成本的量级差异直接决定了训练能否规模化。

第二,高度可控、可重复。真实环境中的对比实验常受制于不可控变量。而在虚拟环境里,研究人员只需调整光照、车流密度、降水概率等参数,就能快速生成任意目标场景,让AI训练从“被动等待”转向“主动生成”。

第三,风险可控,能提前暴露问题。AI在部署前需要充分的安全验证,但真实环境中的安全测试代价极高。游戏沙盒完美绕过了这些限制:研究者可以主动构造极端天气、传感器故障、恶意输入等边缘场景,零风险地探测AI的行为边界,观察其是否异常或有害。

第四,具备天然的可解释性。当前AI常被诟病为“黑箱”。游戏环境为破解这一难题提供了条件:每一个状态变量都可以被精确记录、暂停、回放和复现,研究者得以逐帧追问“AI此刻看到了什么、为何这样决策”。这种在真实世界中几乎无法实现的因果可追溯性,让游戏成为可解释性研究的天然实验室。

第五,实时交互、有效反馈。与静态数据不同,游戏环境的核心特征是“交互性”:AI在游戏中不仅“看”到了什么,更重要的是它能够“做”什么,并立刻看到行动带来的结果。这种即时的“动作—反馈”闭环,是训练决策智能的必要条件。

游戏环境对AI的价值主要体现在两个方面:一是利用现成的商业游戏作为训练环境,二是利用游戏引擎技术构建专用的仿真平台。前者虽是娱乐产品,物理规律可能被夸张处理,但依然可用来训练AI的通用决策能力。例如,腾讯“绝悟”AI最初是为《王者荣耀》这类复杂多人在线对战游戏研发的,后来发现其在游戏中锤炼出的最优路径规划能力,可以迁移到病理全片扫描诊断领域,决策效率相比传统方式提升约400%。

后者则是利用游戏引擎技术搭建高度贴近真实世界的专用仿真场景,如1:1还原的矿山或城市街区。以腾讯推出的自动驾驶仿真平台TADSim为例,该系统利用游戏引擎的厘米级三维重建、工业级车辆动力学模型和AI驱动的交通流仿真技术,可在云端支持上千辆自动驾驶主车及上百万辆交通车同步运行,日均测试能力超过1000万公里,远远突破了真实路测的限制。

三、数据维度

环境的价值最终要通过它产出的数据来兑现。游戏数据的独特价值体现在两个天然属性和两个数据来源上。

第一个属性是天然的“多模态对齐”。现实世界本身就是多模态且自动对齐的,而现实中采集视觉、声音、动作往往来源分散,难以同步。游戏则不同,它运行时同时产生画面、声音、动作、物理反馈,且天然处于同一时间轴、同一场景中,彼此自动对应。这相当于一套图像、音频、动作与环境状态完全同步的“多模态教科书”,是训练“视觉—语言—动作”大模型的关键原材料。

第二个属性是清晰的“状态—动作—反馈”因果结构。AI要理解世界,不仅要知其然,还要知其所以然。现实中因果关系复杂,关键反馈容易遗漏。游戏天然具备这种结构,会完整记录“看到什么(状态)—做了什么(动作)—得到什么结果(反馈)”,任何一次失败都能精确回放。这相当于给AI一本带完整解题步骤和答案的“教科书”。

游戏数据的另一个独特性在于,它既有人类经验的沉淀,也可以有机器智能的探索。

一方面,人类与游戏交互产生的数据,是人类经验的数字沉淀,可以支撑AI的模仿学习。这就像让AI站在无数顶尖人类玩家的肩膀上看世界,快速习得那些难以用规则描述的经验。以沙盒游戏《我的世界》为例,AI通过模仿人类玩法,就能学会大量难以言传的策略。人类的数字沉淀还可以帮助AI实现“人类偏好对齐”,让决策更贴近人类的价值判断。

另一方面,AI与游戏交互产生的数据,是机器智能与环境互动产生的合成数据。利用算法和游戏引擎批量生成的合成数据,可以覆盖现实中稀缺的长尾场景,弥补真实数据在边缘场景上的天然稀缺。而AI在游戏中“自我博弈”产生的数据则可用于强化学习训练,驱动模型在无需人类监督的情况下持续自我进化。前文的AlphaGoZero正是例证。

四、总结

正如英伟达早已不是一家游戏显卡公司,游戏产业的价值坐标也正在越过娱乐产业的边界,向科技基础设施的方向迁移。在环境维度,它为AI提供了低成本、可交互、有即时反馈的虚拟系统,让智能得以反复试错、快速成长;在数据维度,它持续产出结构化、多模态自对齐的海量数据,为智能提供源源不断的养料。

当然,虚拟终究不能完全替代现实,游戏环境更像是真实世界的高效放大器而非替身。但随着AI向具身智能与世界模型演进,游戏承载的这两重价值会进一步凸显。这也提醒我们是时候转换看待游戏的视角:不再只盯着它的娱乐外壳,而是看清它作为AI隐性基础设施的内核。中国拥有全球最大的游戏市场和最活跃的游戏产业生态,在移动游戏、电竞、游戏AI等领域已经积累了深厚的技术储备与人才梯队。若能超越“游戏即娱乐”的单一认知,系统性地推动游戏技术向AI基础设施转化,这很可能成为中国在全球AI竞争中一个独特的优势来源。

(刘劲系长江商学院会计与金融学教授、投资研究部主任,段磊系深之度咨询合伙人)

最新快讯

2026年07月24日

10:14
没有意外,没有反转,果然是王虹、邓煜。 就在刚刚,美国费城,ICM(国际数学家大会)现场,四年一度菲尔兹奖名单公布,中国双子星双双在列,创造中国数学领域新历史。 1991年出生35岁的王虹,正式成为菲尔兹奖历史上第三位女性得主。一同创造历史的是王虹的北京大学2007级同届校友邓煜。 虽然前有1982年获奖的丘成桐,后有2...
10:14
如果你是3D打印爱好者,一定有过类似的经历:想给耳机设计一个分层收纳盒,翻遍模型库也找不到适配尺寸的现成方案。 市面上现有的解法,却各有硬伤。人工建模产能低、成本高,追赶不上工业和创客两端同时膨胀的需求;通用AI生成的3D模型则更像是一具“空壳”,内部没有尺寸标注,没有装配逻辑,改一个孔距就得全部重绘。放到仿真环境里物体会直接穿模,导出打印...
10:14
过去半年,面对高昂的AI投入成本,互联网大厂开始集体转向。百度撤回了token新规,字节跳动开始严审AI投入的回报,京东和阿里也传出压缩非核心AI团队的消息。这并非AI赛道遇冷,而是互联网公司终于在狂奔之后开始低头算账。模型越来越贵,变现路径却远不如预期,烧钱的速度正在触碰管理层的容忍边界。这是不容忽视的趋势。互联网算AI经济账,本质是回答一个问题:花出去的...
10:14
央行6月资产负债表(BS)显示其恢复扩表。伴随央行态度转松,我们预计第三季度(Q3)超储总量修复的概率较高,但需警惕Q3可能是年内政府债供给相对高点,银行承接能力仍待评估。央行流动性投放回归季节性均值,下半年宽货币空间值得留意。此外,鉴于央行持债余额持续下行,为配合政府债发行加力,下半年加大买债操作的可能性更高。 **央行6月资产负债表:恢复扩表** 从资产...
10:14
7月22日,财政部公布2026年上半年,全国一般公共预算收入121047亿元,同比增长4.7%;全国一般公共预算支出143329亿元,同比增长1.5%。1.核心观点:加快专项债发行拨付,缓解项目储备及地方财力约束掣肘或是后续财政发力重点 6 月广义财政呈现收入小幅回落、支出明显收缩。6 月广义财政收入同比回落至 1.8%,较5月下滑0.7个百分点;...
10:14
**全球市场动态** 美股三大期指集体下挫,纳指期货跌1.15%,标普500指数期货跌0.79%,道指期货跌0.84%。欧洲股市主要指数普跌,德国DAX指数跌0.98%,英国富时100指数跌0.47%,法国CAC指数跌1.36%,欧洲斯托克50指数跌1.26%。美国劳工部数据显示,截至7月18日当周初请失业金人数为18.7万人,创下自2022年9月24日以来...
09:43
三十年图论悬案,一夜之间轰然倒塌。就在今日,GPT-5.6 Pro成功证伪了困扰图论界三十年的Dinitz-Garg-Goemans猜想。他给出的证据干脆利落:一张图的分数流成本仅为58,而任何容量违规不超过15的不可分割流,成本至少为60。58小于60,一个悬了三十年的图论猜想就此倒下。 同一时间,哥大博士Shouqiao Wang利用GPT-5.6 So...
09:43
我不得不承认,去年的 Gemini 确实表现强劲,但如今它的口碑已跌落谷底,甚至被戏称为“北美大豆包”。无论是聊数学题突然输出大便,还是画海滩照片时被误认为恋童癖,这些荒谬的抽象发言让 Gemini 在互联网上饱受诟病。而除了模型本身表现急转直下,谷歌近期在科研人员上的变动也堪称频繁。 两年前,谷歌斥资 27 亿美元挖回的 Transformer 作者之一,...
09:42
据鼓狮财经7月24日消息,国内商品期货开盘整体向好,多数品种录得上涨。涨幅榜上,原油领涨,涨幅超过6%;燃料油与苯乙烯紧随其后,涨幅均超3%;纯苯、沥青及BR橡胶涨幅也超过2%。跌幅榜上,沪银、钯和铂表现疲软,跌幅均超3%,沪金跌幅则达到2%以上。
09:42
图论界三十年悬案,一夜之间崩塌。 今天,GPT-5.6 Pro成功证伪了图论领域持续三十年的猜想——Dinitz-Garg-Goemans猜想。他给出的证据干脆利落:一张图,分数流的成本仅为58。然而,任何容量违规不超过15的不可分割流,其成本至少是60。58小于60,这意味着悬了三十年的猜想不攻自破。 与此同时,哥大博士Shouqiao Wang利用GPT...
09:42
刚刚站在领奖台上,与王虹、邓煜并肩而立,Jacob Tsimerman 下台后立即向世界展示了他职业生涯的巅峰时刻有多么戏剧化。之所以用“戏剧”一词,是因为他身上充满了巨大的反差:一个笃信“AI会导致人类灭绝”的人,如今却加入了一家AI公司。他甚至写过论文专门给“AI如何灭绝人类”建立分类学。他在社交媒体上唯一的帖子,主题是数学家将如何失业,而现在,他成了第...
09:42
在当下中国的AI叙事版图中,梁文锋正在演变为一个极具象征意义的符号。更确切地说,他代表了一种苦行僧式的姿态,高举“AGI圣杯”的旗帜,对沿途的一切商业诱惑视而不见。在梁文锋的哲学体系中,世界分明主次、讲究轴线。主线,是认知智能的核聚变,是从CoT(思维链)到Agent(智能体),再到持续学习与自我迭代的链式反应,是通往窄门的唯一正途。而旁支,则是那些看似繁花...