Kimi K3的问世在全球人工智能领域激起了强烈反响。7月21日,《科创板日报》记者实地探访了月之暗面位于北京海淀区的办公区。作为近期备受全球产业链瞩目的本土大模型企业,其总部恰好坐落在被业内称为“中国最智慧三平方公里”的科创产业带上。
在与媒体的交流中,月之暗面B端企业业务负责人黄震昕首次对Kimi K3发布后的市场关切进行了全面回应,涵盖了算力紧张现状、开源策略及商业化路径等焦点话题。
**底层架构革新,实现“史诗级”进化**
关于K3被形容为“史诗级进化”的技术跃迁,黄震昕强调,其核心动力并非简单的工程效率优化,而是参数量与底层架构的创新。他透露,K3的性能提升主要依托于公司在2025至2026年间集中发布的多项基础层技术,对沿用8至11年的AI基础机制进行了系统性重写。
具体而言,K3的训练效率与推理效率因此提升了25%。这三项关键技术分别是:首先,以技术论文形式发布的Attention Residuals,其中包含一名17岁学生的贡献,该技术获得了马斯克的高度评价;其次,MoonClip(新型二阶优化器Muon),这是Kimi首次将其应用于大模型训练,实现了“20T训练数据用出40T的效果”,据悉DeepSeek V4也已认可并采用此技术;最后是Kimi Linear Attention(线性注意力机制),解决了传统线性注意力在长距离任务上的性能衰减问题,使模型在规模扩大十倍时成本仅同步增长,让Scaling Law得以持续演进。
现场演示显示,K3已支持百万级token上下文,可一次性处理大量研究报告或代码。非技术人员仅需简单指令,即可生成3D游戏、动态咨询级PPT及带实时图表的深度芯片研究报告。
针对核心技术,黄震昕表示,公司倾向于在发布前将技术细节写入报告并开源,并不担心被他人模仿。面对马斯克声称其2万亿参数模型有望超越Kimi,黄震昕持开放态度,称希望对手能出来“掰一掰手腕”,并表示马斯克态度的转变反映了Kimi带来的震撼。
**打破低价标签,算力应对“DeepSeek时刻”**
针对市场存在的“开源模型只能走低价路线”的刻板印象,黄震昕予以了纠偏。他指出,K3在多个榜单位列第一,定价并未走低价路线,目前全球范围内处于供不应求状态,中国模型并非廉价标签。
因用户请求量爆发,公司已暂停C端新用户注册。黄震昕坦言,这类似于去年DeepSeek时刻的情况,尽管预案充分,用户热情仍超预期。在“放开注册”与“保障老用户”之间,公司选择优先保障付费客户体验,宁可暂时牺牲部分收入,目前正通过模型效能优化和增加算力供给解决瓶颈。
**To B与To C双线并行,聚焦“难而正确”的生产力**
在业务布局上,黄震昕介绍,公司采取To B与To C双线策略。C端聚焦知识工作者的日常办公,依托Kimi Walk客户端落地全链路生产力工具;B端则以代码开发、智能Agent为核心,提供技术支撑。
商业化方面,黄震昕首次披露,API调用收入约占B端收入的70%,公司坚持不做私有化部署,模式对标海外成熟企业。此外,公司近期将发布“Kimi Hosted Agent”,将C端验证的Agent Harness和沙箱能力平台化开放,例如媒体机构可直接接入PPT生成API定制内部应用。
关于模型公司与Agent的路线之争,黄震昕重申,模型是基础,Agent能力是模型强大后的自然产物。公司愿景是寻求将能源转化为智能的最优解,不做娱乐场景,聚焦编程、金融、法律、科研等“难而正确”的领域。他表示,Kimi的创新将围绕长上下文、Token效率和Agent集群三个方向展开。
对于大模型“幻觉”问题,黄震昕坦言无法杜绝,只能通过降低。目前K3通过Agent Swarm中专设的“事实校验员”子代理进行数据核验,已将幻觉比例控制在较低水平。
在企业文化方面,黄震昕特别提到了摇滚精神的影响。公司根植于摇滚精神与大模型研发逻辑,搭建了扁平化组织,内部沟通无职级壁垒,即便是实习生也能直接与创始人杨植麟交流。
