9月10日,DeepSeek正式推出V4.1Flash模型,官网、App及API端同步上线。该模型被定位为新一代模型结构中体积最小的版本,旨在同时突破能力上限、提升推理速度及吞吐量。V4.1Flash拥有552B参数,基于MoE架构,并采用了全新的CausalEncoderDecoder设计。在计算模式上,输入与输出采用非对称计算策略,输入阶段激活约8B参数,输出阶段激活约16B参数。通过保留大参数规模但仅调用部分参数进行实际推理,并配合FP4精度的KVCache技术,其显存需求降至上一代的四分之一,硬盘需求降至八分之一,相比初代模型,缓存规模缩减了约437倍。推理流程方面,CSA2负责跨层复用缓存并利用Top-K索引筛选关键信息,DSpark则通过轻量模块提前预判部分Token。
官方测试表明,V4.1Flash在软件工程、网络安全及自动化任务等多类Agent评测中均超越V4Pro。定价方面,新费率于9月10日中午生效,沿用峰谷分时机制,闲时价格仅为高峰时段的一半。API端用户只需将模型名称更改为”deepseek-flash”即可切换,旧版本已下线,旧名称将暂时自动路由。从9月14日中午起,访问deepseek-v4-pro的请求将全部转向V4.1Flash,并按Flash费率计费。目前,腾讯WorkBuddy、CodeBuddy与OpenCode均已接入该模型。
受此影响,港股两家大模型公司股价今日下跌:智谱AI盘中跌幅超10%,尾盘报价约814港元;MiniMax跌幅超9%,最低触及288.60港元。9月以来,两家公司累计回撤幅度分别接近30%和14%。针对大模型行业的竞争态势,机构观点存在分歧。摩根士丹利认为,无序恶性竞争的概率较低,旗舰与轻量并行的双线布局已成为行业标准,调价后的V4Flash费率仍高于Qwen3.8-flash和GLM5.3-flash,且存在溢价。杰富瑞则持相反观点,指出中国大模型赛道过于拥挤,更青睐算力与数据优势明显、资产负债表稳健的全栈云厂商,并将智谱云业务的市销率倍数从50倍下调至30倍。
DeepSeek概念股板块全天收跌1.19%,主力资金净流出83.47亿元。板块内仅游族网络和中新赛克两家涨停。据路透社报道,DeepSeek已聘请中信证券筹备科创板上市,计划年内启动IPO流程。21世纪经济报道进一步核实称,中信证券目前处于尽职调查阶段,双方尚未签订正式的上市辅导协议,浙江证监局官网亦未查到相关备案信息。按照辅导备案不少于三个月的规定,若公司希望在年内递交申请,则必须在9月提交相关材料。
数据显示,2026年前七个月DeepSeek营收约4.75亿元,约为2025年全年营收的十倍;同期净亏损7.15亿元,综合毛利率为44.6%。目前市场给予DeepSeek的最新估值为5000亿元人民币。据此推算,若成功上市,其市值区间预计在1.5万亿至2.5万亿元之间。
