国产AI大模型风暴:DeepSeek V4开源与500亿美元估值背后

过去48小时,国内AI大模型领域接连迎来重磅消息。DeepSeek V4无预告开源,首次适配华为昇腾算力,首轮融资估值高达500亿美元;字节豆包月活突破3.45亿甩开DeepSeek;Kimi K2.6登顶全球代码基准榜首。九大模型密集发布,标志着国产AI正式从"模型竞赛"迈入"智能体落地"的深水区。本文梳理这一轮AI风暴的核心看点与底层逻辑。

一、DeepSeek V4突袭开源:搅动全球AI格局

4月24日,DeepSeek无预告地开源了V4系列,在业界引发剧烈震动。这一次发布的V4系列包含两个版本:V4-Pro拥有1.6万亿参数,V4-Flash为2840亿参数,两个版本均支持百万Token上下文——这意味着用户可以输入长达100万字的长文本进行理解和推理,而无需分段处理。

V4的发布之所以引发全球关注,不只因为参数规模,更因为三个关键突破:

首次适配华为昇腾国产算力。 DeepSeek V4实现了与华为昇腾910B芯片的深度适配,成为首个真正在国产算力上运行的头部大模型。这打破了业界对英伟达GPU的路径依赖,对国内AI产业的自主可控具有战略意义。

开源与性能兼得。 DeepSeek一贯坚持开源路线,V4延续了这一策略,同时在多项基准测试中逼近闭源模型的能力水平。

核心团队承压。 值得注意的是,DeepSeek V4技术报告披露了近300人的研究与工程团队,其中10名核心成员已被标注”已离职”,包括王炳宣、阮肿、郭达雅等核心贡献者。人才流失问题引发业内关注。

二、首轮融资500亿:国家队入场,腾讯在列

就在V4开源的同月,DeepSeek完成了成立以来首次对外外部融资洽谈。据财经及彭博社等多方报道:

  • 领投方为国家大基金(国家集成电路产业投资基金),这是大基金首次跨界投资AI大模型公司,释放了明确的政策信号——AI基础设施已被纳入国家战略优先级。
  • 融资规模约700亿元人民币(约100亿美元),投前估值达450-500亿美元。
  • 腾讯出现在洽谈名单中,字节跳动、阿里等头部厂商也被传参与谈判,资本正在加速向头部模型公司集中。

从100亿美元到500亿美元估值,只用了一个多月。资本市场的热情背后,是对中国AI技术实力的重新定价,也是对AI赛道战略价值的集体押注。

三、字节豆包甩开DeepSeek:用户争夺战白热化

在资本市场炙手可热的同时,用户层面的竞争却呈现截然不同的格局:

截至2026年5月底,字节豆包月活已达3.45亿,较此前的3.15亿进一步攀升,稳居国内AI应用榜首,全球仅次于ChatGPT。相比之下,DeepSeek月活为1.27亿,阿里千问月活1.66亿——豆包的领先优势正在持续扩大。

字节豆包的策略核心是“更强模型+更低价格+更易落地”三箭齐发:豆包大模型1.8版本针对多模态Agent场景定向优化,在视觉推理、视频理解等任务中逼近全球顶尖水平;同时依托字节跳动抖音、头条等生态的海量用户数据,实现全场景流量导入。

四、Kimi登顶代码榜首:垂直能力的崛起

在豆包和DeepSeek双雄争霸的格局下,Kimi K2.6在SWE-Bench Pro代码基准上以58.6%的得分首次登顶全球榜首,这是国产AI模型在代码能力领域取得的历史性突破。

SWE-Bench Pro是全球最具权威性的代码任务评测基准之一,Kimi的登顶打破了OpenAI、Anthropic等美国厂商在这一指标上的长期垄断,验证了国产模型在垂直能力上可以做到全球领先。

阿里方面也不甘示弱,Qwen3.6-Max-Preview在Artificial Analysis榜单中登顶最佳国产大模型,同时千问月活达1.66亿,形成了对DeepSeek的追赶态势。

五、九大模型密集发布:AI Agent时代全面到来

2026年4月被称为国产AI的”Agent爆发周”——月之暗面、阿里、腾讯、DeepSeek、字节跳动、小米、智谱AI等九家头部企业先后发布或升级旗舰模型,平均不到三天就有一款新品亮相。

这一轮发布潮的共同特征是:从大模型能力的军备竞赛,转向Agent(智能体)能力的落地之争。 各家的核心卖点不再只是”模型有多强”,而是”模型能在多少场景中代替人执行任务”。

腾讯混元Hy3 preview的发布是其中值得关注的一环。这是姚顺雨加盟腾讯后的首款模型作品,业界对其在复杂推理和多步任务执行上的能力抱有较高期待。

六、底层逻辑:国产AI进入”三足鼎立”新阶段

纵观过去48小时的信息,有三条主线逐渐清晰:

第一条线:算力自主。 DeepSeek V4适配华为昇腾,意味着国产AI大模型正在加速摆脱对英伟达的依赖。国家大基金领投DeepSeek,更是将这一趋势提升到国家战略层面。

第二条线:用户为王。 豆包用生态打法赢得用户,DeepSeek用技术深度赢得开发者,两条路线的竞争尚未分出胜负,但用户规模正在成为越来越重要的竞争筹码。

第三条线:Agent落地。 密集的模型发布背后,各家争夺的核心已从”谁的大模型更强”转向”谁的智能体能更好地完成任务”。2026年下半年,国内AI市场的主旋律将是Agent落地能力的真刀真枪较量。

参与讨论 (0)

请保持理性交流,共同建设AI营销生态