国产AI模型“无限战争”:Kimi刷新智能极限,DeepSeek当价格屠夫 国产ai模型kimi谁创造的 国产AI大模型技术突破有哪些
创始人
2026-07-31 03:04:01
0



没有一款AI模型能强大到无法超越,继续融资,继续“烧钱”。

©️懂财帝出品 · 作者|嘉逸

中国AI,把美股的估值逻辑干崩了。

华尔街坚信:AI模型越强,算力支出越高,烧钱越多。

但,Kimi、DeepSeek戳破了“泡沫”。去年初,DeepSeek R1凭借极低算力成本媲美GPT-4,英伟达股价单日暴跌近17%,市值蒸发5890亿美元。

近期,Kimi开源K3,以有限算力逼近Fable 5、GPT-5.6 Sol,Code Arena测评分数全球第一,一度干崩美股AI板块。

核心逻辑是:即便遭遇“算力瓶颈”,中国AI公司仍能取得突破(差距仅剩2-3个月)。那GPU还是唯一答案么?英伟达等AI基础设施的收入预期是否要下调?

对此,高盛合伙人在客户电话会里直言:算力扩张时代,可能到头了。

与此同时,Kimi还带崩了智谱——智谱创始人唐杰曾是Kimi创始人杨植麟的科研导师。Kimi正加速推进港股IPO,市场担忧智谱的“稀缺性”,短短两个交易日,股价跌超42%。



Kimi K3和杨植麟,竟然这么强?

01 | Kimi刷新“智能极限”,DeepSeek当价格屠夫

Kimi K3拿到了DeepSeek的剧本,撕裂硅谷。

白宫威胁,封禁外国开源AI模型。

近200家AI巨头、科技公司(微软、Meta、英伟达、Palantir等)随即联名致信警告:如果封禁中国开源模型,“将有数百家公司瞬间死亡。”英伟达CEO黄仁勋表示:美国公司“绝对应该被允许使用中国模型。”[1]



因为,Kimi K3和DeepSeek太强了。

Kimi K3刷新了“智能极限”,2.8万亿参数,MoE(混合专家)架构,896个专家中每次仅激活16个,100万token上下文,是目前全球最大的开源模型。

K3还创新了两项技术架构:

其一,KDA混合线性注意力,使KV缓存使用量减少了75%,在100万token上下文长度下解码吞吐量提升最高6倍。

其二,注意力残差(AttnRes),让AI模型有选择地跨层检索信息,有效解决信息稀释问题,大幅提升长程任务能力。

基于此,K3实现SOTA水平,跻身全球第一梯队,Artificial Analysis测试得分57,排名第三,仅次于Fable 5(60分)和GPT-5.6 Sol(59分)

Arena编码能力测试中,K3斩获1679分,超越所有美国AI模型,登顶全球第一。

同时,K3也更贵,定价对标海外顶级模型,百万tokens输入2元(缓存命中),输出100元,价格是K2.5的5倍。但API依然供不应求,以至于Kimi只能暂停C端新用户订阅。



与之对比,DeepSeek继续坚持“极致性价比”。

DeepSeek正灰度测试DeepSeek V4 Pro和V4 Flash。以V4 Pro为例,1.6万亿参数,490亿激活参数,MoE架构,100万token上下文,综合性能比肩Claude Opus 4.6 Max。

价格方面,DeepSeek首次引入“峰谷计费”:平时阶段,V4 Pro百万tokens输入0.025元(缓存命中),输出6元。高峰阶段翻倍,V4 Pro百万tokens输入0.05元(缓存命中),输出12元,但仍显著低于Kimi K3。

能看出,DeepSeek想要以同业10%的价格,提供顶级模型80%的AI能力。

综上,Kimi、DeepSeek蹚出了中国AI崛起的两条路:Kimi向上突破“智能天花板”,DeepSeek探索AGI,并不断向下突破使用成本。

02 | 两个AI天才,两种AI灵魂

Kimi、DeepSeek两次震撼全球,技术架构颇有默契。

Kimi K2、K3都采用了DeepSeek首创的MLA注意力机制,来削减KV缓存占用,解决内存困境。DeepSeek也借鉴了Kimi的技术经验,在V4模型中应用“二阶优化器Muon”,提升训练稳定性、模型扩展性等。

两家公司的组织环境和技术气质,亦高度相似。

DeepSeek像一个大型实验室,扁平、交叉分工、不加班。

Kimi的管理略有不同,但同样纯粹,极度热爱AI。一位熟悉Kimi的DeepSeek研究员表示,两家公司都有相似的技术理想,“如果Kimi老板看对了方向,可能比DeepSeek更快接近AGI。”[2]

Kimi创始人杨植麟和DeepSeek创始人梁文锋,也有很多共同点。

他们都是广东人,低调、务实、技术派。

有DeepSeek员工透露,梁文锋除了编程,没有什么其他的爱好[3]。近期的闭门会里,也能看到梁文锋对AI的深刻、独特理解。

杨植麟也是“技术狂”,他自己拆解技术架构,在社交媒体上和网友聊技术到凌晨3点。

技术路线方面,两人坚定支持开源模型,终极目标都是AGI。

梁文锋认为,“开源,发论文,其实并没有失去什么。”[3]“开源是属于我们这个规模公司的sweet point(甜蜜点)。”

DeepSeek不想做下一个字节、腾讯,不追C端流量、B端收入,“公司真正的长期目标是AGI,所有资源、所有决策都围绕‘提升AGI实现概率’这一核心指标。”[4]

杨植麟认为,开源AI加速探索智能上限。“通过开源,让企业、研究者、终端用户能低门槛获取智能,是非常重要的事。”

他在去年底的内部信中写道,“接下来公司最重要的目标是超越Anthropic等前沿公司成为世界领先的AGI公司。”

两人亦有不同,成长经历决定思考路径。

梁文锋毕业于浙大,是一位量化工程师,通过量化投资完成资本原始积累,再进阶AI研究。

他追求极致低成本,AI普惠,“无论是API,还是AI,都应该是普惠的、人人可以用得起的东西。”

因此,DeepSeek克制商业化,定价极低,V4 Pro高峰阶段的输入价(缓存命中)仅为K3的1/40。梁文锋表示,“只赚合理利润,不是利润最大化的定价。”

杨植麟比梁文锋年轻7岁,毕业于清华,尔后赴美留学,一直深耕AI领域,是可计算学派的笃信者。

在他看来,大模型的本质是“压缩产生智能”。在他的演讲、采访和内部信中,“突破、超越、AGI、智能上限”等词汇的出现频率较高。

两个AI天才,两种AI灵魂,造就了Kimi和DeepSeek的独特优势。最终,殊途同归,他们正加速推升AI模型的进化速率,冲击AGI。

03 | IPO盛宴,创造“万亿神话”?

AI无限战争,用户为两种模型买单:一是顶级模型,如Fable 5、GLM-5.2、Kimi K3。二是极致性价比模型,如DeepSeek。

Kimi、DeepSeek已驶入“增长快车道”。据公开资料,DeepSeek ARR约4亿—5亿美元。

Kimi 6月份ARR已超过3亿美元,API收入占比超过70%,K3发布后日销售量增加了6倍。



资本蜂拥而至,争相抢筹。截至目前,Kimi已完成8轮融资,融资规模超过600亿元人民币,估值350亿美元,股东阵容强大,包括:国资基金,如国家AI产业投资基金;顶级PE/VC,如红杉中国、IDG资本;科技巨头,如阿里、腾讯、美团。

DeepSeek已完成首轮融资,融资规模高达510亿元人民币,估值520亿美元,股东“明星云集”,国家AI产业投资基金、IDG资本、腾讯、京东、宁德时代......

但,没有一款AI模型能强大到无法超越。尤其对中国AI公司来说,对比海外同业,差距仍然存在,算力支出、资本扩张必须加码,钱仍然不够花。

融资狂潮继续,Kimi正推进Pre-IPO轮融资,目标估值500亿美元。

同时,Kimi已通知股东,正式启动VIE及红筹架构拆除工作,计划最快6个月内港股IPO。

DeepSeek也在抓紧筹钱,并期望留住核心人才,原计划推进第二轮融资,融资规模100亿元人民币,目标估值710亿美元,约4800亿元人民币。DeepSeek原计划在A股科创板上市,目标2027年挂牌。但目前已暂停。

未来,Kimi、DeepSeek能否和智谱一样,创造万亿市值神话?有待观察。

可以确认的是,AI故事终究要有“估值锚”,当他们站在资本市场“聚光灯”下,投资者便会进一步拷问预期:何时跑通商业化闭环?

当短期股价走势和长期AGI理想爆发冲突,杨植麟和梁文锋,Kimi和DeepSeek,还能否保持纯粹?

参考资料:

[1] Kimi K3,已经撕裂了整个硅谷-极客公园

[2] 知春路最有AGI理想的两个男人-白鲸实验室

[3] 我所见过的梁文锋-聪明投资者

[4] 读懂梁文锋:一群平凡的人做出了不平凡的事-中国蓝新闻

说明:数据源于公开披露,不构成任何投资建议,市场有风险,投资需谨慎。

相关内容

热门资讯

猪油蒙了心 猪油蒙了心 猪油蒙... 图:Scheherazade最近才知道,有个认识的叔叔沉迷菠菜。从中年一直玩到退休,总忍不住偶尔去一...
刚刚,出大事了!官方直接定调,...   截至收盘,上证指数跌0.62%,深证成指跌2.73%,创业板指跌3.97%,北证50跌1.43%...
财报后Meta大跌10%,扎男... Meta第二季度产生了318.62亿美元经营现金流,又花掉310.78亿美元建设数据中心和购买服务器...
国产AI模型“无限战争”:Ki... 没有一款AI模型能强大到无法超越,继续融资,继续“烧钱”。©️懂财帝出品 · 作者|嘉逸中国AI,把...
粉笔营收同比下滑18.3%!炒... 粉笔上半年由盈转亏,炒股巨亏 5600 万,创始人言论失当黯然离场7 月末,港股公考培训龙头粉笔(0...
中国电信8月1日起停止第三方互... 红星资本局7月30日消息,中国电信官网已上线一则落款为7月31日的《关于规范互联网渠道售卡管理的公告...
马斯克月瘦 18 斤的减肥神针... 打开社交平台,到处都是打了“躺瘦针”之后判若两人的对比图,那些曾经“喝凉水都长肉”的博主们,突然间有...
惠誉上调华润置地的评级至“A-... 本文来源:时代周报7月29日,惠誉发布评级报告,将华润置地有限公司(简称“华润置地)的长期外币发行人...
副总闫增辉遭留置调查!华锦股份... 华锦股份副总经理闫增辉遭留置调查 公司上半年业绩实现扭亏为盈7 月 29 日晚间,北方华锦化学工业股...
近一个月回撤近50%!东吴双动... 都说盈亏同源,何为盈亏同源?近一个月公募基金的剧烈震荡,把这条市场铁律演绎得淋漓尽致。上半年,公募资...