全网都在等DeepSeek V4正式版,看梁文锋到底是“梁圣”还是“牢梁”时,一份网传的闭门会记录刷屏了。看完三个多小时的投资人交流会内容,许多人心服口服。
DeepSeek正在推进首轮外部融资,梁文锋在会上聊了不少硬核技术思路。今天不重复语录,重点拆解背后的商业逻辑——DeepSeek到底想下什么棋。
TileLang:脱离英伟达生态的第一步
据网传信息,DeepSeek正在尝试摆脱英伟达的CUDA生态,关键武器是一个叫TileLang的编程语言。去年9月,DeepSeek发布V3.2-Exp时,公告里就提到“使用高级语言TileLang进行快速原型开发”。当时业内就注意到,它没选更常见的Triton,而是选了2025年1月才开源的TileLang。

CUDA是英伟达2006年推出的GPU编程平台,全世界大部分AI模型都建立在它之上。买别家芯片,硬件跑分不差,但一跑真实训练任务就拉胯,因为编译器、算子库、通信库的生态远不如CUDA成熟。这是英伟达真正的护城河。
TileLang瞄准的是写算子的方式。它在开发者和底层硬件之间加了一层翻译器,工程师用接近Python的方式告诉它算子要干什么,编译器处理底层细节。在英伟达卡上,最终仍走CUDA;但换成别的芯片,上层代码可以复用,不必从头手搓所有算子。再结合DeepSeek正在适配昇腾的消息,意图很明确:未来一声令下,直接拎包入住。
便宜没好货?DeepSeek的定价逻辑
DeepSeek的定价一直是行业谜题。但根据网传说法,利润不低,基本不到一年能回本。因为用的人太多,反而稳赚不赔。而且海外模型没把成本放在最关键位置,不缺算力;DeepSeek一直缺算力,又追求长期主义,所以有动力研究低成本模型。

大模型本质是词语接龙机器,上下文越长,计算量越大。Token多了,再便宜也扛不住。DeepSeek的杀手锏是缓存命中——它用MLA(多头潜在注意力机制)把KV Cache暴力压缩。传统架构存全部中间数据,文件巨大;MLA压缩成极小的摘要,用时还原,效果几乎不损。比如上下文10万时,DeepSeek V4 Pro的缓存文件只有0.4个G,友商直接干到6个G。
Anthropic也能做缓存命中,但只保留5分钟,因为缓存文件太大,存在内存或显存里太贵。DeepSeek的缓存能保留几小时到几天,靠的就是MLA。这技术在DeepSeek V2发布时就搞出来了,从架构设计第一天就把效率当核心目标。
以少胜多的顶级阳谋
去年春节那波泼天流量,搁任何公司都是连夜融资、疯狂投放。DeepSeek呢?不买量、不急着变现,连留存数据都懒得做,用得太猛还想把你踹出去。不是不想赚钱,而是现在不想赚钱。他们心里装着AGI,认为C端Agent、世界模型都是通往AGI大道上顺手的事。

DeepSeek信奉一条底层逻辑:AI太大了,大到不可能被独占。如果AI未来能吃下全球GDP的10%,任何一家科技巨头都吞不下。而且想吃独食的,往往死得最惨,同行会合伙防你,监管盯着你,市场还会免费平替。最终竞争会变成一场反向拍卖:谁要得少,谁价格低、朋友多、阻力小,谁就能活到最后。用爱发电不可能,但少拿一点、多让一点,换的是把AGI做成的概率。只要蛋糕足够大,随便分一点就很大。
在这个大家都急着做C端应用套现、卷流量商业化的时代,能有这么一家公司专注AGI的终极天花板,本身就是一件吸引人的事。蓝色大鲸鱼已经在水下憋足了劲儿,DeepSeek V4正式版能否再次刷新认知?拭目以待。