不知道大家清不清楚之前DeepSeek融资的事儿,简单的说一下背景:
之前DeepSeek一直秉持着不融资、不上市、不商业化的原则。
但是后来可能是因为种种原因的推动,DeepSeek最终还是决定正式走向资本市场。
于是在5月中旬组织了这场线上4个小时的投资者交流会,当时是每个机构有两个参会名额。
整体流程就是梁文锋先讲 ,然后投资者提问 ,梁回答。
因为当时貌似是闭门会议,大家都只是有一些只言片语的金句流传了出来,最近elsewhere和腾讯科技整理了梁文锋会议上发言的实录,大家有兴趣的可以去找原文看一下。(推荐腾讯科技的,更多更详细一些)
这里贴一下地址:baijiahao.baidu.com/s?id=187147...
整个发言信息量非常大,我看完以后不由得佩服人家的格局 和做事的方法。
我也从一些小的细节中发现了可能是DeepSeek选择走向资本市场的原因,当然,不一定对,只是我的猜测。
腾讯科技这边的文章将整个发言分成了11个话题,从中大家或许可以管中窥豹,了解一下DeepSeek到底在走一条什么样的路。
我也班门弄斧的简单解读一下,有不成熟和曲解意思的地方希望大家海涵。
愿景与克制
DeepSeek一开始做并没有想着要挣大钱,而是想着做一件对人类有益 的事情。(虽然我认为公司本身就具备商业化的底色)
抱着这么一种愿景,一种初衷DeepSeek从十几个人出发,走到现在。
靠的是共同的目标,而不是KPI的硬性要求。
而且DeepSeek在做事的过程中保持了高度的克制,只做主线上的事情,DeepSeek理解的主线就是AGI。
他们的长久目标就是AGI,一切跟AGI有关系的都会倾尽全力去做。
克制是目前DeepSeek能坚定向下的核心之一。资源是有限的,利益是无限的,有时候克制自己,少做一些,反而能够提高做成的概率。
也正是因为克制自己,所以在同行同业的眼中DeepSeek并不是一个巨大的威胁,而是一个友好的伙伴。
这个伙伴只做自己路上的事情,并且愿意用自己的力量帮助别人,而不侵吞别人的份额。
虽然看起来可能少拿了很多东西,但事实上却是拿到了自己原本想要得到的部分,并且还没有引起他人的仇视,甚至有加分。
AGI路线图
DeepSeek理解AGI的实现是一个渐进式的过程,是一个阶梯性质的过程,不可能一蹴而就。
去年的阶梯是思维链,今年的阶梯是Agent,通过持续学习能力的迭代,接下来可能会达到一个奇点。(这里我理解可能有些"量变引发质变的拐点"的意思,这可能是一个过程,不是一个瞬间)
这个奇点就是Agent能够达到自我迭代 ------> 持续学习 ------> 自我迭代的一个过程,这时候就能够进入下一个阶梯具身智能。
DeepSeek在这条路上也始终秉持克制的原则,只做AGI的主线。
不做AI相关附属路线上的东西,比如图片生成、视频生成、3D生成等等,这些东西可能背后都是一个巨大的生意,但是DeepSeek选择在当前的资源和阶段下不做这方面。
保持高度的专注,专注于AGI这条主线上的事情,努力推动AI进入下一个阶梯,通用智能或者说具身智能。
而现阶段要解决的主要问题就是持续学习,现阶段仍然依赖于训练达到一个更强的模型,努力的目标是自我的持续学习,自我迭代。
自己能够开发自己的下一个版本,更强的模型,直到进入具身智能阶段。
团队与人才
所有的人聚在一起不是单纯的为了利益,或者是简单的将聪明人聚在一起。
想要让大家在一起合作,奔着一个目标走,核心要有自己的愿景。
大家坚持一个愿景,一个目标往下走,团队就能足够稳定,也就能够做成AGI。(这里梁的原话是:只要我能够保持团队的稳定性,我一定能做成,一定能做成AGI,就这么简单。个人感觉非常的自信且坚定)
在现在这个阶段下,钱不是问题,资源也不是问题,团队的稳定性其实才是公司的核心利益。
梁原话:这也是我们面临的一个非常大的挑战,或者说,我觉得是最大的风险。当然,这个风险随着我们近期的这一次融资,得到了比较大的解除。因为大家拿到的期权都还是比较多的,金额还是比较大的。
所以我理解,DeepSeek的这次融资目的之一也是为了维持团队的稳定性,虽然大家都是奔着同一个目标来的。
但是面包也是要有的,这次融资让大家拿到期权也是DeepSeek让利的一部分。
并不是说用钱来捆绑大家,而是用钱让大家不这么焦虑。
毕竟现在AI人才的竞争还是非常大的,各家挖角的投入不断加码下团队内部也可能出现一定的动荡。
让大家吃饱以后重新明确目标,未尝不是一个好办法。
因为整个团队的人员并不全为钱做这件事,本身他自己就是有理想,想要完成这件事的,解决完基本需求以后才能更好的坚定目标。
DeepSeek内部也没有什么KPI来约束人,它们希望自己有时间去研究自己感兴趣的领域。
并且因为足够的克制和专注,需要做的事也很少,也不需要加班来完成。梁认为做研究需要一个比较松弛的环境 ,兴趣需要在松弛的环境里才能发展。(我们老板只会觉得工作量不饱和)
算力与资源
现在显卡不够,越多越好。但是要保证在合理价格内买到显卡,这个任务非常艰巨。(美国禁售)
梁认为我们和美国的差距主要在资源上,所有的区别其实归根结底都是算力资源的区别。
我们落后美国大概是两年,需要用美国二十分之一的算力来做成AI这件事。经过我们的持续努力将这个差距不断地缩小,落后的时间不断缩小。
目前DeepSeek训练的V4并不是说这么大的模型就足够用了,而是当前资源下只能训练这么大的。
硅谷在说Scaling到头了,但是对于我们来说还远不止。(这里我理解Scaling说的应该是随着参数、数据、计算量的增加,使得AI的智能性能呈可预测的幂律提升并能涌现新能力。这是个方法论哈,不是啥定律。)
国产芯片与生态
英伟达的护城河到后面会被瓦解,因为AI本身能够推动显卡的开发迭代。
游戏卡后面会和计算卡分开,后续的计算卡应该全部都是采用专用的计算芯片。
后续国产卡的生态会迅速崛起,这应该归结于美国禁售带来的"迫不得已",所以后续国产算力会迎头赶上。
竞争格局与行业判断
在整个行业竞争中,中国很可能扮演的角色还是产能最大、电力最多、产品最便宜的角色。
就像我们现在输出自己的商品一样:量大、质优、价廉。
OpenAI一开始可能真的是奔着垄断全世界去的,但是他会不断地遇到挑战者。
而且我们这个挑战者愿意在整个利益分配过程中比他拿的更少,拿的多遇到的阻力肯定要比拿的少大。
DeepSeek商业化的道路上只取自己应得的那部分,产品力上一定不比美国差,成本上肯定比美国低,所以竞争力肯定比美国更强。
模型研发与技术
后续竞争的公司比拼的很有可能是成本控制。
多模态方面DeepSeek也一直在做,V4后续发布的版本会支持原生多模态。
公司内部秉持着自己觉得好用,再推向他人的想法。
商业化与定价
目前DeepSeek的API定价处在一个合理的范围(我个人觉得不便宜),在当前背景下受限B端业务的应该是需求,而不是技术本身。
但是目前来看B端需求正在快速增长,但是不会增长到无穷大。
所以商业化方面主要是来自B端的收入,加上C端用户。
以明年B端的收入需求规模,公司可能很久实现净利润转正了。
最差的一种情况就是卖API,即便是这样也足够支撑一个上市公司了。
开源策略
DeepSeek目前还吃秉持着开源的策略,因为闭源没有任何好处。
即便是开源,想要做起来也是有门槛的,这个门槛也非常高。
开源并不影响商业收入,我们致力于AGI主线的发展,开源本身并不让我们损失任何东西。
数据与后训练
数据标注目前成为成本的很大一部分,高质量数据标注的成本非常高,无论中国还是美国。
现阶段仍然采用两条腿走路,自己标+外标。目前自己标的是成本比较低的部分。
组织与公司定位
公司没有模仿对象,每一步都是从自身的实际情况出发的。
DeepSeek明确是要商业化的,因为毕竟是一个公司。但是只赚该赚的钱,这个过程中有取舍。
希望从公司出发能够将AI这个盘子做大,并且DeepSeek有足够的自信能够成长"大盘子"中一家万亿级别的公司。(非常自信)
总结
我非常推荐大家深度看一看原文,创始人的格局非常大,人也足够自信。
最为关键的一点在于,明白自己的边界在哪里。在当前资源下能够做成什么心里有数,并且对于行业走向能够精准的给出自己的判断。
DeepSeek开启融资或许是为了稳定团队内部,但中国有这样极具自信和能力的团队做AI一定是能够成功的。