看完DeepSeek梁文锋内部交流会发言实录,我或许明白了为什么一直坚持不融资的DeepSeek开启了融资之路,也明白了中国人做AI一定是能够成功的

不知道大家清不清楚之前DeepSeek融资的事儿,简单的说一下背景:

之前DeepSeek一直秉持着不融资、不上市、不商业化的原则。

但是后来可能是因为种种原因的推动,DeepSeek最终还是决定正式走向资本市场

于是在5月中旬组织了这场线上4个小时的投资者交流会,当时是每个机构有两个参会名额。

整体流程就是梁文锋先讲 ,然后投资者提问梁回答

因为当时貌似是闭门会议,大家都只是有一些只言片语的金句流传了出来,最近elsewhere和腾讯科技整理了梁文锋会议上发言的实录,大家有兴趣的可以去找原文看一下。(推荐腾讯科技的,更多更详细一些)

这里贴一下地址:baijiahao.baidu.com/s?id=187147...

整个发言信息量非常大,我看完以后不由得佩服人家的格局做事的方法

我也从一些小的细节中发现了可能是DeepSeek选择走向资本市场的原因,当然,不一定对,只是我的猜测。

腾讯科技这边的文章将整个发言分成了11个话题,从中大家或许可以管中窥豹,了解一下DeepSeek到底在走一条什么样的路。

我也班门弄斧的简单解读一下,有不成熟和曲解意思的地方希望大家海涵。

愿景与克制

DeepSeek一开始做并没有想着要挣大钱,而是想着做一件对人类有益 的事情。(虽然我认为公司本身就具备商业化的底色)

抱着这么一种愿景,一种初衷DeepSeek从十几个人出发,走到现在。

靠的是共同的目标,而不是KPI的硬性要求。

而且DeepSeek在做事的过程中保持了高度的克制,只做主线上的事情,DeepSeek理解的主线就是AGI

他们的长久目标就是AGI,一切跟AGI有关系的都会倾尽全力去做。

克制是目前DeepSeek能坚定向下的核心之一。资源是有限的,利益是无限的,有时候克制自己,少做一些,反而能够提高做成的概率。

也正是因为克制自己,所以在同行同业的眼中DeepSeek并不是一个巨大的威胁,而是一个友好的伙伴。

这个伙伴只做自己路上的事情,并且愿意用自己的力量帮助别人,而不侵吞别人的份额。

虽然看起来可能少拿了很多东西,但事实上却是拿到了自己原本想要得到的部分,并且还没有引起他人的仇视,甚至有加分。

AGI路线图

DeepSeek理解AGI的实现是一个渐进式的过程,是一个阶梯性质的过程,不可能一蹴而就。

去年的阶梯是思维链,今年的阶梯是Agent,通过持续学习能力的迭代,接下来可能会达到一个奇点。(这里我理解可能有些"量变引发质变的拐点"的意思,这可能是一个过程,不是一个瞬间)

这个奇点就是Agent能够达到自我迭代 ------> 持续学习 ------> 自我迭代的一个过程,这时候就能够进入下一个阶梯具身智能。

DeepSeek在这条路上也始终秉持克制的原则,只做AGI的主线。

不做AI相关附属路线上的东西,比如图片生成、视频生成、3D生成等等,这些东西可能背后都是一个巨大的生意,但是DeepSeek选择在当前的资源和阶段下不做这方面。

保持高度的专注,专注于AGI这条主线上的事情,努力推动AI进入下一个阶梯,通用智能或者说具身智能。

而现阶段要解决的主要问题就是持续学习,现阶段仍然依赖于训练达到一个更强的模型,努力的目标是自我的持续学习,自我迭代。

自己能够开发自己的下一个版本,更强的模型,直到进入具身智能阶段。

团队与人才

所有的人聚在一起不是单纯的为了利益,或者是简单的将聪明人聚在一起。

想要让大家在一起合作,奔着一个目标走,核心要有自己的愿景

大家坚持一个愿景,一个目标往下走,团队就能足够稳定,也就能够做成AGI。(这里梁的原话是:只要我能够保持团队的稳定性,我一定能做成,一定能做成AGI,就这么简单。个人感觉非常的自信且坚定)

在现在这个阶段下,钱不是问题,资源也不是问题,团队的稳定性其实才是公司的核心利益。

梁原话:这也是我们面临的一个非常大的挑战,或者说,我觉得是最大的风险。当然,这个风险随着我们近期的这一次融资,得到了比较大的解除。因为大家拿到的期权都还是比较多的,金额还是比较大的。

所以我理解,DeepSeek的这次融资目的之一也是为了维持团队的稳定性,虽然大家都是奔着同一个目标来的。

但是面包也是要有的,这次融资让大家拿到期权也是DeepSeek让利的一部分。

并不是说用钱来捆绑大家,而是用钱让大家不这么焦虑。

毕竟现在AI人才的竞争还是非常大的,各家挖角的投入不断加码下团队内部也可能出现一定的动荡。

让大家吃饱以后重新明确目标,未尝不是一个好办法。

因为整个团队的人员并不全为钱做这件事,本身他自己就是有理想,想要完成这件事的,解决完基本需求以后才能更好的坚定目标。

DeepSeek内部也没有什么KPI来约束人,它们希望自己有时间去研究自己感兴趣的领域。

并且因为足够的克制和专注,需要做的事也很少,也不需要加班来完成。梁认为做研究需要一个比较松弛的环境 ,兴趣需要在松弛的环境里才能发展。(我们老板只会觉得工作量不饱和)

算力与资源

现在显卡不够,越多越好。但是要保证在合理价格内买到显卡,这个任务非常艰巨。(美国禁售)

梁认为我们和美国的差距主要在资源上,所有的区别其实归根结底都是算力资源的区别。

我们落后美国大概是两年,需要用美国二十分之一的算力来做成AI这件事。经过我们的持续努力将这个差距不断地缩小,落后的时间不断缩小。

目前DeepSeek训练的V4并不是说这么大的模型就足够用了,而是当前资源下只能训练这么大的。

硅谷在说Scaling到头了,但是对于我们来说还远不止。(这里我理解Scaling说的应该是随着参数、数据、计算量的增加,使得AI的智能性能呈‌可预测的幂律提升‌并能涌现新能力。这是个方法论哈,不是啥定律。)

国产芯片与生态

英伟达的护城河到后面会被瓦解,因为AI本身能够推动显卡的开发迭代。

游戏卡后面会和计算卡分开,后续的计算卡应该全部都是采用专用的计算芯片

后续国产卡的生态会迅速崛起,这应该归结于美国禁售带来的"迫不得已",所以后续国产算力会迎头赶上。

竞争格局与行业判断

在整个行业竞争中,中国很可能扮演的角色还是产能最大、电力最多、产品最便宜的角色。

就像我们现在输出自己的商品一样:量大、质优、价廉。

OpenAI一开始可能真的是奔着垄断全世界去的,但是他会不断地遇到挑战者。

而且我们这个挑战者愿意在整个利益分配过程中比他拿的更少,拿的多遇到的阻力肯定要比拿的少大。

DeepSeek商业化的道路上只取自己应得的那部分,产品力上一定不比美国差,成本上肯定比美国低,所以竞争力肯定比美国更强

模型研发与技术

后续竞争的公司比拼的很有可能是成本控制。

多模态方面DeepSeek也一直在做,V4后续发布的版本会支持原生多模态。

公司内部秉持着自己觉得好用,再推向他人的想法。

商业化与定价

目前DeepSeek的API定价处在一个合理的范围(我个人觉得不便宜),在当前背景下受限B端业务的应该是需求,而不是技术本身。

但是目前来看B端需求正在快速增长,但是不会增长到无穷大。

所以商业化方面主要是来自B端的收入,加上C端用户。

以明年B端的收入需求规模,公司可能很久实现净利润转正了。

最差的一种情况就是卖API,即便是这样也足够支撑一个上市公司了。

开源策略

DeepSeek目前还吃秉持着开源的策略,因为闭源没有任何好处。

即便是开源,想要做起来也是有门槛的,这个门槛也非常高。

开源并不影响商业收入,我们致力于AGI主线的发展,开源本身并不让我们损失任何东西。

数据与后训练

数据标注目前成为成本的很大一部分,高质量数据标注的成本非常高,无论中国还是美国。

现阶段仍然采用两条腿走路,自己标+外标。目前自己标的是成本比较低的部分。

组织与公司定位

公司没有模仿对象,每一步都是从自身的实际情况出发的。

DeepSeek明确是要商业化的,因为毕竟是一个公司。但是只赚该赚的钱,这个过程中有取舍

希望从公司出发能够将AI这个盘子做大,并且DeepSeek有足够的自信能够成长"大盘子"中一家万亿级别的公司。(非常自信)

总结

我非常推荐大家深度看一看原文,创始人的格局非常大,人也足够自信。

最为关键的一点在于,明白自己的边界在哪里。在当前资源下能够做成什么心里有数,并且对于行业走向能够精准的给出自己的判断。

DeepSeek开启融资或许是为了稳定团队内部,但中国有这样极具自信和能力的团队做AI一定是能够成功的。

相关推荐
怕浪猫1 小时前
第6章 检索增强生成:打造知识库驱动型Agent
openai·agent·ai编程
狂师2 小时前
从 LLM 评测到 AI Agent 评测,我的一些思考!
人工智能·程序员·aigc
牧子川2 小时前
何时拒绝使用工具:Agent 不是万能钥匙
人工智能·大模型·agent·tools·functioncalling
MicrosoftReactor2 小时前
技术速递|智能体测试智能体:基于 Foundry Hosted Agents 构建云原生 Skill-Eval Harness
ai·云原生·agent·ai-agent·skill
不好听61311 小时前
Vibe Coding 深度解析:工作流、胶水编程与 Spec-Driven Development
agent
不好听61311 小时前
Vibe Coding 深度解析:从起源到核心原理
agent
菩提小狗12 小时前
AI每日资讯|AI落地|最新情报|skill精选|2026年07月21日(11案例+10爆款Skill)
大模型·agent·skill·ai资讯·ai落地
win4r12 小时前
🚀Graph Engineering范式:Codex Multi-agent V2支持Kimi、MiniMax、GPT多模型混用+动态派生subagent,并行执行、Pi Agent工具调用,效率倍增
aigc·ai编程·vibecoding