AI编程入门教程02-LLM发展历程,AI 御四家十年风云:OpenAI 分裂、Anthropic 出走、谷歌掉队、马斯克上桌

大家好,我是卡卡罗特。

这是我的AI编程入门教程的第2章。

这篇文章主要想跟大家聊一下 AI 的发展历史。

内容很干,看完之后,你会对整个 AI 发展历程、大语言模型发展历程,有个大概的了解。

AI,也就是我们说的人工智能。

这其实是一个很大的词语。 它下面有很多分支领域。

比如各大短视频平台的推荐系统,智能驾驶,人脸识别......这些都是 AI 领域的应用场景。

我们现在所说的 AI、ChatGPT、豆包、Kimi、WorkBuddy......这里面的 AI 其实是大语言模型,Large Language Model,简称 LLM。

这个技术其实早在 2017 年就已经出现了,到现在已经过去了差不多 10 年。

这一切起源于 2017 年,谷歌有 8 位研究员发表了一篇论文,名字叫《Attention Is All You Need》。

标题直译过来是,你需要的只有注意力

论文中最核心的点,就是提出了一种叫 Transformer 的架构。

这个架构是大语言模型的核心。

这个架构非常复杂,用一张图可以概括。

然而,让这篇论文真正出圈,却是在 5 年后。

OpenAI

2022 年底,ChatGPT 发布,它的公司叫 OpenAI。

值得玩味的是,虽然早期的 OpenAI 确实挺 Open,但后来的核心模型基本都没有开源,越来越不 Open 了。 反倒是中国模型持续开源前有kimi后有GLM,都是顶级模型!

仅仅两个月,用户破亿。

相比于现在的 Codex、Claude Code 这种全能的 Agent 而言,当时虽然只是 AI 的早期阶段,但仍然激起了广泛的关注。

因为那时大家对 AI 的关注还只是停留在谷歌的 AlphaGo 下围棋、推荐算法......

ChatGPT 能做到的就是,你打开一个对话框,它能跟你聊哲学、帮你写代码、替你写邮件、甚至模仿莎士比亚写诗。

这东西很新奇,没见过,然后迅速爆火。

当时微博、知乎、微信公众号,很多博主都在推荐 ChatGPT。

但是因为网络问题,国内用户基本用不到。

这就造成了一个非常巨大的信息差。

在国内进一步推动了ChatGPT的爆火。

回到 OpenAI,它的创始人值得一提。

其实 OpenAI 是 2015 年由埃隆·马斯克和**山姆·奥特曼(Sam Altman)**一起发起的。

马斯克是谁? 特斯拉、SpaceX 老板。

奥特曼是谁?

不好意思,放错了,是这个哥们。

马斯克的大名大家都知道,就不必多说了。

奥特曼,这哥们是谁?

奥特曼其实并不是传统的技术出身。

他更像是出身硅谷的精英,更像职业经理人

他斯坦福辍学,19 岁创办位置社交 App Loopt,后来公司卖给 Green Dot,金额大概 4340 万美元。

后来他加入 Y Combinator。

2014 年,年仅 28 岁的奥特曼接替 Paul Graham,成为 YC 总裁

YC 是什么地方?

简单说,就是硅谷创业公司的幕后老板之一。Airbnb、Dropbox、Stripe、Reddit,这些公司都接受过 YC 的投资。

所以奥特曼早期能接触到很多优秀的人才。这个背景很重要。

当时,在 2015 年前后,整个硅谷都在讨论 AI。

当时谷歌已经收购 DeepMind,Facebook、微软、百度都在疯狂招 AI 研究员。大家隐约意识到,下一波技术革命就会发生在 AI 这个领域

但是马斯克这哥们对 AI 挺敏感的。

那几年他一边在特斯拉推 Model X,一边在 SpaceX 做火箭回收。

2015 年 12 月,SpaceX 的 Falcon 9 一级火箭第一次成功垂直降落。

也就是同一个时期,他在公开场合反复警告 AI 风险,认为这东西如果被少数巨头垄断,后果可能很危险。

所以当时马斯克找上奥特曼一起成立 OpenAI 的时候,就已经确定好 OpenAI 的目标。

不是一家商业公司 ,也不是一个营利机构,而是致力于让 AGI(也就是通用人工智能)以一种更开放、更安全的方式发展,最终让全人类受益。

这听起来非常理想主义,也很酷!

就像奥特曼在 OpenAI,他虽然是 CEO,但早年的公开报酬一年只有六万多美元,而且长期没有 OpenAI 股权。某种程度上,也算是为爱发电。

尽管奥特曼和马斯克自己不靠 OpenAI 的工资赚钱,但招人肯定是要发工资的,那就需要投资,需要 Money。

马斯克负责搞钱。

马斯克凭借他的人脉,拉了硅谷很多富豪投资 OpenAI。这里面有纯现金的,也有投资一些算力的......

奥特曼就负责找人才。

在 OpenAI 早期的时候,有几个核心人员有必要说一下。

  • Ilya Sutskever,早期研究负责人。师从 Geoffrey Hinton,此前在 Google Brain 工作。
  • Greg Brockman,早期 CTO,前 Stripe CTO。他负责把研究团队变成持续交付的工程组织。
  • John Schulman,强化学习核心人物,后来深度参与了 RLHF 路线。
  • Wojciech Zaremba,早期联合创始人,研究机器人和深度学习。
  • Andrej Karpathy,早期成员,后来去了特斯拉负责 AI。2023 年短暂回到 OpenAI,2024 年再次离开。2026 年 5 月,他加入 Anthropic 做预训练研究。

然后 2015 年,这波人成立了 OpenAI。

随着 OpenAI 的发展,他们发现训练大型 AI 模型需要的钱越来越夸张。

我们知道大模型训练成本非常高,需要大规模 GPU 集群、数据中心。

当然,这些顶级的研究员也是要付工资的。

这些巨额的投入不是一个非营利组织所能承担的。

然后矛盾就有了。

OpenAI 的核心人员和马斯克都认为,需要将 OpenAI 转向营利公司,但是,双方对于控制权产生了分歧。

马斯克是一个控制欲极强的人, 他要求如果 OpenAI 要商业化,自己需要绝对的领导权,并且要将 OpenAI 并入特斯拉。

但 OpenAI 的核心理念就是拒绝让一个人拥有绝对的领导权。

然后,2018 年马斯克辞去了 OpenAI 董事职位。

这里面有很多原因,比如 OpenAI 太烧钱了,没有足够的资源去跟 Google 等其他大厂竞争,当然,他的理念也和其他核心成员不对付。

然后 OpenAI 通过一系列股权设计,成立了一个营利子公司,但控制权依然在非营利组织手里。

OpenAI 接受了微软的 10 亿美元投资。

后来微软累计投入一路滚到超过 130 亿美元。

当然,这 10 亿美元中有很大部分是算力、技术投资。

这恰恰也是 OpenAI 最缺的。

随着 OpenAI 逐渐商业化,这让早期的一些成员感到不安。

其中最核心的一批人,就是后来 Anthropic 的创始团队。

Dario Amodei,前 OpenAI 研究副总裁。

Daniela Amodei,前 OpenAI 安全和政策副总裁,还是上面这哥们的妹妹。

再加上一些早期核心成员。

他们认为公司在安全性上做得不够,商业化的步子迈得太快了

他们信仰一个理念,AI 太强大了,如果安全没做好,一旦出问题就是灾难性的。

Anthropic

然后在 2020 年底,这批人陆续离开 OpenAI,并在 2021 年创立了一家新公司,Anthropic。

他们做的模型叫 Claude,从一开始就把「安全」和「可控」刻在基因里。

相比 ChatGPT,Claude 回答的风格更谨慎,也更克制。

也就是现在火爆的 Claude Code,做出 Claude 4.6、4.7、4.8,以及 Fable 5 模型的公司。

是那个动不动就封你号,被广大中国开发者一边骂一边用的公司。

有意思的是 CEO Dario Amodei,年轻的时候,在百度工作过。

你没看错,百度。

他博士毕业后,先在斯坦福医学院做了几年博士后,后来进入百度硅谷 AI 实验室,跟着搞 AI 的老前辈吴恩达做语音识别。不过在百度干了不到一年就走了。

谷歌

OpenAI、Anthropic 在大杀四方。提出 Transformer 架构的谷歌在干嘛?

ChatGPT 发布后,谷歌紧急推出了自己的聊天机器人 Bard,后来升级改名,也就是现在的 Gemini。

Gemini 最大的特点是原生多模态------它不是先做一个纯文本模型,再往上面嫁接图片能力。

而是一开始就用文字、图片、音频、视频混在一起训练,这让它在看图理解、图表分析、跨模态推理这些方面非常有优势。

但是相比 OpenAI、Anthropic,现在谷歌唯一拿得出手的似乎只有 Nano Banana 这个生图模型。

不过随着ChatGPT的Image 2.0生成模型的爆火,Nano banana也逐渐失去了吸引力。

如今 GPT 5.6 Sol、Anthropic 的 Fable 模型毋庸置疑是世界第一梯队。

最近 Kimi 的 K3 模型也广受好评,挤入第一梯队。

然而,谷歌的 Gemini 3.5 Pro 迟迟没有发布,继续回炉重造中。

谷歌似乎已经掉队了。

一个发明了 Transformer 的公司,在自己的赛道上,被几家创业公司按在地上摩擦。

在美国科技大厂里,谷歌也是出了名的「养老厂」,很容易犯「大公司病」。

现在AI发展这么快,也许更适合初创企业。

可以发现,这些搞AI的顶级企业,无论是国外的OpenAI, Anthropic,还是国内的Kimi ,DeepSeek,无一例外,都是初创企业。

SpaceXAI

OpenAI、Anthropic 大杀四方,搞 AI 讲故事的能力也更强。

马斯克也没有忘记搞 AI。

他成立了一家叫 xAI 的公司,旗下的模型是 Grok。

相比 ChatGPT 和 Claude,Grok 的用户显然更少,现在一般只有 X 平台才有用户。

老马花了很多钱搞 AI,但一直搞不起来,钱烧了不少。

然后就是 2026 年 5 月 6 号,马斯克正式宣布 xAI 解散,不再作为独立公司运营,整体并入 SpaceX,改名叫 SpaceXAI。

老马的 Grok 模型用户量很少,据外媒报道使用率只有 11%

然后 xAI 把那座坐拥 22 万张 GPU 的 Colossus 1 超级计算机的算力租给了 Anthropic。

每个月能收回 12.5 亿美元,一年就是 150 亿。

XAI 名义上成了一个算力公司

不知道大家知不知道 Cursor 这个编程软件?

AI 编程几乎就是靠 Cursor 带火的,在 2 年前的 AI 编程中,Cursor + Claude 4.6 模型,是地表编程 + 写作的最强搭配。

Cursor 也借助 Claude 模型,让这家初创的小公司赚得盆满钵满。

然而 Anthropic 发布了自己的 Coding Agent ,Claude Code,然后迅速占领市场,火出圈。

OpenAI 也推出了自己的 Codex。

Cursor 似乎并没有那么性感了。订阅用户陆续被抢走,未来岌岌可危。

然后今年 4 月份,老马跟 Cursor 达成协议,拿到了以 600 亿美金收购 Cursor 的选择权。

等到 6 月 16 日,SpaceX 正式行权,签下并购协议,老马即将Cursor收入囊中。

前不久,xAI 的 Grok 4.5 模型爆火。

一直吊车尾的 Grok 模型打了个翻身仗,模型能力仅次于 GPT 5.6、Fable 5,马斯克也因此正式上桌了

你猜的没错,Grok 4.5,的确是和 Cursor 一起训练出来的。老马这笔交易不亏!

看到这里你会发现,所谓 AI 大战,表面上拼的是模型,背后拼的其实是人、钱和权力

OpenAI 从理想主义走向商业化,Anthropic 从 OpenAI 出走,马斯克绕了一大圈,也终于重新坐上牌桌。

国内的AI公司也逐渐迈入第一梯队,像Kimi、Deepseek、智谱...,都是非常年轻,有创造力的公司。

相信要不了多久,与国外顶级公司的差距越来越小。

期待一下吧。

你心目中国内第一AI公司是哪家呢?欢迎评论区交流👏。

我是卡卡罗特,持续分享 从0到1非程序员AI入门编程课程~ 加关注再走呗~

相关推荐
用户3126874877201 小时前
AI Agent 开发实战(二):调用 LLM 不只是发个 HTTP 请求,Prompt 工程才是真功夫
ai编程
Am-Chestnuts1 小时前
AI长回答批量导出PDF与长图:多轮内容整理和免费Markdown备份
人工智能·pdf·aigc
redreamSo1 小时前
32 个 AI 编程工具的配置都放哪,这个仓库整理清楚了
ai编程·claude·cursor
9i编程1 小时前
国内直连 Claude Code 本地部署完整实操手册 ——DeepSeek 兼容接口版
ai编程·claude
leeyi1 小时前
RAG 流水线设计:Eino 的 Loader → Transformer → Indexer → Retriever(第60篇-E46)
aigc·agent·ai编程
liuliuqiqirr1 小时前
2026最新两款AI编程工具深度对比实测
大数据·ai编程
用户216753009732 小时前
Superpowers 卸载潮背后,我做了个轻量替代方案(开源)
ai编程
卡卡罗特AI2 小时前
AI编程入门教程01-VibeCoding前的正确姿势是,先问AI去Github上找项目
chatgpt·ai编程