被AI大模型彻底碾压!我发现我的智商都不够用了

【关注微信公众号:跟强哥学SQL,回复"笔试"免费领取大厂SQL笔试题。】

来看看这道今年的全国甲卷理科数学填空题第1题:

说实话,别说答题思路了,就是看到"偶函数"这个概念,都是它认识我,我不认识它了。

要知道,当年数学可是我的拿手好戏。看来"高考是绝大多数人这辈子的智力天花板"这句话,也印证在了自己的身上。

当然,这道题的答案是什么并不重要。重要的是,像GPT-4、文心一言4.0、通义千问、ChatGLM2等AI大模型,面对这样的高智商计算题,已经能轻松解答了。

有人把今年的147道高考客观题输入各个大模型,正确率如下表:

怎么样?你觉得自己能得第几名?

从结果来看,得分最高的是GPT-4,也才刚刚及格,大家的提升空间都还很大。

但对比GPT-3.5,GPT-4仅仅半代的升级,正确率就提升了42.12%。不敢想像,随着技术迭代升级,AI大模型的智力会提升到一个多么恐怖的水平。

不过,一个好消息是,在AI大模型的战场上,来自我们中国的大模型虽然还有相当的差距,但追赶的希望并非没有。

百度的李彦宏说,截至今年10月份,国内发布的AI大模型数量已经达到238家了。而且还有增加的趋势。

推荐一个GitHub上的开源项目,整理了目前国内发布的比较出名的AI大模型列表。

地址是:https://github.com/wgwang/LLMs-In-China

这个地址可以查到各个AI大模型的官网,以及如何试用,有没有APP等基本信息。

感兴趣的同学可以去看下。

【关注微信公众号:跟强哥学SQL,回复"笔试"免费领取大厂SQL笔试题。】

相关推荐
可观测性用观测云6 分钟前
可观测性 4.0:教系统如何思考
人工智能
sunny86520 分钟前
Claude Code 跨会话上下文恢复:从 8 次纠正到 0 次的工程实践
人工智能·开源·github
小笼包包仔35 分钟前
OpenClaw 多Agent软件开发最佳实践指南
人工智能
smallyoung1 小时前
AgenticRAG:智能体驱动的检索增强生成
人工智能
_skyming_1 小时前
OpenCode 如何做到结果不做自动质量评估,为什么结果还不错?
人工智能
南山安1 小时前
手写 Cursor 核心原理:从 Node.js 进程到智能 Agent
人工智能·agent·设计
掘金安东尼2 小时前
如何为 AI 编码代理配置 Next.js 项目
人工智能
GPUStack2 小时前
Token 不再焦虑:用 GPUStack + OpenClaw 搭一个“无限用”的本地 AI 助手
ai·模型推理·gpustack·openclaw
aircrushin2 小时前
轻量化大模型架构演进
人工智能·架构
文心快码BaiduComate3 小时前
百度云与光本位签署战略合作:用AI Agent 重构芯片研发流程
前端·人工智能·架构