被AI大模型彻底碾压!我发现我的智商都不够用了

【关注微信公众号:跟强哥学SQL,回复"笔试"免费领取大厂SQL笔试题。】

来看看这道今年的全国甲卷理科数学填空题第1题:

说实话,别说答题思路了,就是看到"偶函数"这个概念,都是它认识我,我不认识它了。

要知道,当年数学可是我的拿手好戏。看来"高考是绝大多数人这辈子的智力天花板"这句话,也印证在了自己的身上。

当然,这道题的答案是什么并不重要。重要的是,像GPT-4、文心一言4.0、通义千问、ChatGLM2等AI大模型,面对这样的高智商计算题,已经能轻松解答了。

有人把今年的147道高考客观题输入各个大模型,正确率如下表:

怎么样?你觉得自己能得第几名?

从结果来看,得分最高的是GPT-4,也才刚刚及格,大家的提升空间都还很大。

但对比GPT-3.5,GPT-4仅仅半代的升级,正确率就提升了42.12%。不敢想像,随着技术迭代升级,AI大模型的智力会提升到一个多么恐怖的水平。

不过,一个好消息是,在AI大模型的战场上,来自我们中国的大模型虽然还有相当的差距,但追赶的希望并非没有。

百度的李彦宏说,截至今年10月份,国内发布的AI大模型数量已经达到238家了。而且还有增加的趋势。

推荐一个GitHub上的开源项目,整理了目前国内发布的比较出名的AI大模型列表。

地址是:https://github.com/wgwang/LLMs-In-China

这个地址可以查到各个AI大模型的官网,以及如何试用,有没有APP等基本信息。

感兴趣的同学可以去看下。

【关注微信公众号:跟强哥学SQL,回复"笔试"免费领取大厂SQL笔试题。】

相关推荐
hh9501 分钟前
gent Plan x DeepSeek Harness:多 Agent 协作场景下的中央编排实践
人工智能·wpf·adg·火山引擎·agent plan·adg成都社区
cczixun17 分钟前
2026 智能体平台落地实战:从 POC 验证到生产上线,避开选型与交付陷阱
人工智能·落地·选型·智能体·2026
IT_陈寒17 分钟前
Redis内存警告竟是因为这个不起眼的配置项
前端·人工智能·后端
CHY_12823 分钟前
VSO.ai 系列(二):AI验证回归优化实战
人工智能·synopsys·vso.ai·验证加速
2401_8900956134 分钟前
武汉人工智能应用软件开发实施异常怎么排查?模拟环境与验证步骤
人工智能·案例复盘·武汉自动意志科技·智钳claw·企业ai智能体·ai漫剧生成
泰迪智能科技011 小时前
三种人社职业技能等级证书报考指南对比:人工智能训练师 / 计算机程序设计员 / 服务机器人应用技术员
人工智能·百度·机器人
森山冶仁1 小时前
AI 原生数据治理技术栈:大模型 + 向量库 + 知识图谱怎么选
人工智能·知识图谱·数据治理
记忆张量MemTensor1 小时前
产品更新|MemOS 现已支持 DeepSeek Harness 长期记忆接入
人工智能·typescript·开源·agent
FII工业富联科技服务1 小时前
WRC 2026技术拆解:从人类示范到真机反馈,机器人“大脑”如何完成训练闭环?
人工智能·机器人·自动化·制造
科里 Coralyx1 小时前
RLHF、InstructGPT、红队测试:从“会生成“到“可交付“
人工智能