ChatGPT or BingChat

你相信我们对大模型也存在「迷信权威」吗?

ChatGPT 的 GPT-4 名声在外,我们就不自觉地更相信它,优先使用它。但我用 ChatALL 比较 AI 大模型们这么久,得到的结论是:

ChatGPT GPT-4 在大多数情况下确实是最强,但综合费用、访问难度、封号风险等条件,它就不是了。而大多数人在用的 ChatGPT 3.5,就更不是了。

那么最强的是谁呢?Bing Chat!先列举几个客观事实,再做主观分析。

ChatGPT 3.5 ChatGPT 4 Bing Chat
费用 免费 每月 20 美元 免费
注册 国外手机号 国外手机号 任意邮箱
封 IP
封帐号
浏览器兼容 只 Edge

从上表可以看出,除了浏览器兼容这一项以外,都是 Bing Chat 更好。

下面再主观分析下模型的效果,毕竟这个是王道。

先透露一个小道消息。据说,Bing Chat 比 ChatGPT 更早使用了 GPT-4 模型。甚至可能从第一天就是 GPT-4。但为什么没有人说 Bing Chat 比当时的 ChatGPT 3.5 更强?大概就是明星光环导致的吧。

Bing Chat 的三个风格:创造力、平衡和精确,从一开始时就不是同一个模型设了不同的 temperature 那么简单。

起初,创造力的模型是 h3imaginative,平衡是 harmonyv3,精确是 h3precise。从命名看,平衡就很独特。后来不知道某一天「平衡」变成了 galileo(伽利略),更独特了。

chatall.ai 同时发 prompt 给它们,能明显感觉到「平衡」的生成速度更快。这也说明基础模型和另两个大有不同。可能是 GPT-3.5,也可能是 GPT-4 最新的蒸馏调优版(就像现在的 3.5 比最早的 3.5 快很多一样)。后者的可能性更大。

也就是说,Bing Chat 就是免费的 GPT-4 了,何必还费劲去鼓捣 ChatGPT 呢?

如果以上分析还不够说服力,那么我们来看客观数据。

下面是 chatall.ai 五月份的数据统计:

解释下数据:

  1. 发送、加亮、删除和拷贝四列是用户对大模型做对应操作的次数,「率」就顾名思义了
  2. 「加亮」是突出显示,表示这个结果好。但因为 ChatALL 现在长期保存数据的能力还不够,这个操作的意义不大,不是很能说明问题
  3. 「删除」表示这条结果太差了,不想再看到了。但因为 ChatALL 这段时间在 Bing Chat 上出了不少 bug,很可能有大量出错信息被删除
  4. 「拷贝」表示这条结果我打包带走拿去用了,是另一种认可,且可能是最强的认可

坦率说,因为基数不够大,以及各种缺陷,这个数据只能参考。但考虑到 ChatGPT 的光环加持,Bing Chat 受 ChatALL bug 的负面影响,还是可以说明 Bing Chat 和 ChatGPT 4 效果上是伯仲之间的。

转载:https://zhuanlan.zhihu.com/p/633148476

相关推荐
数字游民95271 小时前
gpt image 2怎么用?附超全提示词案例库
人工智能·gpt·ai·opc·waytoopc·数字游民9527
guokai.wu2 小时前
GPT-5.5 简要介绍(免费使用方法)
gpt
陈天伟教授3 小时前
GPT Image 2-城市海报
开发语言·人工智能·gpt·神经网络
陈天伟教授3 小时前
GPT Image 2-天府成都
人工智能·gpt·安全
AI 赋能5 小时前
深入探讨OpenAI ChatGPT 4o图像API的运用与操作
人工智能·chatgpt
AIGC大时代5 小时前
Gemini做裁判,用vibe-coding的方式对比DeepSeek-V4和ChatGPT-5.5的学术水平!DeepSeek惊艳了!
chatgpt·ai论文·deepseek·ai学术写作
JavaEdge.5 小时前
GPT-5.5 发布:一种面向真实工作的全新智能形态
gpt
熊文豪5 小时前
拆解 awesome-gpt-image-2-prompts:一份 GPT-Image-2 的社区实战提示词样本
gpt·dreamweaver·gpt-image-2
Rabbit_QL5 小时前
【ChatGPT Image2 全景图实战】从提示词到电影级长镜头画面
人工智能·chatgpt
Resistance丶未来6 小时前
DeepSeek-V4 新手快速上手指南
数据结构·python·gpt·算法·机器学习·claude·claude 4.6