语言模型测试系列【9】

语言模型

  1. 文心一言
  2. 讯飞星火
  3. 通义千问2.5
  4. 豆包
  5. 360智脑
  6. 百小应
  7. 腾讯元宝
  8. Kimi
  9. C知道

好长时间没有做语言模型的测试了,一方面是没有好的素材,各模型都在升级优化,而且频率很高;另一方面近期在阅读和学习其他的知识,所以更的也少了。本次发布的文章同时更新了部分大模型的称呼。

提问及回答

问题 :Qwen1.5-7B-Chat
说明 :对,没错,问题就是这个千问的语言模型,最近在研究语言模型这款的搭建和使用,不经意间就想问Qwen1.5-7B-Chat相关的内容,但不知道从何问起,于是就只是把模型名输出来,让个各大模型来给我提供一些灵感了。

文心一言

讯飞星火

通义千问2.5

豆包

360智脑

百小应

腾讯元宝

Kimi

C知道


对比分析

这次的的对比很明显的豆包文心一言讯飞星火 胜出,这两个大模型的回答都很准确,而且回答内容各有千秋,都能用上,特别是豆包 的理解过程,提供出了搜索来源;而文心一言 后面有度娘这么大一搜索平台支撑,确没有提供出这点功能展示,着实有点小失落;讯飞星火提供的摩搭平台的资料来源,着实是一大助力,对搭建模型的研究来说,很是及时。

至于腾讯元宝把这个模型占为己有的做法。。。,这里就不做评论了,貌似腾讯的好多应用都有类似案例

其他模型嘛,除了C知道的回答里可以转成"思维导图"的设计,着实是一个亮点。

从上面几个大模型的回答,从主观意识上对比如下:

模型名称 回答内容
文心一言 准确
讯飞星火 准确
通义千问2.5 没回答出来
豆包 准确
360智脑 没回答出来
百小应 没回答出来
腾讯元宝 回答错误
Kimi 没回答出来
C知道 没回答出来

总结

对于当前搜索模型的需求来说,讯飞星火 提供的摩搭资源链接,确实是很不错的回答;其次就是豆包 的搜索来源提供,可以让我们更方便的有据可循、追本溯源。
文心一言,我觉得可以多借鉴一下其他模型,继续优化自身,当然了,因为3.5是免费的,咱也没再测4.0版本,兴许做的更好呢。 ^v^

加油~~~

相关推荐
AI码农小姐姐5 分钟前
AI漫剧推文短视频动态镜头实现:FFmpeg zoompan 与 Ken Burns 效果实践
人工智能·音视频·ai工具·ai漫剧
技灵AI12 分钟前
ChatGPT Images 2.5 深度解读:延迟减半、Sketch 草图与 Flare/Sunburst 双模型 API
人工智能·gpt·aigc·音视频·images2.5
Geek-Chow14 分钟前
12. 完整重演:一句话请求的完整旅程 + 动手练习
人工智能
m0_7345717614 分钟前
深入理解人工智能chatGPT 外部工具与知识增强层 (Tools & RAG Layer)
人工智能·chatgpt
智能运维指南17 分钟前
2026年企业自动化运维平台选型:四类架构的差异与决策逻辑
运维·人工智能·嘉为蓝鲸
user_admin_god17 分钟前
第 01 篇:OpenAI 兼容 API 初探 —— 用 curl 跑通第一次对话
java·人工智能·spring boot·语言模型·devops
梦帮科技18 分钟前
RNS 代币架构:ERC20 五件套扩展与六钱包分配
人工智能·sql·区块链·database·合成复用原则·加密货币
林澈在路上25 分钟前
游戏场景背景音乐定制AI软件哪款好 2026对比推荐
大数据·人工智能·aigc·音视频
宁渡AI大模型1 小时前
AI 全栈面试新趋势:Vibe Coding、前端、Java 后端高频面试题深度解析|河南宁渡科技有限公司编程教程
java·javascript·人工智能·python·ai大模型
AI码农小姐姐1 小时前
AI漫剧推文短视频自动化生产:从文本分镜到视频合成的工程实现
人工智能·音视频·ai工具·ai漫剧·知漫剧