数模测评:doubao1.5>deepseek-v3>gpt-o1

本次测试了当前评价最高的三款大模型doubao1.5、gpt-o1、deepseek-v3(r1崩溃),都是采用无提示词的硬核提问方式,测试视频如下。

gpto1、doubao1.5、deepseek测评

测试方式:

上传美赛六道题目文件

直接提问以下5句话:

  • 这是一道数学建模题目,请做下问题重述

  • 请给出每一个问题的思路

  • 针对每个问题推荐前沿算法

  • 建立第一问数学模型

  • 编写第一问数学模型的程序

相关推荐
暂时先用这个名字4 分钟前
安装deepseek harness及插件
人工智能·ai·npm·pnpm·deepseek·深度求索·harness
skywalk81638 分钟前
用WorkBuddy成功把Deepseek Harness移植到FreeBSD
人工智能·deepseek·harness
GoCodingInMyWay1 小时前
DeepSeek Harness 开始
ai·agent·deepseek·harness
GoCoding1 小时前
DeepSeek Harness 开始
agent·ai编程·deepseek
ovO10 小时前
我按下“发送”之后:DeepSeek Harness 如何把一次请求变成 1,177 个增量片段
人工智能·开源·deepseek
mCell13 小时前
用 Cordis 从零构建一个 Mini DeepSeek Harness
typescript·agent·deepseek
wujian831114 小时前
怎么用千问生成word文档:从「格式崩」到「一键过」,AI导出鸭打通最后半厘米
人工智能·ai·c#·word·豆包·deepseek·ai导出鸭
特立独行的猫A19 小时前
深入 Oh My Pi(omp):终端里最能打的 AI 编程 Agent
deepseek