计算机的错误计算(一百八十七)

摘要 用大模型计算 sin(123.456789). 其自变量为弧度。结果保留16位有效数字。第一个大模型是数学大模型。先是只分析,不计算;后经提醒,才给出结果,但是是错误结果。第二个大模型,直接给出了Python代码与结果,其中结果中最后一位数字错误。第三个大模型,也是给出Python代码,代码正确,但是结果错误。

例1. 用大模型计算 sin(123.456789). 其自变量为弧度。结果保留16位有效数字。

下面是与一个数学大模型的对话。



以上为与一个数学大模型的对话。

下面是与另一个大模型的对话。



以上为与另一个大模型的对话。

下面是与第三个大模型的对话。



点评:

(1)正确答案是 -0.8044063476133953(ISRealsoft 提供)。

(2)三个大模型的输出依次为 0.8064165273072594、-0.8044063476133956以及-0.4285105141394708 .

(3)显然,第一个与第三个大模型的输出是错误的;第二个大模型的输出只有 1 位错误数字。

(4)第一个大模型是数学大模型。它先是分析;后经提示,才给出结果。第二个大模型是直接给代码,再结果。第三个大模型说了一句话再给代码并结果。

(5)第一个数学大模型偏重中小学数学?

(6)后两个大模型的代码相同,但是,怎么有一个结果是错误的?看来是没计算,结果是抄来的?

(7)看来大模型的逻辑分析功能很强。但是,计算功能很弱。

相关推荐
Shockang7 小时前
AI 设计工作流全景拆解:Figma MCP / Claude Design / Codex / Google Stitch
人工智能
To_OC8 小时前
数据集划分不是随便切:手把手切分大众点评情感数据集
人工智能·llm·agent
冬奇Lab9 小时前
每日一个开源项目(第142篇):android/skills - Google 官方 Android 开发 AI Skill 库
人工智能·开源·资讯
冬奇Lab9 小时前
Skill 系列(06):Skill 工程化与治理——路由准确率 38%、压缩节省 76%
人工智能·开源·agent
IT_陈寒11 小时前
Vue这个坑我跳了两次,原来问题出在这
前端·人工智能·后端
新新技术迷11 小时前
Node给AI接口做SSE代理与鉴权
人工智能
redreamSo12 小时前
大模型是不是到顶了?瓶颈到底在哪
人工智能·openai
Oo92012 小时前
Tool Use 背后的技术逻辑
人工智能
姗姗来迟了12 小时前
Vue3封装AI流式对话组件踩坑实录
人工智能