计算机的错误计算(一百八十七)

摘要 用大模型计算 sin(123.456789). 其自变量为弧度。结果保留16位有效数字。第一个大模型是数学大模型。先是只分析,不计算;后经提醒,才给出结果,但是是错误结果。第二个大模型,直接给出了Python代码与结果,其中结果中最后一位数字错误。第三个大模型,也是给出Python代码,代码正确,但是结果错误。

例1. 用大模型计算 sin(123.456789). 其自变量为弧度。结果保留16位有效数字。

下面是与一个数学大模型的对话。



以上为与一个数学大模型的对话。

下面是与另一个大模型的对话。



以上为与另一个大模型的对话。

下面是与第三个大模型的对话。



点评:

(1)正确答案是 -0.8044063476133953(ISRealsoft 提供)。

(2)三个大模型的输出依次为 0.8064165273072594、-0.8044063476133956以及-0.4285105141394708 .

(3)显然,第一个与第三个大模型的输出是错误的;第二个大模型的输出只有 1 位错误数字。

(4)第一个大模型是数学大模型。它先是分析;后经提示,才给出结果。第二个大模型是直接给代码,再结果。第三个大模型说了一句话再给代码并结果。

(5)第一个数学大模型偏重中小学数学?

(6)后两个大模型的代码相同,但是,怎么有一个结果是错误的?看来是没计算,结果是抄来的?

(7)看来大模型的逻辑分析功能很强。但是,计算功能很弱。

相关推荐
Mengke2 小时前
以「asset-price-mcp」为例,从 0 开发 MCP Server
llm·mcp
阿坡RPA8 小时前
手搓MCP客户端&服务端:从零到实战极速了解MCP是什么?
人工智能·aigc
用户27784491049938 小时前
借助DeepSeek智能生成测试用例:从提示词到Excel表格的全流程实践
人工智能·python
机器之心8 小时前
刚刚,DeepSeek公布推理时Scaling新论文,R2要来了?
人工智能
算AI10 小时前
人工智能+牙科:临床应用中的几个问题
人工智能·算法
simplify2010 小时前
【译】Anthropic:推理模型的思维链并非总是忠实
llm·deepseek
几米哥10 小时前
从思考到行动:AutoGLM沉思如何让AI真正"动"起来
llm·aigc·chatglm (智谱)
凯子坚持 c11 小时前
基于飞桨框架3.0本地DeepSeek-R1蒸馏版部署实战
人工智能·paddlepaddle
你觉得20511 小时前
哈尔滨工业大学DeepSeek公开课:探索大模型原理、技术与应用从GPT到DeepSeek|附视频与讲义下载方法
大数据·人工智能·python·gpt·学习·机器学习·aigc
8K超高清12 小时前
中国8K摄像机:科技赋能文化传承新图景
大数据·人工智能·科技·物联网·智能硬件