计算机的错误计算(二百零四)

摘要 利用两个大模型判断:在(0, ) 范围内, 和 等价吗?实验表明,两个大模型(其中一个是数学大模型)均在输出幻觉,均说等价!

例1. 在(0, ) 范围内, 和 等价吗?

下面是一个大模型的回答。



以上为一个大模型的回答。

下面是与另外一个大模型的对话。



点评:

(1)首先,它们是不等价的。等价的是:

(2)因此,两个大模型(其中一个是数学大模型)的结论均是错误的。

(3)其中,红色字体 \arccot 是大模型写错了:在latex 排版系统中没有符号 \arccot(虽然有 \arcsin、\arccos、\arctan 等),所以浏览器不认识。

(4)模型一,前3步均是正确的;但是,第4步结论是错误的。说明什么呢?说明它没有智能。

(5)模型二,"设φ=arccot(A),则cotφ=1/A。"显然是错误的。为什么会出现这样的错误呢?为了得出想要的结论?

(6)大模型的推理很厉害。但是,其公然歪说、瞎说,这个怎么说呢?

相关推荐
回眸&啤酒鸭3 小时前
【回眸】私人定制旅游路线助手
人工智能
硅基手札3 小时前
MCP 实战 —— 从零写一个 CRC16 服务器(保姆级)
运维·服务器·ai
用户360055579003 小时前
Day 1·3 确定性测试门:推理引擎的PASS/FAIL自检机制
人工智能
知几蜗牛3 小时前
HydraFusion的Single、Cascade与Critique如何落到工程门禁
人工智能
mit6.8243 小时前
plz直接提交 pull equest
人工智能
Solara3 小时前
29 条回复永远没送到:翻完 108 条投递台账,我才发现「微信限流」是我取错的名字
人工智能·agent·ai编程
lucas_AI3 小时前
别再无脑堆数据了:腾讯 WeVisDoc 把文档解析卷到 95 分,token 是按预算花的
人工智能
橘和柠3 小时前
一台笔记本上的三国杀:eNSP、VirtualBox 与 Docker,我让它们共存了
人工智能
achong3 小时前
AI 写代码比你还啰嗦?用 ponytail「懒人法则」治它
人工智能
柒和远方3 小时前
LangSmith RAG 量化评估:从"感觉还行"到"数据说话"
langchain·llm·测试