计算机的错误计算(二百零四)

摘要 利用两个大模型判断:在(0, ) 范围内, 等价吗?实验表明,两个大模型(其中一个是数学大模型)均在输出幻觉,均说等价!

例1. 在(0, ) 范围内, 等价吗?

下面是一个大模型的回答。



以上为一个大模型的回答。

下面是与另外一个大模型的对话。



点评

(1)首先,它们是不等价的。等价的是:

(2)因此,两个大模型(其中一个是数学大模型)的结论均是错误的。

(3)其中,红色字体 \arccot 是大模型写错了:在latex 排版系统中没有符号 \arccot(虽然有 \arcsin、\arccos、\arctan 等),所以浏览器不认识。

(4)模型一,前3步均是正确的;但是,第4步结论是错误的。说明什么呢?说明它没有智能。

(5)模型二,"设φ=arccot(A),则cotφ=1/A。"显然是错误的。为什么会出现这样的错误呢?为了得出想要的结论?

(6)大模型的推理很厉害。但是,其公然歪说、瞎说,这个怎么说呢?

相关推荐
pt10432 分钟前
Cisco Splunk for AI Operations:AIOps企业实践
运维·人工智能·自动化
龙腾AI白云3 分钟前
大模型的幻觉怎么治
人工智能·机器学习·知识图谱
刘天远10 分钟前
Agent系统接入编排:评分模型、状态机与Python门禁
数据库·人工智能·python
AgentMaster15 分钟前
零售行业智能客服系统怎么选?3 大场景落地与 4 款平台对比实践
大数据·人工智能·算法
myaifas18 分钟前
如何选择智能体可视化设计的平台
人工智能·ai·ai编程
leizhen1984080927 分钟前
AI 不会注定失控,也不会自动被控制
人工智能·安全
远航计算机28 分钟前
客服记录怎么变成 AI 会引用的内容?五步清洗法
大数据·人工智能·算法·aigc
三声三视32 分钟前
封全站判“允许“,封目录判“禁止“:tri-geo 体检 74 分那次我拆了 31 行 judge_ua
人工智能·ai·skillhub·tri-skill·tri-geo
赋创小助手32 分钟前
Qwen3.8-27B 本地推理 Benchmark 解析:llama.cpp、vLLM、SGLang 与长 Context 的性能差异
服务器·人工智能·大模型·qwen·vllm·sglang·context长度