计算机的错误计算(二百零四)

摘要 利用两个大模型判断:在(0, ) 范围内, 等价吗?实验表明,两个大模型(其中一个是数学大模型)均在输出幻觉,均说等价!

例1. 在(0, ) 范围内, 等价吗?

下面是一个大模型的回答。



以上为一个大模型的回答。

下面是与另外一个大模型的对话。



点评

(1)首先,它们是不等价的。等价的是:

(2)因此,两个大模型(其中一个是数学大模型)的结论均是错误的。

(3)其中,红色字体 \arccot 是大模型写错了:在latex 排版系统中没有符号 \arccot(虽然有 \arcsin、\arccos、\arctan 等),所以浏览器不认识。

(4)模型一,前3步均是正确的;但是,第4步结论是错误的。说明什么呢?说明它没有智能。

(5)模型二,"设φ=arccot(A),则cotφ=1/A。"显然是错误的。为什么会出现这样的错误呢?为了得出想要的结论?

(6)大模型的推理很厉害。但是,其公然歪说、瞎说,这个怎么说呢?

相关推荐
南方程序猴3 分钟前
Windows一键安装Codex所有环境
人工智能·gpt·ai·chatgpt·ai编程
MartinYeung54 分钟前
[论文学习]LLM智能体无法保密:多智能体系统中的隐私评估
人工智能·学习
only-qi10 分钟前
大模型应用如何保证实时性和多轮对话一致性
人工智能·llm
thesky12345611 分钟前
27届大模型面试准备(二十):评测体系全攻略——Benchmark、数据污染、LLM-as-Judge 与 Arena 对战
大模型·benchmark·模型评测·llm-as-judge·数据污染·elo·mmlu
吾AI科技13 分钟前
Agent的诞生(三):Skill —— 让模型掌握处理复杂流程的能力
ai·agent·智能体
数据智研14 分钟前
【数据分享】中国民政统计年鉴(1949-2025)
大数据·人工智能·信息可视化·数据分析
武子康17 分钟前
GPT-Live 可能怎样实现:从公开行为到架构约束的证据梯度
人工智能
问商十三载18 分钟前
大模型采信内容看的不是字数?2026语义信噪比模型深度解析
人工智能
智驾19 分钟前
API Error: 400 messages...... 解决方案
ai·claude·kimi
大鹏的NLP博客20 分钟前
大模型 Tokenizer:从字符到 Byte,再到大词表
深度学习·机器学习·大模型·分词