DeepSeek V3.1 发生严重bug!请立即停止在编码或数据精度较高的场景使用!

DeepSeek V3.1 发生严重bug!请立即停止在编码或数据精度较高的场景使用!

"极" 字当头!

DeepSeek V3.1 在 8 月 21 日悄悄上线时,业界都在关注它 128K 的超长上下文窗口和比 Claude Opus 便宜 68 倍的成本优势。谁也没想到,这个支持国产芯片 FP8 格式的硬核模型,会栽在一个简单的汉字上。

null

用户陆续发现,无论是写邮件、编代码还是生成散文,"极" 字总会毫无征兆地插队。有人调侃说这是模型在练习书法,也有人猜测是不是开发者偷偷植入了 "极致优化" 的 KPI 密码。

null

为什么 AI 会犯这种小学生错误?

DeepSeek V3.1 这次可能栽在两个技术点上:一是分词器更新时没校准好 "极" 字的编码,二是 FP8 格式压缩数据时把某个特征误判成了 "极" 字信号。三是没有洗干净数据。

null

静默发布的代价:小 bug 暴露大问题

不同于其他厂商的开发布会,DeepSeek 选择用 Hugging Face 上线的方式低调发布 V3.1。这种 "让产品自己说话" 的自信,在 "极" 字 bug 面前略显尴尬。

截至发稿,官方尚未回应这个小插曲,但社区已经炸开了锅。有人发现繁体中文输出里 "極" 字同样泛滥,证明这不是简单的编码错误。更有意思的是,编程场景里 "极" 字出现频率明显低于文案创作,看来 AI 也知道在代码里要收敛些。

这个小 bug 意外成了测试用户包容度的试金石。

就像当年计算器刚普及人们担心算错数,如今的 AI 错误本质是技术进步的必经之路。DeepSeek 用 68 倍成本优势证明了国产化的潜力,而一个 "极" 字的小插曲,或许能让整个行业更重视细节打磨,,让我们也给DeepSeek 一些改进的机会。

相关推荐
小白跃升坊1 天前
倒反天罡!DeepSeek V4-Flash 正式版悄然上线:130亿激活参数,把自家1.6万亿旗舰「以下克上」
ai·大模型·agent·deepseek·v4
爱勇宝2 天前
DeepSeek V4-Flash 更新:代码与 Agent 能力全面增强
前端·后端·deepseek
我是大卫2 天前
图解Transformer:为什么GPT、Claude、DeepSeek都用同一个架构?
gpt·deepseek
我才是银古2 天前
Prompt 工程的"断舍离":如何用更少的词让 AI Agent 更聪明
deepseek·ai平台·opencode
Muscleheng3 天前
Spring Boot 3.x 集成 DeepSeek 实现 Function Calling(工具调用)
人工智能·spring boot·后端·ai·spring ai·deepseek
minhuan3 天前
主流大模型能力边界:GPT-4o、Claude3.5、Llama3、Qwen、DeepSeek横向对比22.6
qwen·大模型应用·llama3·gpt-4o·deepseek·主流大模型能力边界·claude3.5
AC赳赳老秦3 天前
软著公开信息批量采集:OpenClaw 抓取软件著作权公开数据,分析企业技术布局方向
大数据·网络·人工智能·python·php·deepseek·openclaw
张申傲3 天前
拆解 harness9(10):Benchmark 驱动开发
人工智能·ai·agent·deepseek·harness
lincats3 天前
Matt Pocock 演讲逐帧拆解:好 Skill 和坏 Skill 的差距就在这 4 个维度
ai·codex·ai agent·deepseek·claude code
我才是银古3 天前
My OpenCode × DeepSeek Config 实战:从一行需求到 13 次提交的全自动化开发管线
deepseek·opencode