GLM-4.6与DeepSeek-V3.2-Exp发布

GLM-4.6

GLM-4.6是智谱AI于2025年9月30日发布并开源的新一代大模型,在核心能力上实现显著提升,尤其在代码生成、长上下文处理及智能体应用等方面表现突出.

image

GLM-4.6 是智谱最新的旗舰模型,其总参数量 355B,激活参数 32B。GLM-4.6 所有核心能力上均完成了对 GLM-4.5 的超越,具体如下:

高级编码能力:在公开基准与真实编程任务中,GLM-4.6的代码能力对齐Claude Sonnet 4,是国内已知的最好的Coding模型。

上下文长度:上下文窗口由128K→200K,适应更长的代码和智能体任务。

推理能力:推理能力提升,并支持在推理过程中调用工具。

搜索能力:增强了模型在工具调用和搜索智能体上的表现,在智能体框架中表现更好。

写作能力:在文风、可读性与角色扮演场景中更符合人类偏好。

多语言翻译:进一步增强跨语种任务的处理效果。

CodeGeeX已集成GLM4.6

image

生成单测

image

DeepSeek V3.2 Exp

DeepSeek-V3.2-Exp是深度求索公司于2025年9月29日发布的实验性大模型,核心创新与特点如下:

技术架构

‌稀疏注意力机制‌:引入自研的DeepSeek Sparse Attention(DSA),通过细粒度稀疏化处理长文本,显著提升训练和推理效率,计算成本降低近9倍

该机制采用128维FP8精度Lightning Indexer优化索引过程,同时保留FP16核心计算精度

‌性能验证‌:在公开评测集上表现与前代V3.1-Terminus持平,长序列上下文支持达160K(华为云适配)

成本优化

‌API降价‌:调用成本降低50%以上,新价格为每百万tokens输入0.2元(缓存命中)/2元(未命中),输出3元

‌开源生态‌:模型及GPU算子(TileLang/CUDA版本)已在Hugging Face和ModelScope平台开源,支持国产芯片(寒武纪、昇腾、海光DCU)深度协同

image
DeepSeekV3.2

参考

docs.bigmodel.cn

github.com/deepseek-ai...

相关推荐
秋邱19 分钟前
不仅是极速:从 CANN SHMEM 看 AIGC 集群通信的“安全微操”艺术
安全·aigc
鸽芷咕1 小时前
AIGC 辅助模型压缩:从 amct 仓库看智能量化策略生成
aigc·cann
那个村的李富贵1 小时前
昇腾CANN跨行业实战:五大新领域AI落地案例深度解析
人工智能·aigc·cann
芷栀夏1 小时前
CANN 仓库实战:用 DrissionPage 构建高效、稳定的 UI 自动化测试框架
ui·aigc·transformer·cann
七月稻草人1 小时前
CANN生态ops-nn:AIGC的神经网络算子加速内核
人工智能·神经网络·aigc
云边有个稻草人2 小时前
CANN:解构AIGC底层算力,ops-nn驱动神经网络算子加速
人工智能·神经网络·aigc·cann
lili-felicity2 小时前
CANN加速Stable Diffusion文生图推理:从UNet优化到内存复用
人工智能·aigc
Token_w2 小时前
CANN ops-nn仓库解读——AIGC模型高效运行的算子基石
aigc
禁默3 小时前
【硬核入门】无需板卡也能造 AI 算子?深度玩转 CANN ops-math 通用数学库
人工智能·aigc·cann
七月稻草人3 小时前
CANN ops-nn:AIGC底层神经网络算力的核心优化引擎
人工智能·神经网络·aigc·cann