Kimi K3正式发布:宣称开源第一,仅次于 GPT-5.6 和 Fable 5

7月17日,月之暗面正式推出 Kimi K3。

官方宣称,虽然 Kimi K3 的整体表现仍落后于最强的闭源模型 Claude Fable 5 和 GPT-5.6 Sol,但它在整套评测中展现出前沿水平的能力,并稳定超过了其他所有模型。

同时,Kimi-K3在前端代码竞技中以76%的胜率和1679的得分位居榜首,超过Claude Fable 5和GPT-5.6。

据官方介绍,Kimi K3 是一个 2.8 万亿参数模型,是全球首个开源的3万亿级别模型。基于 KDA 混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,原生支持视觉理解,并拥有 100 万 token 上下文窗口。

Kimi K3 基于 Kimi Delta Attention(KDA)和 Attention Residuals(AttnRes)构建。同时进一步扩大了 Mixture of Experts(MoE)的稀疏度:结合 Stable LatentMoE 框架后,模型可以在 896 个专家中高效激活 16 个。

再加上训练方法和数据配方的优化,这些结构性改进让 Kimi K3 相比 K2 的整体扩展效率提升约 2.5 倍,能更有效地把算力转化为能力。

官方表示,即日起,可通过 kimi.com、最新版 Kimi 手机App、最新版 Kimi Work 桌面客户端、Kimi Code 和 Kimi API,使用 Kimi K3 模型。

当前默认思考强度为 max(极致),后续更新后会增加 low 和 high 两种模式。

据开放平台公示信息,kimi-k3 采用输入、输出 Token 分开计价模式,计费单位为每百万 Token。其中输入 Token 分两档收费,缓存命中时单价仅 2 元,未命中缓存标准价为 20 元;输出 Token 统一定价 100 元 / 百万 Token。

官方宣称,借助 Mooncake 分离式推理架构,Kimi 官方 API 编程场景的缓存率超过 90%,实际输入价格仅为标准输入价格的 1/4。同时,最高 30% 的充赠活动同步进行中。

官方表示,目前 Kimi K3 仍有局限性。

在后训练过程中全程使用思考历史保留模式,如果 agent 框架未按要求回传全部历史思考内容,或从其他模型正在进行的会话中切换到 Kimi K3,则有可能引发上下文干扰,导致内容生成质量不稳定。官方建议使用 Kimi Code 等经过兼容性验证的 Agent 框架,并避免在会话中途切换到 Kimi K3。

此外,Kimi K3 的训练重点优化了长程、高难任务。因此,在任务执行过程中遇到小问题或用户意图模糊时,它可能会替用户做出非预期的决定。

如果你觉得多模型 切换 、工具订阅的流程太繁琐,也可以试试我们的「胜算云」平台,一站式搞定AI创作与开发相关需求。官网:https://www.shengsuanyun.com/?from=CH_M2SUSXRR

相关推荐
技术程序猿华锋17 小时前
深度解析 GPT-Image-2.5:双架构模型演进、获取API 接入与工程化开发教程
人工智能·gpt
西索斯coding2 天前
GPT-5.6-Luna 接入 Cline 教程:base_url 配置、max_tokens 上限与 ZDR 请求头写法
大数据·人工智能·gpt·ai
whyfail3 天前
开发平替实录:ZCode + 火山 Coding Plan + GLM-5.3-Flash,打不过 GPT-5.6-Sol,但只差一口气的成本
gpt·codex·glm·智谱·zcode
沉默王二3 天前
Codex 最新焚决发布,快!
gpt·agent·ai编程
技灵AI4 天前
ChatGPT Images 2.5 深度解读:延迟减半、Sketch 草图与 Flare/Sunburst 双模型 API
人工智能·gpt·aigc·音视频·images2.5
程序员无隅4 天前
Harness Learn Engineering :用初始化、交接记录与恢复验证,让 Coding Agent 换个会话也能接着干
gpt·ai
邪修king4 天前
Re:Linux系统篇(二十五):文件系统(一):磁盘硬件底层原理:从物理结构到 CHS/LBA 寻址,搞懂硬盘数据的定位逻辑
java·linux·运维·gpt
程序猿编码4 天前
两张 3090 扛 27B:Qwen3.8-27B 大模型 DFlash2 加速版生产级落地
开发语言·gpt·深度学习·神经网络·大模型·qwen
YH55269845 天前
为什么 GPT 要暂停$200 pro 订阅?
gpt·chatgpt