京东正式开源基于国产芯片自研的xLLM大模型推理引擎

xLLM是基于国产芯片自研的一款大模型推理引擎,能让企业部署AI应用时,性能更高、成本更低。

目前,京东已将xLLM开源至GitHub。同时,采用Apache 2.0 许可证,这也意味着自由地使用于商业化产品,无任何附加条款。

此次开源的核心功能包括:

1)基于请求优先级的动态调度器;

2)动态自适应的 PD 分离架构,可根据负载实时调整PD实例的比例;

3)面向多模态场景的 EPD 混合分离调度器;

4)基于硬件特性的多级流水线的执行引擎;

5)涵盖图融合、投机推理、动态负载均衡的计算优化套件;

6)基于Mooncake的多级 KV 缓存的全局管理;

xLLM大模型推理引擎源自京东零售核心业务。目前,该技术服务了京东AI助手京言、智能客服、风控、供应链助手、广告等场景,效率提升5倍以上,机器成本降低90%。

我们始终坚信,AI Infra生态建设离不开每一位开发者。开源,只是第一步。接下来,京东零售AI Infra团队会根据社区需求,继续开放更多高级能力,并和清华、北大、中科大、北航等产学研生态伙伴一起,推动国产AI Infra技术生态的协同创新,推动行业智能化升级。

同时,我们诚挚地邀请每一位对 AI Infra技术充满热情的开发者加入我们,无论是提交PR、提出Issue、参加Workshop,还是在社群分享技术实践,都将是对国产AI Infra技术生态最大的支持!

GitHub地址: github.com/jd-opensour...

官方技术交流群:

相关推荐
一点一木8 小时前
🚀 2026 年 4 月 GitHub 十大热门项目排行榜 🔥
人工智能·github
宝桥南山11 小时前
AI - 在命令行中尝试一下ACP(Agent Client Protocol)通信
microsoft·微软·github·aigc·copilot
拾贰_C14 小时前
【Github | GitHub Copilot | 学生认证】 GitHub Copilot学生如何认证
github
旅之灵夫14 小时前
【GitHub项目推荐--OpenArm:开源7自由度仿人机械臂平台】
github
一乐小哥15 小时前
坚持迭代一个 Chrome 插件半年后,我的同事问我:"这不是 Chrome 自带的功能吗?"
chrome·github·ai编程
Smilezyl16 小时前
一个独立开发者,靠一份 markdown 驱动 Claude Code, 用 20 天跑通 9 个包的 monorepo 工程
前端·人工智能·github
峰向AI16 小时前
做小红书、画信息图、动漫图:这个skill太实用了
github
Cosolar16 小时前
封神级 TTS!VoxCPM2 凭连续表征,玩转多语言合成 + 创意音色 + 无损声纹克隆
人工智能·llm·github
码流怪侠16 小时前
【GitHub】andrej-karpathy-skills:让 AI 编程助手告别三大通病
人工智能·程序员·github
码流怪侠16 小时前
【GitHub】OpenClaw:开源个人AI助手的新标杆
人工智能·程序员·github