当前位置:首页 > Deepseek最新资讯 > 正文内容

全面适配!京东云将DeepSeek推理场景性能提升50%

8个月前 (03-03)Deepseek最新资讯482

央广网北京3月3日消息 在DeepSeek为期五天的“开源周”中,其连续开源的五大核心技术(FlashMLA、DeepEP、DeepGEMM、DualPipe & EPLB、3FS文件系统),惊艳全球。

京东云率先宣布完成对这五项技术的全栈适配,在模型推理效率、算力资源利用率及数据管理等领域实现突破性优化,综合Flash MLA、DeepEP、FP8 GEMM、DualPipe四方面的调优,在DeepSeek推理场景下性能提升50%。

全面适配五大技术,DeepSeek推理场景性能提升50%

作为DeepSeek开源首日的重磅技术,Flash MLA通过动态调度GPU的显存与算力资源,解决了传统方法处理变长序列时的资源浪费问题。

京东vGPU AI算力平台通过支持Flash MLA的FP8格式来提升推理性能,使单Token的 KV Cache显存占用相比Multi-head Attention降低57倍,配合最新的投机推理技术,以极低的显存需求,在高并发请求场景下保证了推理的吞吐量和延迟表现。

此外,针对用于DeepSeek开源的通信库DeepEP,京东云vGPU AI算力平台已全面支持EP模式下的分布式推理,显著提高推理吞吐。通过整合DeepEP作为通信后端,针对机内通信使用NVLink传输数据,机间通信使用NVSHMEM接口走RDMA网络,同时通过灵活的GPU SM数量利用控制,增大GPU算力资源利用率以及减少对计算算子的性能串。

更低成本更高效率,让大模型真正用起来

针对客户大模型的使用需求,京东云vGPU AI算力平台,为用户提供更高推理性能、更多国产芯片适配、更多高数据安全的大模型服务,让大模型真正用起来。

在推理性能方面,针对DeepSeek大模型技术特点,京东云通过推理加速与内核驱动级优化,提升单台服务器推理性能50%。

在国产芯片适配方面,京东云已完成从底层算力到大模型和业务应用的全面国产化适配,包括十余家国产化AI算力,确保自主可控。

在数据安全方面,通过机密容器AI全场景密态计算和先进的容器隔离技术,确保模型数据的机密性与完整性,为用户提供金融级安全防护。

目前,在河南鹤壁、江苏宿迁、山东滨州、广西北海、山西大同,京东云已经助力多地政府基于现有基础设施本地化部署DeepSeek,既满足本地政务业务,又让当地企业不用投入资源,即可通过政务云调用DeepSeek。


标签: DeepSeek

“全面适配!京东云将DeepSeek推理场景性能提升50%” 的相关文章

中国AIGC应用全景图谱公布:DeepSeek、字节、腾讯、美图产品入选

中国AIGC应用全景图谱公布:DeepSeek、字节、腾讯、美图产品入选

4月16日,量子位智库发布2025中国AIGC应用全景图谱,呈现中国AIGC应用现状及趋势,图谱中既有字节、腾讯等头部大厂,也有DeepSeek这样的行业冠军。作为近两年的明星AI公司,美图公司旗下多...

接入DeepSeek,跨境外贸就能躺赢?|钛媒体

接入DeepSeek,跨境外贸就能躺赢?|钛媒体

“身边的跨境老板几乎都在关注大模型动态,想着怎样用大模型提效工作流和运营能力。”孙杨是一家中小型跨境商家的老板,他对钛媒体出海参考说道。DeepSeek爆火后,以孙杨为代表的跨境老板尝试了各种Deep...

微信接入deepseek,这5个神仙接入口大家知道吗?

微信接入deepseek,这5个神仙接入口大家知道吗?

微信接入DeepSeek的入口,至少有5个,大家都可以试试。 (1)微信灰度测试用户(要看运气)。被幸运被邀请微信搜索灰度测试用户,可以在微信搜索框选择“AI搜索”,进入“深度思考”模式,输入问...

破!DeepSeek引发中国资产重估,后劲还有多大?

破!DeepSeek引发中国资产重估,后劲还有多大?

近期,资金持续加仓港股态势显著。2月18日,恒生科技指数继续上涨2%至5609.27点。上周,恒生科技指数大涨7.3%,在冲破去年10月的高位之后,创约3年来的收市新高。多只港股科技股近日已经突破去年...

deepseek王炸组合:微信+DeepSeek来了,网友:“王炸组合”!

deepseek王炸组合:微信+DeepSeek来了,网友:“王炸组合”!

deepseek继续扩大生态圈2月15日部分微信用户发现微信搜索已经上线“ai搜索”功能并接入deepseek-r1提供的“深度思考”服务2月16日,记者从腾讯集团确认,微信搜一搜在调用混元大模型丰富...

AMD与清醒异构推出免费体验版DeepSeek AI系统测试平台

AMD与清醒异构推出免费体验版DeepSeek AI系统测试平台

IT时报记者郝俊慧近日,AMD-清醒异构人工智能应用联合实验室发布AMD ROCm原生的AI系统测试体验平台。用户免费注册后,只需上传简单的训练素材文件,就可以体验DeepSeek等主流开源大模型的能...