当前位置:首页 > Deepseek最新资讯 > 正文内容

全面适配!京东云将DeepSeek推理场景性能提升50%

2周前 (03-03)Deepseek最新资讯43

央广网北京3月3日消息 在DeepSeek为期五天的“开源周”中,其连续开源的五大核心技术(FlashMLA、DeepEP、DeepGEMM、DualPipe & EPLB、3FS文件系统),惊艳全球。

京东云率先宣布完成对这五项技术的全栈适配,在模型推理效率、算力资源利用率及数据管理等领域实现突破性优化,综合Flash MLA、DeepEP、FP8 GEMM、DualPipe四方面的调优,在DeepSeek推理场景下性能提升50%。

全面适配五大技术,DeepSeek推理场景性能提升50%

作为DeepSeek开源首日的重磅技术,Flash MLA通过动态调度GPU的显存与算力资源,解决了传统方法处理变长序列时的资源浪费问题。

京东vGPU AI算力平台通过支持Flash MLA的FP8格式来提升推理性能,使单Token的 KV Cache显存占用相比Multi-head Attention降低57倍,配合最新的投机推理技术,以极低的显存需求,在高并发请求场景下保证了推理的吞吐量和延迟表现。

此外,针对用于DeepSeek开源的通信库DeepEP,京东云vGPU AI算力平台已全面支持EP模式下的分布式推理,显著提高推理吞吐。通过整合DeepEP作为通信后端,针对机内通信使用NVLink传输数据,机间通信使用NVSHMEM接口走RDMA网络,同时通过灵活的GPU SM数量利用控制,增大GPU算力资源利用率以及减少对计算算子的性能串。

更低成本更高效率,让大模型真正用起来

针对客户大模型的使用需求,京东云vGPU AI算力平台,为用户提供更高推理性能、更多国产芯片适配、更多高数据安全的大模型服务,让大模型真正用起来。

在推理性能方面,针对DeepSeek大模型技术特点,京东云通过推理加速与内核驱动级优化,提升单台服务器推理性能50%。

在国产芯片适配方面,京东云已完成从底层算力到大模型和业务应用的全面国产化适配,包括十余家国产化AI算力,确保自主可控。

在数据安全方面,通过机密容器AI全场景密态计算和先进的容器隔离技术,确保模型数据的机密性与完整性,为用户提供金融级安全防护。

目前,在河南鹤壁、江苏宿迁、山东滨州、广西北海、山西大同,京东云已经助力多地政府基于现有基础设施本地化部署DeepSeek,既满足本地政务业务,又让当地企业不用投入资源,即可通过政务云调用DeepSeek。


“全面适配!京东云将DeepSeek推理场景性能提升50%” 的相关文章

福建首家接入DeepSeek中医院来了 电信助力开启AI诊疗新时代

福建首家接入DeepSeek中医院来了 电信助力开启AI诊疗新时代

随着智慧医疗建设推进,人工智能技术在医疗领域的应用不断深化,成为提升医疗服务质量与效率的重要抓手。近日,中国电信福建公司充分发挥云网融合与数字技术优势,助力福建省人民医院成为全省首个接入DeepSee...

DeepSeek,激荡AI行业的“一股清流”

DeepSeek,激荡AI行业的“一股清流”

近期,外媒纷纷将聚光灯投向中国初创企业深度求索公司,其自主研发的人工智能(AI)大语言模型“深度求索”(DeepSeek)凭借“好用、开源、免费”三大特点,在全球范围内引发热烈反响。这一创新成果不仅在...

众多产业行业与DeepSeek“联姻结对”,将为我们带来什么?

众多产业行业与DeepSeek“联姻结对”,将为我们带来什么?

新华社北京2月17日电 DeepSeek在多家医院完成本地化部署;微信测试接入DeepSeek;部分地区政务系统已接入……众多行业产业与DeepSeek“联姻结对”的消息接踵而至,令人不禁想问:AI正...

Deepseek微信小程序入口使用教程-deepseek的微信入口在哪里?微信如何才能使用免费的 Deepseek小程序?

Deepseek微信小程序入口使用教程-deepseek的微信入口在哪里?微信如何才能使用免费的 Deepseek小程序?

太多的朋友在后台问deepseek的微信入口在哪里?微信如何才能使用免费的 Deepseek小程序?虽然deepseek有网页版(https://chat.deepseek.com),但毕竟访问没有微...

企业微信接入 DeepSeek 模型,支持智能机器人、智能表格

企业微信接入 DeepSeek 模型,支持智能机器人、智能表格

IT之家 2 月 21 日消息,企业微信今日宣布接入 DeepSeek 模型,带来了「智能机器人」、「智能表格-客户跟进总结」等 AI 功能。IT之家从官方介绍获悉,接入 DeepSeek、混元等大模...

巨大人才缺口!DeepSeek带火AI岗,“六小龙”全球高薪招贤

巨大人才缺口!DeepSeek带火AI岗,“六小龙”全球高薪招贤

(央视财经《经济半小时》)2025年春节,中国人工智能大模型DeepSeek在全球引发轰动。DeepSeek的崛起也让相关领域的人才在这个春招季炙手可热。春招首周,人工智能工程师的求职增速位居职业榜首...