当前位置:首页 > Deepseek最新资讯 > 正文内容

全面适配!京东云将DeepSeek推理场景性能提升50%

1年前 (2025-03-03)Deepseek最新资讯613

央广网北京3月3日消息 在DeepSeek为期五天的“开源周”中,其连续开源的五大核心技术(FlashMLA、DeepEP、DeepGEMM、DualPipe & EPLB、3FS文件系统),惊艳全球。

京东云率先宣布完成对这五项技术的全栈适配,在模型推理效率、算力资源利用率及数据管理等领域实现突破性优化,综合Flash MLA、DeepEP、FP8 GEMM、DualPipe四方面的调优,在DeepSeek推理场景下性能提升50%。

全面适配五大技术,DeepSeek推理场景性能提升50%

作为DeepSeek开源首日的重磅技术,Flash MLA通过动态调度GPU的显存与算力资源,解决了传统方法处理变长序列时的资源浪费问题。

京东vGPU AI算力平台通过支持Flash MLA的FP8格式来提升推理性能,使单Token的 KV Cache显存占用相比Multi-head Attention降低57倍,配合最新的投机推理技术,以极低的显存需求,在高并发请求场景下保证了推理的吞吐量和延迟表现。

此外,针对用于DeepSeek开源的通信库DeepEP,京东云vGPU AI算力平台已全面支持EP模式下的分布式推理,显著提高推理吞吐。通过整合DeepEP作为通信后端,针对机内通信使用NVLink传输数据,机间通信使用NVSHMEM接口走RDMA网络,同时通过灵活的GPU SM数量利用控制,增大GPU算力资源利用率以及减少对计算算子的性能串。

更低成本更高效率,让大模型真正用起来

针对客户大模型的使用需求,京东云vGPU AI算力平台,为用户提供更高推理性能、更多国产芯片适配、更多高数据安全的大模型服务,让大模型真正用起来。

在推理性能方面,针对DeepSeek大模型技术特点,京东云通过推理加速与内核驱动级优化,提升单台服务器推理性能50%。

在国产芯片适配方面,京东云已完成从底层算力到大模型和业务应用的全面国产化适配,包括十余家国产化AI算力,确保自主可控。

在数据安全方面,通过机密容器AI全场景密态计算和先进的容器隔离技术,确保模型数据的机密性与完整性,为用户提供金融级安全防护。

目前,在河南鹤壁、江苏宿迁、山东滨州、广西北海、山西大同,京东云已经助力多地政府基于现有基础设施本地化部署DeepSeek,既满足本地政务业务,又让当地企业不用投入资源,即可通过政务云调用DeepSeek。


标签: DeepSeek

“全面适配!京东云将DeepSeek推理场景性能提升50%” 的相关文章

接入DeepSeek,大连12345迈入“智慧服务”新时代

接入DeepSeek,大连12345迈入“智慧服务”新时代

近日,市数据局与中国移动大连分公司合作,在全省率先将DeepSeek大模型引入12345热线平台应用场景,12345热线平台成功升级智能助手、智能知识库、智能质检三大智能化应用场景,实现服务质效全面提...

全市首家!南岸医保牵手DeepSeek 服务与政策智能触达

全市首家!南岸医保牵手DeepSeek 服务与政策智能触达

5月22日,基于DeepSeek大模型,结合微信公众号服务,医保服务事项和业务办理流程等内容,南岸区医疗保障局全新升级的医保智能客服——“医保智慧助手”投入试运行。这标志着重庆市首个接入DeepSee...

如何找到并启用微信内的DeepSeek功能(附排查方法)

如何找到并启用微信内的DeepSeek功能(附排查方法)

我的iOS微信和安卓微信都有接入DeepSeek的AI搜索功能,而且用了10多天,重度用户一枚。作为过来人,有必要给不知道的人分享下经验。 一句话总结,微信内的DeepSeek功能有多个登入口,...

金价上涨!DeepSeek回答能不能入手黄金

金价上涨!DeepSeek回答能不能入手黄金

3月14 日,国际金价飙升了40多美元,国内黄金市场也迎来大幅涨价,众多知名品牌的足金首饰售价纷纷跨越 900 元 / 克的关口。那么,从投资角度讲,眼下是不是入手黄金的时机?记者问询了DeepSee...

专访学而思CTO田密:接入DeepSeek改变的不只是产品

专访学而思CTO田密:接入DeepSeek改变的不只是产品

开源的DeepSeek大模型火了,在线教育行业也因此卷起千层浪花。近期,学而思、网易有道、中公教育、猿辅导、作业帮等头部企业密集宣布接入DeepSeek大模型,这引发了业界广泛关注。DeepSeek为...

百度首页上线DeepSeek入口链接-AI搜索DeepSeek满血版”即可体验

百度首页上线DeepSeek入口链接-AI搜索DeepSeek满血版”即可体验

记者获悉,百度搜索目前已全量上线DeepSeek满血版并提供联网服务,其中PC端开放1小时超千万人使用。对比其它接入DeepSeek产品,百度搜索在首页搜索框下方点击“AI搜索DeepSeek满血版”...