当前位置:首页 > Deepseek最新资讯 > 正文内容

全面适配!京东云将DeepSeek推理场景性能提升50%

1年前 (2025-03-03)Deepseek最新资讯616

央广网北京3月3日消息 在DeepSeek为期五天的“开源周”中,其连续开源的五大核心技术(FlashMLA、DeepEP、DeepGEMM、DualPipe & EPLB、3FS文件系统),惊艳全球。

京东云率先宣布完成对这五项技术的全栈适配,在模型推理效率、算力资源利用率及数据管理等领域实现突破性优化,综合Flash MLA、DeepEP、FP8 GEMM、DualPipe四方面的调优,在DeepSeek推理场景下性能提升50%。

全面适配五大技术,DeepSeek推理场景性能提升50%

作为DeepSeek开源首日的重磅技术,Flash MLA通过动态调度GPU的显存与算力资源,解决了传统方法处理变长序列时的资源浪费问题。

京东vGPU AI算力平台通过支持Flash MLA的FP8格式来提升推理性能,使单Token的 KV Cache显存占用相比Multi-head Attention降低57倍,配合最新的投机推理技术,以极低的显存需求,在高并发请求场景下保证了推理的吞吐量和延迟表现。

此外,针对用于DeepSeek开源的通信库DeepEP,京东云vGPU AI算力平台已全面支持EP模式下的分布式推理,显著提高推理吞吐。通过整合DeepEP作为通信后端,针对机内通信使用NVLink传输数据,机间通信使用NVSHMEM接口走RDMA网络,同时通过灵活的GPU SM数量利用控制,增大GPU算力资源利用率以及减少对计算算子的性能串。

更低成本更高效率,让大模型真正用起来

针对客户大模型的使用需求,京东云vGPU AI算力平台,为用户提供更高推理性能、更多国产芯片适配、更多高数据安全的大模型服务,让大模型真正用起来。

在推理性能方面,针对DeepSeek大模型技术特点,京东云通过推理加速与内核驱动级优化,提升单台服务器推理性能50%。

在国产芯片适配方面,京东云已完成从底层算力到大模型和业务应用的全面国产化适配,包括十余家国产化AI算力,确保自主可控。

在数据安全方面,通过机密容器AI全场景密态计算和先进的容器隔离技术,确保模型数据的机密性与完整性,为用户提供金融级安全防护。

目前,在河南鹤壁、江苏宿迁、山东滨州、广西北海、山西大同,京东云已经助力多地政府基于现有基础设施本地化部署DeepSeek,既满足本地政务业务,又让当地企业不用投入资源,即可通过政务云调用DeepSeek。


标签: DeepSeek

“全面适配!京东云将DeepSeek推理场景性能提升50%” 的相关文章

开源才是未来!李开复:DeepSeek证明闭源是一条死路

开源才是未来!李开复:DeepSeek证明闭源是一条死路

快科技3月30日消息,日前,在2025中关村论坛年会人工智能主题日上,零一万物CEO李开复在演讲中谈到了DeepSeek。李开复表示,DeepSeek是一个非常快速能达到推理引擎思考的,而且不是靠蒸馏...

百度搜索宣布将全面接入DeepSeek及文心大模型深度搜索功能

百度搜索宣布将全面接入DeepSeek及文心大模型深度搜索功能

【百度搜索宣布将全面接入DeepSeek及文心大模型深度搜索功能】财联社2月16日电,百度搜索和文心智能体平台宣布将全面接入DeepSeek和文心大模型最新的深度搜索功能。搜索用户可免费使用DeepS...

新华网:可提供基于Deepseek模型的训练推理服务

新华网:可提供基于Deepseek模型的训练推理服务

金融界3月26日消息,有投资者在互动平台向新华网提问:Deepseek释放了算力需求,贵公司算力情况如何?公司回答表示:新华AIGC应用使能平台的高弹性算力包产品,可以为客户提供低成本普惠的算力资源,...

斯坦福2025 AI Index报告来了:DeepSeek在全文中被提到45次

斯坦福2025 AI Index报告来了:DeepSeek在全文中被提到45次

斯坦福《2025 AI指数》揭示:美国以40个顶尖模型领跑,中国性能差距缩至1.7%;训练成本飙升近2亿美元,但推理费用骤降99%。DeepSeek以600万美元低成本突围,质疑与希望并存;AI碳足迹...

淮北市人民政府网站完成DeepSeek大模型接入

淮北市人民政府网站完成DeepSeek大模型接入

日前,市人民政府网站完成DeepSeek大模型接入工作,同步梳理并接入全市政府网站群近153万条海量数据。自上线以来,DeepSeek大模型智能问答累计处理各类咨询、办事等业务请求超1.5万件次,政民...

昇腾+DeepSeek | 推动校园AI解决方案实力迈向新高度

昇腾+DeepSeek | 推动校园AI解决方案实力迈向新高度

      3月20日-21日,“华为中国合作伙伴大会2025”在深圳隆重举行。大会以“因聚而生 众智有为”为主题,众生态伙伴齐聚一堂,凝聚智慧与能力,共同探讨数智化转型...