当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek联合清北发布DualPath推理框架:吞吐量提升近2倍

6个月前 (02-27)Deepseek最新资讯63

  2月27日消息,依旧没等到DeepSeek V4,今天DeepSeek与北京大学、清华大学在ArXiv联合发布了一篇关于全新智能体推理框架DualPath的论文。据了解,该框架旨在解决智能体在长文本推理场景下面临的I/O瓶颈问题,通过优化存储读取路径,显著提升了大规模模型的推理吞吐量deepseek

  据论文介绍,DualPath的核心创新在于改变了传统的“存储至预填充引擎”(Storage-to-Prefill)单路径加载模式,引入了“存储至解码引擎”(Storage-to-Decode)的第二条路径。在现有的预填充-解码分离架构中,存储I/O压力往往集中在预填充引擎上,导致解码引擎的存储带宽闲置,这种不平衡成为了限制系统吞吐量的障碍。DualPath通过利用解码引擎闲置的存储网卡带宽读取缓存,并配合高速计算网络(RDMA)将其传输至预填充引擎,实现了集群存储带宽的全局池化与动态负载均衡。

  在技术实现上,DualPath采用了以计算网卡为中心的流量管理和自适应请求调度机制。系统将所有GPU相关流量统一管理,利用服务质量(QoS)机制确保推理通信的高优先级,保证大规模数据传输不干扰延迟敏感型任务。同时,调度器能实时监控各引擎负载,动态决定最优路径,减少GPU执行过程中的闲置时间。

  数据显示,研究团队在包含1152个GPU的大规模生产集群上,使用660B规模的模型进行了实测。结果表明,DualPath在离线推理场景下的吞吐量提高了1.87倍,在线服务场景下的吞吐量平均提升了1.96倍。此外,在高负载环境下,首字延迟(TTFT)得到大幅优化,而Token间的生成速度几乎未受干扰。(袁宁)原文出处:DeepSeek联合清北发布DualPath推理框架:吞吐量提升近2倍,感谢原作者,侵权必删!

标签: deepseek

“DeepSeek联合清北发布DualPath推理框架:吞吐量提升近2倍” 的相关文章

DeepSeek又更新了,期待梁文锋“炸场”

DeepSeek又更新了,期待梁文锋“炸场”

  《BUG》栏目实测发现,升级后的DeepSeek在上下文长度和交互友好度上有明显改进,编程能力受到推崇。在使用经济性上,也有开发人员指出,“DeepSeek或将V3与R1模型进行了合并...

华金证券-电子行业周报:AI半导体,DeepSeek~V3.1加速国产算力-25

华金证券-电子行业周报:AI半导体,DeepSeek~V3.1加速国产算力-25

  DeepSeek-V3.1正式发布:本次升级包含以下主要变化。(1)混合推理架构:同时支持思考模式与非思考模式;(2)更高思考效率:相比DeepSeek-R1-0528,DeepSee...

12月6日DeepSeek预测:快船vs灰熊,哈登率队复仇or莫兰特缺阵埋隐患?

12月6日DeepSeek预测:快船vs灰熊,哈登率队复仇or莫兰特缺阵埋隐患?

  北京时间12月6日09:00,NBA常规赛将上演西部卡位战,洛杉矶快船客场挑战孟菲斯灰熊。两支胜率不足五成的球队狭路相逢,近期状态迥异的他们将为季后赛席位展开激烈厮杀。...

大成创业板人工智能ETF(159242.SZ)盘中涨近3%,AI算力链双线迎利好

大成创业板人工智能ETF(159242.SZ)盘中涨近3%,AI算力链双线迎利好

  截至2025年10月21日10:11,创业板人工智能ETF大成(159242)盘中涨近3%,现涨2.05%,盘中换手11.52%,成交3431.42万元,市场交投活跃。截至10月20日...

“杭州六小龙”首次同框乌镇对话,DeepSeek梁文锋缺席现场 巴伦精选

“杭州六小龙”首次同框乌镇对话,DeepSeek梁文锋缺席现场 巴伦精选

  11月7日下午大会的主论坛上,这场对话由中国工程院院士、之江实验室主任王坚主持,宇树科技股份有限公司创始人王兴兴,强脑科技有限公司创始人兼首席执行官韩璧丞,群核科技联合创始人兼董事长黄...

12月26日DeepSeek预测:火箭vs湖人,东契奇带伤出战,湖人主场险胜

12月26日DeepSeek预测:火箭vs湖人,东契奇带伤出战,湖人主场险胜

  圣诞大战次日,西部第四的湖人将在斯台普斯中心迎战排名第六的火箭(12月26日09:00)。两队胜率相差仅4.9%,但湖人坐拥主场优势,且东契奇可能带伤复出,这场卡位战或将决定季后赛主场...