当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek“开源周”第二天开源EP通信库

1年前 (2025-02-25)Deepseek最新资讯648

新京报贝壳财经讯(记者罗亦丹)北京时间2月25日,DeepSeek发布了其“开源周”第二天的成果:DeepEP,第一个用于MoE模型(混合专家模型)训练和推理的开源EP通信库。

据了解,EP为Expert Parallelism(专家并行),是一种在大规模分布式AI模型训练中使用的技术,能用于提升模型并行处理能力和训练效率。

DeepSeek介绍,DeepEP的特点包括:高效且优化的全对全(all-to-all)通信,节点内和节点间支持NVLink和RDMA,用于训练和推理预填充的高吞吐量内核,用于推理解码的低延迟内核,原生FP8调度支持,灵活的GPU资源控制,实现计算与通信重叠。

DeepSeek发布公告截图


“DeepSeek“开源周”第二天开源EP通信库” 的相关文章

数据安全又合规 京东云DeepSeek一体机助力金融机构快速用上大模型

数据安全又合规 京东云DeepSeek一体机助力金融机构快速用上大模型

随着金融科技的迅猛发展,越来越多的金融机构开始探索如何利用人工智能和大数据技术提升业务效率和服务质量。在这一背景下,京东云推出的DeepSeek一体机成为了众多金融机构的首选工具。它不仅能在保障数据安...

人工智能赋能职业教育,北京八维集团引入DeepSeek

人工智能赋能职业教育,北京八维集团引入DeepSeek

在科技飞速发展的当下,人工智能(AI)已成为推动各行业变革的核心力量,职业教育领域自然也不例外。北京八维集团作为职业教育的领军者,敏锐洞察到人工智能带来的巨大机遇,近日正式引入先进的大语言模型 Dee...

韩国为什么暂停DeepSeek下载?理由和原因是什么?

韩国为什么暂停DeepSeek下载?理由和原因是什么?

韩国为什么暂停DeepSeek下载?理由和原因是什么?据韩联社17日报道,韩国政府当天表示,已经临时暂停基于中国人工智能企业深度求索(DeepSeek)大模型的应用程序在韩国的服务,理由是所谓的“数据...

DeepSeek:如何把留学花的300万赚回来

DeepSeek:如何把留学花的300万赚回来

在当今全球化的时代,越来越多的中国家庭选择将孩子送出国留学,希望通过优质的教育资源为孩子铺就一条通往成功的道路。然而,留学费用动辄数百万元,尤其是对于普通家庭来说,这无疑是一笔巨大的投资。面对300万...

谁是“造物主”?关于DeepSeek的冷思考

谁是“造物主”?关于DeepSeek的冷思考

原创 小复 复旦大学出版社我们正在经历一场静默的“创世记”:AI生成媲美人类的作品基因编辑重塑生命密码元宇宙构建平行宇宙究竟谁才是这个时代的“造物主”?2025年1月20日,幻方量化旗下AI公司深度求...

希荻微:办公系统已接入基于Deepseek模型的提效工具

希荻微:办公系统已接入基于Deepseek模型的提效工具

金融界3月10日消息,有投资者在互动平台向希荻微提问:董秘您好!请问贵公司是否已经部署了DeepSeek?如果已经部署了,请问主要应用于哪些具体的业务?公司接入DeepSeek有哪些成本、收益方面的考...