当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek“开源周”第二天开源EP通信库

4个月前 (02-25)Deepseek最新资讯214

新京报贝壳财经讯(记者罗亦丹)北京时间2月25日,DeepSeek发布了其“开源周”第二天的成果:DeepEP,第一个用于MoE模型(混合专家模型)训练和推理的开源EP通信库。

据了解,EP为Expert Parallelism(专家并行),是一种在大规模分布式AI模型训练中使用的技术,能用于提升模型并行处理能力和训练效率。

DeepSeek介绍,DeepEP的特点包括:高效且优化的全对全(all-to-all)通信,节点内和节点间支持NVLink和RDMA,用于训练和推理预填充的高吞吐量内核,用于推理解码的低延迟内核,原生FP8调度支持,灵活的GPU资源控制,实现计算与通信重叠。

DeepSeek发布公告截图


“DeepSeek“开源周”第二天开源EP通信库” 的相关文章

弘信电子:全资子公司安联通已经推出安联云业务,安联云可一键部署DeepSeek系列镜像

弘信电子:全资子公司安联通已经推出安联云业务,安联云可一键部署DeepSeek系列镜像

每经AI快讯,有投资者在投资者互动平台提问:子公司安联通是否有云计算业务?弘信电子(300657.SZ)3月31日在投资者互动平台表示,公司全资子公司安联通已经推出安联云业务,安联云平台配备GPU的云...

红松App全面接入DeepSeek“AI松小智”

红松App全面接入DeepSeek“AI松小智”

3月3日,红松宣布已全面接入深度求索(DeepSeek)人工智能大模型,并推出国内首款专为50+退休人群量身定制的智能生活助手“AI松小智”,全面升级中老年用户的兴趣文娱生活服务体验。这标志着国内首个...

促更多AI场景应用开发 高职院校首个DeepSeek+Hi Agent开发实战在深信院开课

促更多AI场景应用开发 高职院校首个DeepSeek+Hi Agent开发实战在深信院开课

深圳新闻网2025年3月10日讯(深圳商报首席记者 吴吉)最近,DeepSeek爆火,为我们打开了一扇全新的认知大门。如何将DeepSeek融入专业课程学习,成为学院人才培养的新抓手?最近,深圳信息职...

藕农用上DeepSeek,年节省人工成本30余万元

藕农用上DeepSeek,年节省人工成本30余万元

工人日报-中工网记者 张翀 通讯员 姜胜来 实习生 汪颀伟洪湖市万全镇百亩莲藕种植基地负责人刘小华打开手机端AI管理系统,实时温度、土壤湿度、日照率等参数跃然屏上。据湖北省科技厅消息,今年以来,洪湖市...

重磅升级!上海联通全面推出DeepSeek模型系列服务

重磅升级!上海联通全面推出DeepSeek模型系列服务

在当今全球科技浪潮的澎湃涌动中,国产人工智能大模型DeepSeek以其领先技术实力崛起,成为引领技术革新的先锋力量。该模型不仅以超凡的智能交互能力重塑人机协作的边界,更以卓越的计算性能突破传统AI的桎...

当“医线”代表“接入”DeepSeek

当“医线”代表“接入”DeepSeek

中新网济南2月28日电 题:当“医线”代表“接入”DeepSeek中新网记者 赵晓 祁建月“目前,奥法妥木单抗在治疗自身免疫性脑炎中发挥着越来越大的作用,请详细说明它在临床工作中的应用情况及困境。”一...