当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek开源周第三日 发布高性能通用矩阵乘法库

4个月前 (02-26)Deepseek最新资讯245

新京报贝壳财经讯(记者罗亦丹)北京时间2月26日,DeepSeek进行了其开源周第三日的发布——DeepGEMM,一个支持密集和MoE(专家混合模型)GEMM(通用矩阵乘法)的FP8 (8位浮点数)GEMM库,为V3/R1训练和推理提供支持。

据了解,通用矩阵乘法是许多高性能计算任务的核心,所以其性能优化也是大模型降本增效的重点。

DeepSeek表示,DeepGEMM在Hopper GPU(一种英伟达GPU架构)上最高可达到1350+FP8TFLOPS(每秒万亿次浮点运算),并且像教程一样简洁,可完全即时编译,其核心逻辑只有约300行代码,且在大多数矩阵尺寸上均优于专家调优的内核,并支持密集布局和两种MoE布局。


标签: DeepSeek

“DeepSeek开源周第三日 发布高性能通用矩阵乘法库” 的相关文章

DeepSeek智能体正在改变工作方式?学会这3招,提升你的职业竞争力

DeepSeek智能体正在改变工作方式?学会这3招,提升你的职业竞争力

你还在手动整理数据?还在为写不出高质量文案而苦恼?小心被AI淘汰!2024年,职场内卷已经到了白热化阶段。但比内卷更可怕的是什么?是降维打击!当别人用DeepSeek智能体几分钟搞定你一天的工作,你的...

DeepSeek如何重塑中国大模型产业生态|海斌访谈

DeepSeek如何重塑中国大模型产业生态|海斌访谈

中国互联网大厂在为DeepSeek作出巨大改变。2月14日,百度宣布将于6月30开源文心大模型。2月15日,部分微信用户发现已经可以在搜索功能中调用DeepSeek模型了。百度和腾讯有自己的大模型产品...

DeepSeek发源地再推人工智能创新高地方案!科创板人工智能ETF(588930)现涨超2%,实时成交额突破6000万元

DeepSeek发源地再推人工智能创新高地方案!科创板人工智能ETF(588930)现涨超2%,实时成交额突破6000万元

消息面上,6月4日,杭州市人工智能创新高地建设动员会召开,会上对《杭州市加快建设人工智能创新高地实施方案》进行解读,该方案即将出台。《实施方案》明确了杭州到2025年的人工智能发展目标:全市投入市场的...

至顶AI实验室:DeepSeek完全实用手册V1.5,技术原理·使用技巧·部署进展(PDF版)

至顶AI实验室:DeepSeek完全实用手册V1.5,技术原理·使用技巧·部署进展(PDF版)

好的产品一定是能久经市场考验的,DeepSeek 无疑就是今年最好的产品之一。距离DeepSeek R1发布已经快3个月了,通过微信指数我们可以看到,DeepSeek的热度依然很高。但我们相信,过去的...

中国电信×DeepSeek 解锁教育创新密码

中国电信×DeepSeek 解锁教育创新密码

在教育领域不断追求突破与创新的当下,如何让知识更高效地传递,充分激发学生的无限潜能,成为了亟待解决的难题。中国电信接入DeepSeek,通过“智慧校园+DeepSeek”的组合,让传统校园摇身一变成为...

英伟达宣布创造满血 DeepSeek 推理世界记录

英伟达宣布创造满血 DeepSeek 推理世界记录

IT之家 3 月 19 日消息,英伟达在今日举行的 NVIDIA GTC 2025 上宣布其 NVIDIA Blackwell DGX 系统创下 DeepSeek-R1 大模型推理性能的世界纪录。据介...