当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek又得了个第一

2个月前 (02-15)Deepseek最新资讯140

智东西2月14日报道,刚刚,DeepSeek在开源社区Hugging Face上的点赞数跃居第一,获约8730次点赞,这一数字仍在持续上涨。



这是继DeepSeek应用力压ChatGPT登顶美区App Store免费榜、模型在开源社区GitHub上Star数首次超越OpenAI之后,DeepSeek创下的又一个历史时刻,在海外平台再次登顶。


Hugging Face点赞榜单前十名的模型中,都曾在不同节点引爆整个大模型产业。


排名第二的是曾以AI生图“新王”名号横空出世的FLUX.1,由StableDiffusion原班人马成立的黑森林工作室打造,点赞数约8710次。


排名第六的是全球1000名科学家组成BigScience打造的参数高达1760亿个的超大NLP模型BLOOM,第八的是欧洲AI独角兽Mistral AI基于MoE架构的模型Mixtral-8x7B,其余六席被Meta的Llama系列模型和StabilityAI家的模型包揽。


OpenAI的语音转录模型Whisper-large-v3被挤出前十名之列,排名第11,点赞数约3810次。


此外,DeepSeek-V3的排名在第19名,点赞约3810次,超越了微软的Phi-2和谷歌Gemma-7B模型。


Hugging Face点赞数排行榜前30的还有DeepSeek另一款开源的多模态模型Janus-Pro-7B,该模型在使用文本提示的图像生成排行榜中优于OpenAI的 DALL-E 3和Stability AI的Stable Diffusion。



▲开源社区Hugging Face点赞榜(图源:Hugging Face)


DeepSeek V3、DeepSeek R1、Janus-Pro-7B分别于2024年12月26日和今年1月20日、1月28日发布。


DeepSeek V3为DeepSeek自研MoE模型,参数量达到671B,激活参数量37B,在14.8T token上进行了预训练,该模型在多项评测成绩超越了Qwen2.5-72B和Llama-3.1-405B等开源模型,并在性能上和闭源模型GPT-4o以及Claude-3.5-Sonnet比肩。


DeepSeek R1在数学、代码、自然语言推理等任务上,性能比肩OpenAI o1正式版,在开源DeepSeek-R1-Zero和DeepSeek-R1两个660B模型的同时,蒸馏了6个小模型,其中32B和70B模型在多项能力上实现了对标OpenAI o1-mini的效果。


多模态模型Janus-Pro是去年发布的Janus的高级版本,可显著提高多模态理解和视觉生成。


当下,全球已经掀起了从芯片企业、云计算巨头到各路基础设施公司适配、接入DeepSeek的热潮,DeepSeek所展现出的卓越性能与广泛的应用潜力正在逐渐放大。


“DeepSeek又得了个第一” 的相关文章

特斯联完成摩托车产业打造首个DeepSeek应用案例

特斯联完成摩托车产业打造首个DeepSeek应用案例

近日,特斯联完成摩托车行业首例深度融合DeepSeek的应用案例,助力某上市厂商与DeepSeek全场景无缝融合,打造AI助理,开启摩托车智慧出行新范式。来源: 同花顺7x24快讯...

对话创世伙伴创投梁宇:DeepSeek改写了AI投资范式

对话创世伙伴创投梁宇:DeepSeek改写了AI投资范式

中新经纬4月7日电 (王玉玲)“DeepSeek带来了两个重要的提醒:一是大模型企业是否要继续投入资源钻研底层算法,还是基于DeepSeek现有模型再进行迭代和运营;第二,以往大家普遍倾向于闭源垄断,...

东方国信推出新一代满血版“幕僚DeepSeek一体机”

东方国信推出新一代满血版“幕僚DeepSeek一体机”

人民财讯3月10日电,东方国信发文称,公司充分发挥自身在算力基础设施、行业大数据积累及垂直大模型领域的核心优势,重磅推出新一代满血版“幕僚DeepSeek一体机”。...

接入DeepSeek,大连12345迈入“智慧服务”新时代

接入DeepSeek,大连12345迈入“智慧服务”新时代

近日,市数据局与中国移动大连分公司合作,在全省率先将DeepSeek大模型引入12345热线平台应用场景,12345热线平台成功升级智能助手、智能知识库、智能质检三大智能化应用场景,实现服务质效全面提...

上海数据交易所接入DeepSeek大模型

上海数据交易所接入DeepSeek大模型

观点网讯:2月27日,上海数据交易所正式接入DeepSeek大模型,标志着国内首个大型语言模型在数据交易领域的应用落地。此次合作旨在构建多维数据交易知识体系的领域模型,提升数据交易服务智能化水平。据了...

请整理一份deepseek提示词技巧教程?

请整理一份deepseek提示词技巧教程?

以下是针对DeepSeek提示词设计的系统化教程,从核心原则到进阶技巧,帮助高效引导AI输出:DeepSeek提示词技巧教程一、核心设计原则精准定位任务明确任务类型:创作/分析/计算/设计示例:错误:...