当前位置:首页 > Deepseek最新资讯 > 正文内容

最新的DeepSeek更新了 有网友对新版R1模型进行了测试

2周前 (05-29)Deepseek最新资讯99

5月28日,DeepSeek在官方交流群中公布,DeepSeek R1模型已完成小版本试升级。用户可在官方网页、APP、小程序测试(打开深度思考),API接口和使用方式保持不变。DeepSeek在开源社区Hugging Face也开源了新版R1模型(R1-0528)。

有网友对新版R1模型进行了测试,并表示Deepseek-R1-0528在竞赛级编程的难度基准LiveCodeBench中的表现几乎与OpenAI的o3模型相当。

社交网络和信息网站City-data.com创始人Lech Mazur在社交媒体上表示,Deepseek-R1-0528在Extended NYT Connections基准测试中比原先的DeepSeek R1有了显著改进,分数从38.6上升到49.8。在Thematic Generation基准测试中,Deepseek-R1-0528也优于DeepSeek R1,分数从1.80变为1.74,该分数越低越好。Thematic Generation基准测试衡量各种大模型如何有效地从一小组正例和反例中推断出一个细分或特定的“主题”(类别/规则),然后在一组具有误导性的候选项中检测出哪一项真正符合该主题。

DeepSeek今年春节期间大火。3月份,DeepSeek V3模型完成小版本升级。新版V3模型借鉴DeepSeek R1模型训练过程中所使用的强化学习技术,大幅提高了在推理类任务上的表现水平,在数学、代码类相关评测集上取得了超过GPT-4.5的得分成绩。在HTML等代码前端任务上,新版V3模型生成的代码可用性更高,视觉效果也更加美观、富有设计感。在中文写作任务方面,新版V3模型基于R1的写作水平进行优化,同时提升中长篇文本创作的内容质量。


“最新的DeepSeek更新了 有网友对新版R1模型进行了测试” 的相关文章

中国信通院:启动DeepSeek国产化适配测试工作

中国信通院:启动DeepSeek国产化适配测试工作

中新网北京2月14日电(记者 宋宇晟)近期,DeepSeek陆续开源V3、R1系列高性能、低成本模型,人工智能软硬件协同创新重要性进一步凸显。记者从中国信息通信研究院(简称“中国信通院”)获悉,Dee...

DeepSeek说:我们打赢关税战了吗?

DeepSeek说:我们打赢关税战了吗?

从2025年5月12日发布的中美联合声明内容来看,双方在关税等问题上取得了阶段性突破,但长期博弈态势仍未改变。结合相关信息分析如下:一、短期成果:关税大幅下调超出预期1. 关税对等削减双方同意将4月2...

DeepSeek还能制作动物标本?动物标本非遗代表性传承人科普制作技艺

DeepSeek还能制作动物标本?动物标本非遗代表性传承人科普制作技艺

近日,在北京通州举办的“市民寻宝记”文化市集上,“通州非遗•北派动物标本制作技艺”展位上各式各样的标本栩栩如生,吸引民众围观。该展位负责人、北派动物标本制作技艺非遗代表性传承人张雪峰介绍,作为一名动物...

南京市政务云基于华为云Stack成功部署上线满血版DeepSeek-R1-671B

南京市政务云基于华为云Stack成功部署上线满血版DeepSeek-R1-671B

近期,南京市政务云基于华为云Stack成功部署上线满血版DeepSeek-R1-671B,实现了“南京+DeepSeek满血版”的人工智能政务应用一体化赋能升级。...

DeepSeek教学成果培育专题工作坊在烟台文化旅游职业学院举办

DeepSeek教学成果培育专题工作坊在烟台文化旅游职业学院举办

4月25日至27日,烟台文化旅游职业学院举办2025年DeepSeek赋能教学成果培育、凝练、申报实务与案例解析专题工作坊(第一期)。活动由山东省职业教育和产业人才研究院主办,我院承办。山东省职业教育...

雄安新区发布国内首个DeepSeek农业行业大模型

雄安新区发布国内首个DeepSeek农业行业大模型

长城网·冀云客户端讯(边晨旭)2月27日,国内首个基于DeepSeek提供公众服务的农业行业大模型——“雄小农”AI农业大模型在河北省农业农村厅召开的智慧农业场景打造对接会上正式发布。发布会现场。主办...