当前位置:首页 > Deepseek最新资讯 > 正文内容

清华团队推出“安全增强版DeepSeek”

4个月前 (02-24)Deepseek最新资讯200

人民网北京2月24日电 (记者赵竹青)2月23日,清华大学计算机系相关研究团队宣布推出大语言模型RealSafe-R1。该模型基于DeepSeek R1进行深度优化与后训练,在确保性能稳定的基础上,显著提升了安全性,为开源大模型的安全发展与风险治理提供了创新性解决方案。

近日来,国产开源大模型DeepSeek在自然语言处理和多任务推理方面展现了强大的技术实力,但在面对越狱攻击等安全性挑战时仍存在一定局限性。为此,清华团队提出了基于模型自我提升的安全对齐方式,将安全对齐与内省推理相结合,使大语言模型能够通过具有安全意识的思维链分析来检查潜在风险,实现基础模型自身能力的自主进化。

基于该方法,团队对DeepSeek-R1系列模型进行后训练,正式推出RealSafe-R1系列大模型。实验数据表明,RealSafe-R1安全性提升显著,在多个基准测试中有效增强了对各种越狱攻击的抵抗力,并减轻了安全与性能之间的“跷跷板”现象。

据悉,RealSafe-R1各尺寸模型及数据集将于近期向全球开发者开源。


“清华团队推出“安全增强版DeepSeek”” 的相关文章

创新驱动 智领未来 山东移动DeepSeek高教共创沙龙举办

创新驱动 智领未来 山东移动DeepSeek高教共创沙龙举办

在科技飞速发展的当下,人工智能技术正以前所未有的速度重塑高等教育发展格局。为深入探索人工智能与高等教育的融合创新路径,3月27日,山东移动携手华为在青岛举办以“创新驱动 智领未来”为主题的DeepSe...

李开复:DeepSeek将中美AI差距缩小至3个月

李开复:DeepSeek将中美AI差距缩小至3个月

参考消息网3月25日报道据新加坡《联合早报》网站3月25日报道,中国初创企业零一万物首席执行官李开复说,在人工智能(AI)发展方面,中国已将与美国在某些领域的差距缩小至仅3个月,因为中国初创企业深度求...

DeepSeek赋能,美的空调开启AI智能新篇

DeepSeek赋能,美的空调开启AI智能新篇

2025年初,中国人工智能大模型 DeepSeek火遍全球,让全世界看到了中国AI技术的巨大潜力。国内家电行业也迅速乘上了这股东风,持续探索人工智能大模型与智能家居结合的无限可能性。据悉,家电巨头美的...

DeepSeek赋能 成都崇州政府服务创新升级

DeepSeek赋能 成都崇州政府服务创新升级

3月6日,记者从成都崇州市获悉,崇州市AI政务服务小助手“小崇” 正式接入DeepSeek,开启数字政务管家2.0版,提供全新智能导办体验。通过接入DeepSeek大模型技术,打造出形象可爱、功能强大...

DeepSeek提示词编写技巧(高质量典藏版)

DeepSeek提示词编写技巧(高质量典藏版)

“为什么别人用DeepSeek 2分钟搞定周报,你却折腾半小时?为什么别人用DeepSeek分分钟生成精美图表,你还在手动调格式?为什么DeepSeek在别人手里是‘外挂’,到你这就成‘人工智障’?”...

DeepSeek的成功对勘察设计行业的启示

DeepSeek的成功对勘察设计行业的启示

2025年DeepSeek的横空出世加速了勘察设计行业的技术革新,以DeepSeek为代表的人工智能技术正推动勘察设计行业从依赖个人经验转向数据驱动。DeepSeek的成功得益于五个关键因素:创新思维...