当前位置:首页 > Deepseek最新资讯 > 正文内容

清华团队推出“安全增强版DeepSeek”大语言模型RealSafe-R1

7个月前 (02-24)Deepseek最新资讯404

人民网北京2月24日电 (记者赵竹青)2月23日,清华大学计算机系相关研究团队宣布推出大语言模型RealSafe-R1。该模型基于DeepSeek R1进行深度优化与后训练,在确保性能稳定的基础上,显著提升了安全性,为开源大模型的安全发展与风险治理提供了创新性解决方案。

近日来,国产开源大模型DeepSeek在自然语言处理和多任务推理方面展现了强大的技术实力,但在面对越狱攻击等安全性挑战时仍存在一定局限性。为此,清华团队提出了基于模型自我提升的安全对齐方式,将安全对齐与内省推理相结合,使大语言模型能够通过具有安全意识的思维链分析来检查潜在风险,实现基础模型自身能力的自主进化。

基于该方法,团队对DeepSeek-R1系列模型进行后训练,正式推出RealSafe-R1系列大模型。实验数据表明,RealSafe-R1安全性提升显著,在多个基准测试中有效增强了对各种越狱攻击的抵抗力,并减轻了安全与性能之间的“跷跷板”现象。

据悉,RealSafe-R1各尺寸模型及数据集将于近期向全球开发者开源。


“清华团队推出“安全增强版DeepSeek”大语言模型RealSafe-R1” 的相关文章

达实智能:深入交流AIoT与DeepSeek应用

达实智能:深入交流AIoT与DeepSeek应用

5月23日,达实智能(002421)发布公告,近期公司举行了投资者关系活动,时间为2025年5月22日,参与方包括公司副总经理吕枫和证券事务代表管小芬,以及来自广发证券、金鹰基金等29位机构及个人投资...

蚂蚁集团或布局AI智能眼镜产品 DeepSeek加速终端落地

蚂蚁集团或布局AI智能眼镜产品 DeepSeek加速终端落地

据科技媒体报道,蚂蚁集团正在招聘AI智能眼镜的产品专家。根据职位描述可知,该职位主要负责AI智能眼镜应用相关的产品,要求有2C产品的经验,并且熟悉市面上各位VR、AR和AI智能眼镜。这则招聘信息或显示...

DeepSeek回应焦虑:最危险的从来不是技术,而是…

DeepSeek回应焦虑:最危险的从来不是技术,而是…

随着DeepSeek一夜爆红,人工智能正逐步渗透到生活工作的方方面面。最近,一张各职业被AI取代难易程度图在金融圈引起讨论,根据图解,AI率先取代的是高机械性、缺乏创意、弱社交的职业,其中,证券分析行...

重庆首个“DeepSeek+市场监管”成果投入一线应用

重庆首个“DeepSeek+市场监管”成果投入一线应用

本报讯 (何艾彬 记者谢 旺)日前,市民张女士前去重庆市江津区市场监管局办事,恰逢局长办公日,张女士发现,通过“津市通”,即可了解药店办理地址变更的所有流程。这也是重庆首个“DeepSeek+市场监管...

钉钉接入DeepSeek系列模型有哪些重要的意义?

钉钉接入DeepSeek系列模型有哪些重要的意义?

钉钉接入DeepSeek系列模型具有多方面的重要意义,以下是对这些意义的详细阐述:一、技术层面的提升增强AI助理功能:通过接入DeepSeek系列模型,钉钉AI助理获得了深度思考和联网查询的强大能力。...

一周两场,场场火爆!Deepseek+数字人营销训练营吸引百余位青岛企业家参加:必须学会新武器

一周两场,场场火爆!Deepseek+数字人营销训练营吸引百余位青岛企业家参加:必须学会新武器

面对人力成本攀升、爆款内容稀缺、矩阵账号管理低效等难题,AI已成为企业降本增效的“救命稻草”。4月17日-18日,由半岛都市报风口财经联合青岛市女企业家协会、青岛市时装设计师协会、小冰华北运营中心举办...