当前位置:首页 > Deepseek最新资讯 > 正文内容

清华团队推出“安全增强版DeepSeek”

5个月前 (02-24)Deepseek最新资讯273

人民网北京2月24日电 (记者赵竹青)2月23日,清华大学计算机系相关研究团队宣布推出大语言模型RealSafe-R1。该模型基于DeepSeek R1进行深度优化与后训练,在确保性能稳定的基础上,显著提升了安全性,为开源大模型的安全发展与风险治理提供了创新性解决方案。

近日来,国产开源大模型DeepSeek在自然语言处理和多任务推理方面展现了强大的技术实力,但在面对越狱攻击等安全性挑战时仍存在一定局限性。为此,清华团队提出了基于模型自我提升的安全对齐方式,将安全对齐与内省推理相结合,使大语言模型能够通过具有安全意识的思维链分析来检查潜在风险,实现基础模型自身能力的自主进化。

基于该方法,团队对DeepSeek-R1系列模型进行后训练,正式推出RealSafe-R1系列大模型。实验数据表明,RealSafe-R1安全性提升显著,在多个基准测试中有效增强了对各种越狱攻击的抵抗力,并减轻了安全与性能之间的“跷跷板”现象。

据悉,RealSafe-R1各尺寸模型及数据集将于近期向全球开发者开源。


“清华团队推出“安全增强版DeepSeek”” 的相关文章

数字赋能 DeepSeek龙江落地加速度

数字赋能 DeepSeek龙江落地加速度

原标题:感受DeepSeek龙江落地加速度黑龙江省深化能力作风建设工作会议强调,要强化战略思维、前瞻意识、创新理念,善于谋大局、谋未来、谋新路。当前,科技革命和产业变革深入发展,DeepSeek等人工...

车企扎堆接入DeepSeek,真有用还是纯噱头?

车企扎堆接入DeepSeek,真有用还是纯噱头?

今年春节前后,一场围绕DeepSeek展开的“AI风暴”席卷汽车行业。《消费者报道》统计发现,截至2月20日,已有20余家车企和品牌宣布与DeepSeek深度融合,包括吉利、奇瑞、长安、上汽、东风、广...

德州数字水网牵手DeepSeek,迈向智能水网新篇章

德州数字水网牵手DeepSeek,迈向智能水网新篇章

近日,德州数字孪生水网“智水德州”平台成功接入DeepSeek,通过部署德州水利个性化知识库,为复杂水网调度注入了全新的智能化元素,通过DeepSeek的AI驱动技术,水网调度将实现更精准的预测、更智...

四川宝妈用DeepSeek攻略带娃游峨眉山:省时又合理,特色菜都推荐了

四川宝妈用DeepSeek攻略带娃游峨眉山:省时又合理,特色菜都推荐了

5月4日,四川成都的何女士带着两个女儿游览峨眉山,并不时和打印出来的旅行攻略对比,以确认完成行程后能赶上火车返回成都。何女士告诉极目新闻记者,这次亲子游的攻略她都是用DeepSeek做的,先向AI提出...

电信科技+DeepSeek云智赋能福建漳州,让基层治理更有温度!

电信科技+DeepSeek云智赋能福建漳州,让基层治理更有温度!

AI出手,智解千千结!电信科技+DeepSeek云智赋能福建漳州,为基层工作者打造24小时在线的“智能助手”,让基层治理更有温度!...

DeepSeek,激荡AI行业的“一股清流”

DeepSeek,激荡AI行业的“一股清流”

近期,外媒纷纷将聚光灯投向中国初创企业深度求索公司,其自主研发的人工智能(AI)大语言模型“深度求索”(DeepSeek)凭借“好用、开源、免费”三大特点,在全球范围内引发热烈反响。这一创新成果不仅在...