当前位置:首页 > Deepseek最新资讯 > 正文内容

清华团队推出“安全增强版DeepSeek”

7个月前 (02-24)Deepseek最新资讯343

人民网北京2月24日电 (记者赵竹青)2月23日,清华大学计算机系相关研究团队宣布推出大语言模型RealSafe-R1。该模型基于DeepSeek R1进行深度优化与后训练,在确保性能稳定的基础上,显著提升了安全性,为开源大模型的安全发展与风险治理提供了创新性解决方案。

近日来,国产开源大模型DeepSeek在自然语言处理和多任务推理方面展现了强大的技术实力,但在面对越狱攻击等安全性挑战时仍存在一定局限性。为此,清华团队提出了基于模型自我提升的安全对齐方式,将安全对齐与内省推理相结合,使大语言模型能够通过具有安全意识的思维链分析来检查潜在风险,实现基础模型自身能力的自主进化。

基于该方法,团队对DeepSeek-R1系列模型进行后训练,正式推出RealSafe-R1系列大模型。实验数据表明,RealSafe-R1安全性提升显著,在多个基准测试中有效增强了对各种越狱攻击的抵抗力,并减轻了安全与性能之间的“跷跷板”现象。

据悉,RealSafe-R1各尺寸模型及数据集将于近期向全球开发者开源。


“清华团队推出“安全增强版DeepSeek”” 的相关文章

小旺AI截图+DeepSeek:5MB工具如何颠覆传统截图软件?

小旺AI截图+DeepSeek:5MB工具如何颠覆传统截图软件?

在数字化办公场景中,截图工具是用户使用频率最高的效率软件之一。然而,传统截图软件长期面临功能单一、操作繁琐、资源占用高等痛点。近日,一款名为小旺AI截图的PC端工具正式上线,凭借仅5MB的轻量化设计、...

“DeepSeek 启智计划”把AI青年力注入青年夜校

“DeepSeek 启智计划”把AI青年力注入青年夜校

中国青年报客户端讯(中青报·中青网记者 胡春艳 通讯员 周晓曦 刘昌利)近日,在天津市河北区时代书吧,来自国网天津信通公司的青年志愿者们正在面向青年群体宣讲DeepSeek使用方法和操作技巧,助力夜校...

Kimi和DeepSeek又又又撞车?

Kimi和DeepSeek又又又撞车?

摘要:据凤凰网科技了解,今年杨植麟的关注重心早已发生改变。2月底,Kimi内部在重点推进模型表现的提升,“杨植麟亲自带队”。近期,Kimi则专注垂直领域,核心都是提升模型能力上限。几个大模型初创企业里...

硅谷视角深聊:Deepseek的颠覆、冲击、争议和误解

硅谷视角深聊:Deepseek的颠覆、冲击、争议和误解

2024年12月底,中国幻方量化旗下的人工智能团队,发布了6700亿参数大语言基础模型DeepSeek V3,紧接着在2025年1月20日开源了基于V3的两款推理模型:DeepSeek-R1-Zero...

托普云农(301556)已接入deepseek

托普云农(301556)已接入deepseek

 同花顺(300033)金融研究中心03月24日讯,有投资者向托普云农(301556)提问, 请问公司是否接入deepseek?  公司回答表示,您好!我司已接入。此次接入对公司业绩无直接影响,截止目...

数字赋能 DeepSeek龙江落地加速度

数字赋能 DeepSeek龙江落地加速度

原标题:感受DeepSeek龙江落地加速度黑龙江省深化能力作风建设工作会议强调,要强化战略思维、前瞻意识、创新理念,善于谋大局、谋未来、谋新路。当前,科技革命和产业变革深入发展,DeepSeek等人工...