当前位置:首页 > Deepseek最新资讯 > 正文内容

清华团队推出“安全增强版DeepSeek”大语言模型RealSafe-R1

3周前 (02-24)Deepseek最新资讯73

人民网北京2月24日电 (记者赵竹青)2月23日,清华大学计算机系相关研究团队宣布推出大语言模型RealSafe-R1。该模型基于DeepSeek R1进行深度优化与后训练,在确保性能稳定的基础上,显著提升了安全性,为开源大模型的安全发展与风险治理提供了创新性解决方案。

近日来,国产开源大模型DeepSeek在自然语言处理和多任务推理方面展现了强大的技术实力,但在面对越狱攻击等安全性挑战时仍存在一定局限性。为此,清华团队提出了基于模型自我提升的安全对齐方式,将安全对齐与内省推理相结合,使大语言模型能够通过具有安全意识的思维链分析来检查潜在风险,实现基础模型自身能力的自主进化。

基于该方法,团队对DeepSeek-R1系列模型进行后训练,正式推出RealSafe-R1系列大模型。实验数据表明,RealSafe-R1安全性提升显著,在多个基准测试中有效增强了对各种越狱攻击的抵抗力,并减轻了安全与性能之间的“跷跷板”现象。

据悉,RealSafe-R1各尺寸模型及数据集将于近期向全球开发者开源。


“清华团队推出“安全增强版DeepSeek”大语言模型RealSafe-R1” 的相关文章

医保局接入DeepSeek!问不倒的“医保明白人”来了

医保局接入DeepSeek!问不倒的“医保明白人”来了

(人民日报健康客户端记者 周学津)继医疗企业和医院接入DeepSeek后,多地医保局也相继跟上,推动医保服务智能化升级。2月以来,山东省青岛市、广东省深圳市、北京市丰台区等多地医保上线了医保智能服务。...

地方政府热捧DeepSeek 市场追逐AI政务潮

地方政府热捧DeepSeek 市场追逐AI政务潮

财联社2月21日讯(记者 郭松峤)“目前模型的知识储备主要基于已有政务事项数据,部分复杂或特殊场景的知识覆盖仍需完善。”北京市丰台区政务服务和数据管理局相关负责人对财联社记者表示。不过,这不足以阻挡地...

外媒:DeepSeek启发全球AI公司创建更便宜模型

外媒:DeepSeek启发全球AI公司创建更便宜模型

据英国《金融时报》2日消息,包括OpenAI、微软和Meta在内的全球领先人工智能(AI)公司正在转向利用“蒸馏”技术,以创建对消费者和企业来说更便宜的人工智能模型。报道称,中国的DeepSeek运用...

李国杰院士“七问”DeepSeek都说了些什么?

李国杰院士“七问”DeepSeek都说了些什么?

近日,DeepSeek的横空出世,在全球科技领域激起千层浪,引发了从学界到业界的广泛热议与深度思考。《科技导报》2025年第3期刊发李国杰院士的《DeepSeek引发的AI发展路径思考》一文,深入剖析...

DeepSeek:像聊天一样清洗数据,复杂操作变简单

DeepSeek:像聊天一样清洗数据,复杂操作变简单

在日常工作中,你是否经常遇到这样的烦恼:表格数据杂乱无章,需要手动拆分单元格到不同行;二维交叉表难以分析,想转成一维表却无从下手;分组汇总时,想把多行合并成一行,但耗时费力……别焦虑!用DeepSee...

中信特钢DeepSeek-R1大模型接入 成功搭建“特钢信使”应用

中信特钢DeepSeek-R1大模型接入 成功搭建“特钢信使”应用

中信特钢3月3日在互动平台表示,公司大力推动数字技术与实体经济深度融合,以数字化转型驱动全方位改革,加快构建数据资产和挖掘数据价值,推进智能运维。公司近日完成了DeepSeek-R1大模型接入,成功搭...