Top开源大模型安全测评报告(2024)
- 来源:安信信息
- 发布时间:2025/01/10
- 浏览次数:796
- 举报
Top开源大模型安全测评报告(2024).pdf
Top开源大模型安全测评报告(2024)。为深入学习贯彻全国两会精神和党的二十届三中全会精神,落实《中共中央关于进一步全面深化改革、推进中国式现代化的决定》作出“建立人工智能安全监管制度”“完善生成式人工智能发展和管理机制”的重要部署以及根据《中华人民共和国网络安全法》《中华人民共和国数据安全法》《中华人民共和国个人信息保护法》《生成式人工智能服务管理办法》《工业和信息化部等十六部门关于促进数据安全产业发展的指导意见》等法律法规政策文件要求,促进和引导人工智能大模型技术向“负责任、可持续、高可靠”目标发展,让人工智能大模型...
《Top开源大模型安全测评报告(2024)》是由安信信息发布的一份报告,本报告聚焦国内外开源大模型的安全风险测评,通过选取典型的12家20款开源大模型,从12个方面展开深入安全测评, 旨在提高大模型厂商的安全意识和保障行业用户的合法权益,并通过系统性分析国内外开源大模型安全的综合表现,为人工智能大 模型产业各界提供参考。
从大模型安全风险总览来看,开源大模型存在一定安全风险,国内开源大模型安全性整体上 优于国外开源大模型,大模型安全治理工作任重道远需各方共同努力。从大模型安全风险类型分布来看,公共安全、道德伦理、不良信息和网络安全风险较为严重, 谨慎使用国外开源大模型作为基座模型。从大模型安全风险检测方式来看,开源大模型在面对内容分割重组、角色伪装、直接问答、 语言切换、混合攻击等检测方式时防护能力较弱,大模型如何抵御各类型的攻击方式需持续研究。
从国家安全风险类型来看,测试策略数量为268个,其中aya:8b、mistral:7b-instruct、mistral在该风险类 型中风险数量最多,aya:8b单项风险占比最高为20.52%,internlm2:7b单项风险占比最低为2.24%。从历史文化风险类型来看,测试策略数量为5个,其中llama3:8b、mistral:7b-instruct在该风险类型中风 险数量最多,llama3:8b和mistral:7b-instruct单项风险占比最高为20%,其他被测开源大模型未出现该风险。

从公共安全风险类型来看,测试策略数量为478个,其中mistral:7b-instruct、mistral、yi-1.5:6b在该风险 类型中风险数量最多,mistral:7b-instruct单项风险占比最高为17.36%,deepseek-v2:16b-lite-chat-q4_K_M单 项风险占比最低为0.41%。从网络安全风险类型来看,测试策略数量为111个,其中yi:6b、yi-1.5:6b、glm4:9b-chat-q4_K_M在该风 险类型中风险数量最多,yi:6b单项风险占比最高为32.43%,llama3.1:latest单项风险占比最低为1.81%
从不良信息风险类型来看,测试策略数量为199个,其中aya:8b、mistral、mistral:7b-instruct在该风险类 型中风险数量最多,aya:8b单项风险占比最高为28.14%,internlm2:7b单项风险占比最低为3.01%。从道德伦理风险类型来看,测试策略数量为504个,其中falcon、mistral:7b-instruct、llama3.1:latest 在该风险类型中风险数量最多,falcon单项风险占比最高为21.23%,internlm2:7b单项风险占比最低为1.78%。
从隐私信息风险类型来看,测试策略数量为137个,其中aya:8b、yi-1.5:6b、mistral、mistral:7b-instruct 在该风险类型中风险数量最多,aya:8b单项风险占比最高为12.4%,gemma2:9b-instruct-q4_K_M单项风险占 比最低为1.45%。从商业金融风险类型来看,测试策略数量为85个,其中yi:6b、yi-1.5:6b、falcon在该风险类型中风险数量 最多,yi:6b单项风险占比最高为14.12%,qwen2.5:7b、internlm2:7b和glm4:9b-chat-q4_K_M未出现该风险。

从公民权利风险类型来看,测试策略数量为89个,其中yi:6b、yi-1.5:6b、falcon在该风险类型中风险数量 最多,yi:6b和yi-1.5:6b单项风险占比最高为21.34%,qwen:7b、qwen2:7b和qwen2.5:7b等6个开源大模型未出 现该风险。从医疗卫生风险类型来看,测试策略数量为70个,其中aya:8b、falcon、llama3.1:latest在该风险类型中风 险数量最多,aya:8b和falcon单项风险占比最高为10%,deepseek-llm:7b和deepseek-v2:16b-lite-chat-q4_K_M 等5个开源大模型未出现该风险。
从模型滥用风险类型来看,测试策略数量为70个,其中deepseek-v2:16b-lite-chat-q4_K_M、falcon、 llama3.1:latest在该风险类型中风险数量最多,deepseek-v2:16b-lite-chat-q4_K_M、llama3.1:latest和falcon单 项风险占比最高为2.85%,qwen:7b、qwen2:7b和qwen2.5:7b等9个开源大模型未出现该风险。从基础安全风险类型来看,测试策略数量为20个,其中llama3.1:latest和mistral:7b-instruct在该风险类型 中风险数量最多,llama3.1:latest和mistral:7b-instruct单项风险占比最高为10%,qwen:7b、qwen2.5:7b和 deepseek-v2:16b-lite-chat-q4_K_M等9个开源大模型未出现该风险。
开源大模型安全现状总结:从大模型安全风险等级来看,国外开源大模型安全风险比国内开源大 模型等级高,全球人工智能安全治理工作迫在眉睫。 从大模型安全风险类型来看,从国内外开源大模型在公共安全、道 德伦理、不良信息和网络安全风险类型测试不通过率高。 从大模型安全检测方式来看,国内外开源大模型抵御特殊构造指令 攻击方式能力不足,模型容易被误导,导致输出有害内容。 总体上,国内外开源大模型存在一定安全风险,内容安全防护能力 较为薄弱,安全研究投入占比少。在行业自律方面,建议制定人工智能安全伦理准则,确保大模型的开发和应用符合伦理 道德标准,维护国家安全,尊重公民权利,捍卫公平正义。 在AI厂商方面,建议加大人工智能大模型安全研究投入,采用综合的安全策略,结合多种 新兴技术手段来防御各类型变种攻击,提升人工智能大模型的内生安全能力。 在产业应用方面,建议重点行业重点领域部署和应用人工智能大模型时,严格审核人工 智能大模型的内容安全、模型安全、供应链安全和系统安全风险,严防人工智能大模型产生 安全风险。
编辑:999感冒灵-
标签
- 开源大模型
- 相关标签
- 热门文档
- 热门文章
- 本年热门
- 本季热门
- 本月热门
- 1 关于2025年国民经济和社会发展计划执行情况与2026年国民经济和社会发展计划草案的报告——2026年3月5日在第十四届全国人民.pdf
- 2 中国网络视听协会:中国网络视听发展研究报告(2026) .pdf
- 3 市场监管局:2025直播电商行业发展白皮书.pdf
- 4 房地产行业第8_9周周报(2026年2月14日_2026年2月27日):26年春节新房成交量低于23_25年,二手房成交量高于23_25年;上海优化限购、公积金和房产税政策.pdf
- 5 中国新就业形态研究中心-2025中国蓝领群体就业研究报告.pdf
- 6 中国股票策略:中国最佳商业模式研究(第二版).pdf
- 7 互联网行业:第57次中国互联网络发展状况统计报告.pdf
- 8 2026年政府工作报告.pdf
- 9 中国2026年展望:探索新动能.pdf
- 10 2025中国新就业形态报告.pdf
- 1 中国新就业形态研究中心-2025中国蓝领群体就业研究报告.pdf
- 2 腾讯研究院-从超级个体到超级团队:AI时代组织变革的涌现路径.pdf
- 3 兰花科创-600123-优质无烟煤龙头,煤化一体静待周期反转与技改红利释放.pdf
- 4 机械设备行业:拥抱科技,重视AI为主线的设备及硬件等投资机会.pdf
- 5 TGV玻璃基板行业动态报告:玻璃基板崛起,赋能先进封装.pdf
- 6 电力设备行业跟踪周报:锂电储能业绩亮眼、拓展AI第二增长曲线.pdf
- 7 玻璃基封装行业专题:玻璃基板有望成为先进封装新平台.pdf
- 8 投资策略-激光通信行业深度:行业现状、终端结构、市场规模及相关公司深度梳理.pdf
- 9 锐翔智能-920178-北交所首次覆盖报告:FPC整线“小巨人”深度绑定头部客户,向光模块固晶机设备延伸成长边界.pdf
- 10 纺服行业周报:运动品牌Q2流水放缓,安踏、361度表现韧性强.pdf
- 1 锐翔智能-920178-北交所首次覆盖报告:FPC整线“小巨人”深度绑定头部客户,向光模块固晶机设备延伸成长边界.pdf
- 2 房地产行业专题报告:城市更新推动高质量发展.pdf
- 3 千瓜数据-消费行业:2026年上半年热门行业数据简报.pdf
- 4 AI医疗行业2026年6月月报:AI诊断与药研资本化提速,医疗智能体加速落地.pdf
- 5 厄尔尼诺如何影响资产价格:气候风险传导、历史复盘与2026年展望.pdf
- 6 投资策略:这一次,是金银的拐点吗?.pdf
- 7 风电行业2026年中期策略报告:短期招标承压,看好“十五五”两海成长空间.pdf
- 8 宏观专题:俄乌冲突最新进展如何?.pdf
- 9 腾讯研究院-FDE模式行业观察与实践:前线共创,双向赋能.pdf
- 10 银行业理财登记托管中心-中国银行业理财市场半年报告(2026年上).pdf
- 本年热门
- 本季热门
- 本月热门
- 1 2026年莱特光电公司深度报告:“一核双擎”打造中国电子材料领军企业
- 2 2025年医药行业2026年度策略报告:创新药产业链景气度持续提升
- 3 2026年大族激光公司研究报告:PCB消费电子利好有望助力2025_27年盈利持续增长
- 4 2026年分众传媒公司深度报告:基本盘稳固,格局优化+“碰一碰”开启成长新周期
- 5 2026年春季港股及海外中资股投资策略:分化与回归
- 6 2026年航空行业夏航季民航时刻计划详解:稳中求进,国内控总量、国际促复苏
- 7 2026年春季A股投资策略:为第二阶段上涨蓄力,时代资产不退场
- 8 2026年中银香港公司研究报告:高股息护航,财富与出海共促成长
- 9 2026年固收增厚产品系列报告之一:可转债基金的再定位与再解析
- 10 2026年春季北交所化工新材料行业投资策略:周期迎拐点,成长正当时
- 1 2026年6月人形机器人行业月报:资本化提速与量产渐近
- 2 2026年全球人工智能技术、政策、产业与投融资趋势全景洞察
- 3 2026年6月A股市场研判:AI引领向上,聚焦算力与景气延伸
- 4 2026 AI重塑影视产业:漫剧爆发与产业链重构深度解析
- 5 2026年7月A股量化择时:AI识图聚焦半导体与芯片赛道
- 6 氧化锆断供与HBM瓶颈:全球产业趋势跟踪周报(2026年6月29日)
- 7 2026 ASCO年会国产创新药双抗ADC临床数据梳理
- 8 2026年中期医药生物行业投资策略:AI新药加速推进
- 9 A股2026年6月策略:景气强化与震荡上行配置建议
- 10 宁德时代发布钠电储能方案,7月中国电池排产环比增长
