首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >揭开大语言模型的脆弱面:对抗攻击研究综述(二)

揭开大语言模型的脆弱面:对抗攻击研究综述(二)

作者头像
亿人安全
发布2026-04-02 17:31:04
发布2026-04-02 17:31:04
5120
举报
概述
本文聚焦于已对齐单模态大语言模型(LLM)的两类主流对抗攻击 ——越狱攻击与提示注入攻击展开综述。在各章节中,我们先对攻击类型进行定义与概述,再从基本假设、方法差异、研究范畴及核心发现等维度,对现有攻击范式进行系统分类与梳理。
文章被收录于专栏:红蓝对抗红蓝对抗

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
相关产品与服务
腾讯云代码分析
腾讯云代码分析(内部代号CodeDog)是集众多代码分析工具的云原生、分布式、高性能的代码综合分析跟踪管理平台,涵盖代码安全、质量、规范、度量等,通过持续跟踪分析代码,观测项目代码质量,助力维护团队卓越代码文化。
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档