研究论文
BackdoorAlign: Mitigating Fine-tuning based Jailbreak Attack with Backdoor Enhanced Safety Alignment
Jiongxiao Wang, Jiazhao Li, Bo Li, Jiazhao Li, Junjie Hu, Yixuan Li, Patrick McDaniel, Muhao Chen 等 10 位
阅读操作
确认中在文库中上传 PDF 后可生成中文音频讲解。
摘要与影响
摘要 · 节选
暂未获取摘要。可打开原文或 PDF,后续可基于全文生成更完整的速读。
逐年被引趋势
320
325
26
关键指标
5
被引次数 · OpenAlex
1.74
领域内被引倍数
同类平均 = 1
同类平均 = 1
前 12%
引用位次
同领域 · 同年份 · 同类型
同领域 · 同年份 · 同类型
0
参考文献
Google Scholar 与 OpenAlex 的被引统计范围不同,数值存在差异属正常。
AI 辅助阅读
依据:文献信息
论文问答
当前基于文献信息回答
可就本文提问;依据不足时会说明。
学术脉络
学科主题
计算机 / AISecurity and Verification in Computing
Cryptographic Implementations and Security · Advanced Malware Detection Techniques
参考文献 0
暂无参考文献明细
引用本文 5
LLM Safeguard is a Double-Edged Sword: Exploiting False Positives for Denial-of-Service Attacks
被引 5Qingzhao Zhang, Ziyang Xiong, Z. Morley Mao · 2025
Adversarial Attacks and Defenses on Large Language Models: A Systematic Review
被引 3Ruobing Li, Jiayi Liu, Jinyang Zhen · 2025
SAFT: Safety-Preserving Adaptation via Fine-Tuning Transfer for Large Language Models
被引 0Zhiwen Ruan, Yan Yang, Zhuocheng Liang · 2026
按被引量排序,此处列出前 3 条