研究论文
BeaverTails: Towards Improved Safety Alignment of LLM via a Human-Preference Dataset
Jiaming Ji, Mickel Liu, Josef Dai, Xuehai Pan, Chi Zhang, Ce Bian, Boyuan Chen, Ruiyang Sun 等 10 位
阅读操作
确认中在文库中上传 PDF 后可生成中文音频讲解。
摘要与影响
摘要 · 节选
暂未获取摘要。可打开原文或 PDF,后续可基于全文生成更完整的速读。
逐年被引趋势
23120
2326
关键指标
23
被引次数 · OpenAlex
4.73
领域内被引倍数
同类平均 = 1
同类平均 = 1
前 4%
引用位次
同领域 · 同年份 · 同类型
同领域 · 同年份 · 同类型
0
参考文献
Google Scholar 与 OpenAlex 的被引统计范围不同,数值存在差异属正常。
AI 辅助阅读
依据:文献信息
论文问答
当前基于文献信息回答
可就本文提问;依据不足时会说明。
学术脉络
学科主题
计算机 / AISemantic Web and Ontologies
Data Quality and Management · Data Mining Algorithms and Applications
参考文献 0
暂无参考文献明细
引用本文 23
Benchmarking Prompt Injection Attacks on LLMs: Turkish Vulnerability Assessment and English Comparative Analysis
被引 1Öner Aytaş, Tuğçe Şen, Banu Di̇ri̇ · Applied Sciences · 2026
Large Language Models in practice: A comprehensive review of privacy risks, attacks, and defense mechanisms for intelligent system deployment
被引 1Jianhao Li, Jinsong Wang, Zening Zhao · Computer Standards & Interfaces · 2026
STELLAR: A Search-Based Testing Framework for Large Language Model Applications
被引 1Lev Sorokin, Ivan Vasilev, Ken E. Friedl · 2026
按被引量排序,此处列出前 3 条