报告
On-Policy Distillation
Thinking Machines Lab, Kevin Lu
阅读操作
确认中在文库中上传 PDF 后可生成中文音频讲解。
摘要与影响
摘要 · 节选
暂未获取摘要。可打开原文或 PDF,后续可基于全文生成更完整的速读。
逐年被引趋势
530
525
26
关键指标
7
被引次数 · OpenAlex
-
领域内被引倍数
同类平均 = 1
同类平均 = 1
-
引用位次
同领域 · 同年份 · 同类型
同领域 · 同年份 · 同类型
0
参考文献
Google Scholar 与 OpenAlex 的被引统计范围不同,数值存在差异属正常。
AI 辅助阅读
依据:文献信息
论文问答
当前基于文献信息回答
可就本文提问;依据不足时会说明。
学术脉络
学科主题
暂无主题数据
参考文献 0
暂无参考文献明细
引用本文 7
Clustering-Based Weight Orthogonalization for Stabilizing Deep Reinforcement Learning
被引 1Guoqing Ma, Yuhan Zhang, Yuming Dai · 2025
FedKGD: Federated Knowledge-Generating Distillation for Heterogeneous Reinforcement Learning
被引 0Jiangzhou Liao, Xuanhe Yu, Qiyuan Xiao · 2026
Cognitive Radar Antijamming via Synergistic Frequency–Polarization Adaptation
被引 0Wenbin Wei, Rui Guo, Zengping Chen · IEEE Transactions on Aerospace and Electronic Systems · 2026
按被引量排序,此处列出前 3 条