研究论文
Examining Average and Discounted Reward Optimality Criteria in Reinforcement Learning
Vektor Dewanto, Marcus Gallagher
Queensland University of Technology The University of Queensland
来源Lecture notes in computer science
年份2022
阅读操作
确认中在文库中上传 PDF 后可生成中文音频讲解。
摘要与影响
摘要 · 节选
暂未获取摘要。可打开原文或 PDF,后续可基于全文生成更完整的速读。
逐年被引趋势
630
20
22
23
24
625
26
关键指标
14
被引次数 · OpenAlex
2.02
领域内被引倍数
同类平均 = 1
同类平均 = 1
前 12%
引用位次
同领域 · 同年份 · 同类型
同领域 · 同年份 · 同类型
61
参考文献
Google Scholar 与 OpenAlex 的被引统计范围不同,数值存在差异属正常。
AI 辅助阅读
依据:文献信息
论文问答
当前基于文献信息回答
可就本文提问;依据不足时会说明。
学术脉络
学科主题
计算机 / AIReinforcement Learning in Robotics
Supply Chain and Inventory Management · Auction Theory and Applications
参考文献 61
Issues in Using Function Approximation for Reinforcement Learning
被引 324Sebastian Thrun, Anton Schwartz · 1999
Sensitive Discount Optimality: Unifying Discounted and Average Reward Reinforcement Learning.
被引 17Sridhar Mahadevan · 1996
Handbook of Markov Decision Processes
被引 302Eugene A. Feinberg, Adam Shwartz · International series in management science/operations research/International series in operations research & management science · 2002
此处列出前 3 条
引用本文 14
Dopamine transients follow a striatal gradient of reward time horizons
被引 89Ali Mohebi, Wei Wei, Lilian Pelattini · Nature Neuroscience · 2024
Federated Digital Twin Construction via Distributed Sensing: A Game-Theoretic Online Optimization With Overlapping Coalitions
被引 33Ruoyang Chen, Changyan Yi, Fuhui Zhou · IEEE Transactions on Mobile Computing · 2025
Enhanced Federated Learning for Edge Data Security in Intelligent Transportation Systems
被引 32Rongbo Zhu, Mengyao Li, Jiangjin Yin · IEEE Transactions on Intelligent Transportation Systems · 2023
按被引量排序,此处列出前 3 条