研究论文
MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark
Yubo Wang, Xueguang Ma, Ge Zhang, Yuansheng Ni, Abhranil Chandra, Shiguang Guo, Weiming Ren, Aaran Arulraj 等 17 位
阅读操作
确认中在文库中上传 PDF 后可生成中文音频讲解。
摘要与影响
摘要 · 节选
暂未获取摘要。可打开原文或 PDF,后续可基于全文生成更完整的速读。
逐年被引趋势
71360
25
7126
关键指标
82
被引次数 · OpenAlex
25.36
领域内被引倍数
同类平均 = 1
同类平均 = 1
前 0.2%
引用位次
同领域 · 同年份 · 同类型
同领域 · 同年份 · 同类型
0
参考文献
Google Scholar 与 OpenAlex 的被引统计范围不同,数值存在差异属正常。
AI 辅助阅读
依据:文献信息
论文问答
当前基于文献信息回答
可就本文提问;依据不足时会说明。
学术脉络
学科主题
计算机 / AINatural Language Processing Techniques
Speech and dialogue systems · Topic Modeling
参考文献 0
暂无参考文献明细
引用本文 82
From System 1 to System 2: A Survey of Reasoning Large Language Models
被引 23Duzhen Zhang, Zhongzhi Li, Mingliang Zhang · IEEE Transactions on Pattern Analysis and Machine Intelligence · 2025
R1-Onevision: Advancing Generalized Multimodal Reasoning Through Cross-Modal Formalization
被引 20Yi Yang, Xiaoxuan He, Hongkun Pan · 2025
Automating expert-level medical reasoning evaluation of large language models
被引 18Shuang Zhou, Wenya Xie, Jiaxi Li · npj Digital Medicine · 2025
按被引量排序,此处列出前 3 条