研究论文
IVTP: Instruction-Guided Visual Token Pruning for Large Vision-Language Models
Kai Huang, Hao Zou, Xi Ye, BoChen Wang, Zhen Xie, Yu Liang
Alibaba Group (China)
来源Lecture notes in computer science
年份2024
阅读操作
确认中在文库中上传 PDF 后可生成中文音频讲解。
摘要与影响
摘要 · 节选
暂未获取摘要。可打开原文或 PDF,后续可基于全文生成更完整的速读。
逐年被引趋势
420
425
26
关键指标
6
被引次数 · OpenAlex
1.42
领域内被引倍数
同类平均 = 1
同类平均 = 1
前 13%
引用位次
同领域 · 同年份 · 同类型
同领域 · 同年份 · 同类型
29
参考文献
Google Scholar 与 OpenAlex 的被引统计范围不同,数值存在差异属正常。
AI 辅助阅读
依据:文献信息
论文问答
当前基于文献信息回答
可就本文提问;依据不足时会说明。
学术脉络
学科主题
计算机 / AIMultimodal Machine Learning Applications
Human Pose and Action Recognition · Advanced Image and Video Retrieval Techniques
参考文献 29
Making the V in VQA Matter: Elevating the Role of Image Understanding in Visual Question Answering
被引 2,280Yash Goyal, Tejas Khot, Douglas Summers-Stay · 2017
无标题文献
被引 7,281Rico Sennrich, Barry Haddow, Alexandra Birch · Edinburgh Research Explorer (University of Edinburgh)
此处列出前 3 条
引用本文 6
Visual Instruction Tuning towards General-Purpose Multimodal Large Language Model: A Survey
被引 6Jiaxing Huang, Jingyi Zhang, Kai Jiang · International Journal of Computer Vision · 2025
Libra-Merging: Importance-Redundancy and Pruning-Merging Trade-Off for Acceleration Plug-In in Large Vision-Language Model
被引 1Longrong Yang, Dong Shen, Chaoxiang Cai · 2025
ReCoVLM: A Reconfigurable FPGA–GPU Co-Design for Edge Vision-Language Inference
被引 0Yi-Xiang Wang, Yongjiang Xue, Kailai Zhuang · 2026
按被引量排序,此处列出前 3 条