Instruction-ViT: Multi-modal prompts for instruction learning in vision transformer
作者:Zhenxiang Xiao, Yuzhong Chen, Junjie Yao, Lu Zhang, Zhengliang Liu, Zihao Wu, Xiaowei Yu, Yi Pan, Lin Zhao, Chong Ma, Xinyu Liu, Wei Liu, Xiang Li, Yixuan Yuan, Dinggang Shen, Dajiang Zhu, Dezhong Yao, Tianming Liu, Xi Jiang · 发表于:Information Fusion · 年份:2023 · DOI:10.1016/j.inffus.2023.102204 · 被引用次数:26 · 研究领域:Multimodal Machine Learning Applications、Domain Adaptation and Few-Shot Learning、Natural Language Processing Techniques