Advancing Fine-Grained Visual Understanding with Multi-Scale Alignment in Multi-Modal Models
作者:Wei Wang, Zhaowei Li, Qi Xu, Linfeng Li, Yiqing Cai, Botian Jiang, Hang Song, Xingcan Hu, Pengyu Wang, Li Xiao · 年份:2025 · DOI:10.18653/v1/2025.emnlp-main.721 · 被引用次数:4 · 研究领域:Multimodal Machine Learning Applications、Domain Adaptation and Few-Shot Learning、Generative Adversarial Networks and Image Synthesis
Wei Wang, Zhaowei Li, Qi Xu, Linfeng Li, YiQing Cai, Botian Jiang, Hang Song, Xingcan Hu, Pengyu Wang, Li Xiao. Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing. 2025.