VLMEvalKit: An Open-Source ToolKit for Evaluating Large Multi-Modality Models

VLMEvalKit: An Open-Source ToolKit for Evaluating Large Multi-Modality Models

Haodong Duan, Junming Yang, Yuxuan Qiao, Xinyu Fang, Lin Chen, Yuan Liu, Amit Agarwal, Zhe Chen, Mo Li, Yubo Ma, Hailong Sun, Xiangyu Zhao, Junbo Cui, Xiaoyi Dong, Yuhang Zang, Pan Zhang, Jiaqi Wang, Dahua Lin, Kai Chen. ACM Multimedia 2024 (2024).

Abstract. the available training data may be from general domains and models trained on this data may struggle to classify data from different target domains. Accordingly, improvements in training a model to label key-value labeled documents are desirable.

Updated: