
OpenCompass multimodal benchmark...
MMBench's image-text coverage and EN/ZH + CCBench make it key for multimodal evaluation. Deep OpenCompass integration. VLMEvalKit supports 80+ benchmarks. Best for VLM developers, multimodal researchers.
MMBench is OpenCompass multimodal benchmark for LVLM evaluation. MMBench-Dev/Test English (1164/1784), Chinese versions, CCBench Chinese culture (510). Integrated with VLMEvalKit for 80+ benchmarks.
Difficulty: Intermediate
Image-Text Evaluation
Evaluates LVLM image-text understanding and reasoning
Bilingual + CCBench
EN/ZH MMBench plus CCBench 510 Chinese culture questions
VLMEvalKit Integration
Integrates with VLMEvalKit for 80+ multimodal benchmarks
VLM Evaluation
Developers evaluate LVLM image-text capability
Multimodal Leaderboard
Compare multimodal models via OpenCompass MMBench leaderboard
VLMEvalKit or OpenCompass tools, GPU for VLM inference.
CCBench: 510 Chinese culture questions for cultural understanding.
Real reviews and feedback from users