A Dynamic Visual Benchmark for Evaluating Mathematical Reasoning Robustness of Vision Language Models
暂无评论,来聊聊你的看法吧