ITADN

请教如何使用GLMV模型作为裁判模型进行主观评测

#1481Closedmitoly 创建于 2026-03-11
M
mitolycommented
<img width="1493" height="107" alt="Image" src="https://github.com/user-attachments/assets/10d7422b-75db-4ac8-b8e7-55b705369130" /> ``` (VLMEvaLKit) root@iZuf6baa0n75gfsfx0pgtsZ:/VLMEvalKit# cat .env # .env 文件,将其放置在 $VLMEvalKit 下 GLMV_API_KEY=8be1f2763208429ab9bb76xxxxxxxxxx.9EqCEpJCRw7R3Kjt # 你可以设置一个评估时代理,评估阶段产生的 API 调用将通过这个代理进行 #EVAL_PROXY= ``` 评测命令为:python run.py --data MMBench_DEV_CN --model Qwen3-VL-8B-Instruct --mode eval --reuse --verbose 提示如下,默认调用了openai进行,因为服务器在国内,所以希望使用国内模型进行主观评测 <img width="1488" height="521" alt="Image" src="https://github.com/user-attachments/assets/2d7082d5-8c38-420b-b972-89f282665d2a" /> 因为在本人是python新手,并且教程指引上也没有明确的提示,故来寻问,感谢支持!
关闭于 2026-03-25 2 条评论