저우펑페이

🏷️ 인물 멀티모달 벤치마크 AI평가

싱가포르국립대학교 HPC-AI Lab과 Inf Rec Cardinal AI Lab에 소속된 연구자입니다. 초기 이력은 멀티모달 평가 쪽에 몰려 있습니다. 중국어 멀티모달 문항 이해·추론 벤치마크 CMMU(2024), 다학제 시험 문제로 멀티모달 LLM을 평가하는 MDK12-Bench(2025)의 저자로 이름을 올렸고, 데이터셋 증류 평가를 재검토한 DD-Ranking(2025)에도 공저자로 참여했습니다.

세 작업 모두 "무엇을 점수로 삼을 것인가"를 다시 묻는 계열입니다. 벤치마크가 실제 능력을 재고 있는지, 증류 데이터셋의 평가 관행이 성립하는지를 파고들었습니다. Agentic Game Development 논문에서 공간 생성의 보상 프록시가 흐릿하다는 문제를 출발점으로 삼은 것은 이 궤적의 연장선에 있습니다. 측정 도구를 의심하던 사람이 측정 도구 자체를 게임 엔진에서 조달하자고 제안한 셈입니다.