리중즈
조지아대학교(University of Georgia) 컴퓨터과학 박사과정 학생이면서 Tencent HY LLM Frontier에서 함께 연구합니다. 관심사는 장기 호라이즌 터미널 에이전트로, 에이전트가 수십에서 수백 단계에 걸쳐 실행하는 작업을 어떻게 평가하고 어떻게 학습시킬지를 양쪽에서 다룹니다.
스위청, 리쭝샤와 함께 RST(Recursive Synthetic Terminal Tasks)의 공동 1저자를 맡았습니다. 같은 팀이 앞서 내놓은 Long-Horizon-Terminal-Bench에도 핵심 기여자로 참여했습니다. 평가 벤치마크를 먼저 만들고 그 위에서 학습 데이터 합성으로 넘어간 흐름을 두 논문이 이어서 보여줍니다.