후샤오빈
싱가포르국립대학교(NUS) 소속 연구자이며 Tencent 유투랩(YouTu Lab)에서도 함께 일합니다. 통합 멀티모달 모델(UMM)의 이미지 생성과 편집이 주 분야입니다.
멀티 이미지 편집을 UMM으로 일반화하는 프레임워크, 이미지 생성에 추론을 끼워 넣는 interleaved reasoning, 이종 전문가를 잇는 통합 이해·생성 아키텍처 같은 주제로 논문을 냈습니다. 2026년에는 멀티모달 의료 멀티에이전트 시스템 서베이·벤치마크 작업도 했습니다.
ToolArtist - Tool-Using Unified Multimodal Models for Agentic Image Generation의 교신저자입니다. UMM의 생성 능력을 어디까지 정책 안에 넣을 수 있는지가 그의 기존 연구 흐름과 그대로 이어집니다.