우쭈쉬안

🏷️ 인물 컴퓨터비전 교수 NeurIPS논문

푸단대 컴퓨터과학대 부교수이자 Fudan Vision and Learning Laboratory 소속입니다. 메릴랜드대에서 Larry Davis 지도로 2020년 박사를 마쳤고, Facebook AI에서 리서치 사이언티스트로 일했습니다.

연구 축은 대규모 영상 이해, 영상 생성, 효율적 아키텍처입니다. 2017년 Snap PhD Fellowship(전 세계 10명), 2019년 Microsoft Research PhD Fellowship(전 세계 10명), 2022년 AI 2000 Most Influential Scholars를 받았습니다. Yu-Gang Jiang과 함께 Deep Learning for Video Understanding 책을 냈습니다.

영상 이해 쪽에서 쌓은 표현학습 경험이 N0-VTLA - Scaling Vision-Tactile-Language-Action Model with Latent Tactile Tokens의 프로젝트 리드로 이어졌습니다. 이 논문이 촉각을 재구성 대상이 아니라 잠재 예측 대상으로 놓은 선택은 영상 쪽의 JEPA 계열 사고와 같은 계보에 있습니다.