양 레이
개요
Lei Yang(양 레이)은 SenseTime Research에서 멀티모달 모델의 공간 지능(spatial intelligence) 라인을 이끄는 시니어 연구자입니다. SenseNova-SI 시리즈와 EASI 평가 플랫폼을 주도하며 멀티모달 공간 추론 분야의 모델 개발과 평가 인프라 구축을 동시에 담당하고 있습니다. 공간 지능이란 객체의 거리, 위치, 이동 방향을 정확히 파악하는 능력으로, 자율주행과 로봇 내비게이션의 핵심 요소입니다.
SenseNova-SI는 CVPR 2026에 채택된 논문(arXiv:2511.13719)을 기반으로 하며, 오픈소스 공개 후 GPT-5와 Gemini-3-Pro 같은 대형 클로즈드 모델을 핵심 공간 벤치마크에서 추월한 결과로 주목받았습니다. 공간 지능 특화 모델을 오픈소스로 공개한 것 자체가 커뮤니티에 드문 기여입니다.
생애
양 레이의 세부 학력 정보는 공개되지 않았습니다. SenseTime Research 소속 시니어 연구자로서 멀티모달 모델, 특히 공간 지능과 평가 인프라 분야에 집중해 왔습니다. 연구 방향은 단순한 모델 훈련에 그치지 않고, 평가 체계 표준화까지 포함하는 것이 특징입니다. SenseNova-U1 프로젝트에서 시니어 프로젝트 리드 6인 중 1인으로 이름이 올라 있으며, 이는 SenseTime 내에서 공간 지능 축을 대표하는 위치임을 보여줍니다.
업적
대표 성과는 SenseNova-SI-8M 데이터셋 큐레이션입니다. 공간 능력을 정교한 분류 체계(taxonomy)로 구분한 800만 샘플 규모의 학습 데이터로, 이를 기반으로 훈련한 2B 및 8B 모델이 VSI-Bench 68.8%, MMSI 43.3%, MindCube 85.7%, ViewSpatial 54.7%를 기록했습니다. 동급 오픈소스 모델은 물론 GPT-5와 Gemini-3-Pro까지 추월한 수치입니다.
평가 인프라 측에서는 EASI(Holistic Evaluation of Multimodal LLMs on Spatial Intelligence)를 2025년 8월 공개했습니다. 모델 20여 종과 벤치마크 20여 종을 Docker 환경에서 재현 가능하게 돌릴 수 있는 원스톱 리더보드 플랫폼으로, 공간 지능 평가의 표준화를 목표로 합니다. EASI 리더보드에서 GPT-5조차 인간 수준에 크게 미치지 못한다는 결과는 공간 지능이 여전히 미해결 과제임을 드러냈습니다.
SenseNova-U1에서는 공간 지능 평가를 직접 설계하고 측정했습니다. VSI-Bench, ViewSpatial, MindCube-Tiny, 3DSR-Bench에서 동급 크기·think 모드의 Qwen3VL을 일관되게 앞선 결과는 SenseNova-SI 라인의 훈련 노하우가 U1에 그대로 이식된 것입니다.
여담
SenseTime은 매출 50억 위안(2025년 기록)을 넘기며 대형 AI 기업 대열에 들어섰고, SenseNova 라인은 그 기술 축의 중심입니다. 양 레이가 이끄는 공간 지능 라인은 자율주행과 로봇 내비게이션 양쪽에 직접 연결되는 응용 가치가 있어 SenseTime 사업 전략과도 맞닿아 있습니다.
SenseNova-SI를 오픈소스로 공개한 결정은 연구 커뮤니티에 실질적인 기여였습니다. 공간 지능 특화 대형 모델을 오픈소스로 내놓는 경우가 드물어, 이후 해당 분야 연구의 기준선 역할을 하게 될 가능성이 높습니다.
주요 논문
- "Scaling Spatial Intelligence with Multimodal Foundation Models" (CVPR 2026, arXiv:2511.13719, 공저자) -- SenseNova-SI 시리즈
- "Holistic Evaluation of Multimodal LLMs on Spatial Intelligence" (EASI, arXiv:2508.13142, 2025년 8월)
- SenseNova-U1 기술 보고서 (시니어 프로젝트 리드, 2026)
- MMSI-Bench 관련 논문 (arXiv:2505.23764, 멀티이미지 공간 지능 벤치마크)