마샤오텅
Macaron AI 최고연구책임자(CRO)이자 Mind Lab 총괄 책임자. 청화대(Tsinghua University) 자동화과에서 박사학위를 취득(2023)했으며, 이후 같은 학과에서 박사후 연구원으로 재직했습니다. 시안교통대학(Xi'an Jiaotong University) 자동화과 학사(2017). 마르코프 결정 과정, 강화학습, 다중에이전트 시스템과 게임이론을 주요 연구 분야로 삼고 있습니다. ICML 2024에 분포적으로 강건한 RL 논문을 발표했으며, JAIR 2025에 위험 민감 RL인 DSAC를 게재했습니다. Macaron AI에서 "경험으로 학습하는 AI(Experiential Intelligence)" 연구 철학 하에 MinT, LongStraw 등의 대규모 RL 훈련 시스템 개발을 이끌고 있습니다. 개인 홈페이지: https://xtma.github.io/.