양쥔린

🏷️ 인물 에이전트 강화학습

개요

Junlin Yang은 Frontis.AI(Horizon Research) 소속으로, Frontis-MA1 기술 리포트의 1저자이자 Che Jiang과 함께 프로젝트 공동 리더로 표기됩니다.

Frontis-MA1은 재귀적 자기개선(RSI)을 논하는 대신 ML 엔지니어링이라는 실행 가능한 테스트베드로 내려서 재는 접근을 취합니다. OpenMLE-Gym(5,758개 검증된 태스크 환경), OpenMLE-ERL(연산자 학습), OpenMLE-Evo(장기 탐색)로 이루어진 풀스택을 공개하고, 그 위에서 Draft·Improve·Debug·Crossover 네 개 원자 연산자를 학습과 추론에서 같은 어휘로 쓰게 만든 것이 설계의 축입니다.

업적

관련