다이궈하오

🏷️ 인물 LLM GPU 교수 수석과학자

Infinigence AI의 수석과학자이며 상하이교통대학교에 적을 두고 있습니다. 상하이혁신연구원에도 참여합니다.

LLM 추론 가속이 주 무대입니다. GPU에서 디코딩 병목을 줄이는 FlashDecoding++, FPGA에 완결된 매핑 흐름을 올린 FlightLLM, 추측적 조기 종료로 추론을 앞당기는 SpecEE가 대표 작업입니다. 커널 수준 최적화에서 하드웨어 매핑까지 층을 가리지 않고 내려가는 편입니다.

칭화대 왕위의 NICS-EFC 그룹과 오래 협력해 왔습니다. NeoHorse-1 - Towards Recursive Self-Improvement via Agentic Post-Training with Routing Harness에서는 라우팅 하네스가 실제 서빙 환경에서 남기는 기록을 학습 신호로 되돌리는 설계에 참여했습니다. 추론 효율을 다루던 관점이 "서빙 자체를 데이터 소스로 본다"는 쪽으로 확장된 자리입니다.