김보섭
김보섭
김보섭은 카카오 Kanana LLM 팀의 시니어 연구자입니다. 한국어 대규모 언어모델 계보의 초창기부터 사전학습 쪽에 있어 온 인물입니다.
대표 연구
2021년 EMNLP에 실린 What Changes Can Large-scale Language Models Bring? Intensive Study on HyperCLOVA: Billions-scale Korean Generative Pretrained Transformers의 제1저자입니다. 네이버 클로바가 만든 수백억 파라미터급 한국어 생성 모델의 학습과 평가를 정리한 논문으로, 한국어 LLM 연구의 기준점 역할을 했습니다.
현재는 카카오에서 이중언어 모델 시리즈 Kanana의 사전학습을 맡고 있습니다. COLM 2026 논문 Let's Scale Step by Step: Compute-Efficient Hyperparameter Transfer for Large-Scale Mixture-of-Experts의 교신저자로, 총 155B·활성 17B MoE 모델을 스윕 없이 예측한 학습률로 10조 토큰 학습하는 작업을 함께 이끌었습니다.