투옌룬
Midea AI Research Center(AIRC) 연구원입니다.
SemaPLC(2026-08)의 1저자입니다. 이 논문은 PLC 제어 로직을 LLM이 생성할 때 모델이 스스로 완료를 선언하지 못하게 막고, 명세 감사와 컴파일과 라이브 런타임 검증 세 층의 외부 결과가 로그로 확인돼야만 종료를 허용하는 하네스를 제안합니다. 함수 트랙 117개 태스크와 프로젝트 트랙 65개 태스크를 백본 모델 일곱 개에 걸쳐 돌린 평가 설계도 이 논문의 기여입니다.
기존 Agents4PLC 벤치마크의 오라클에 결함이 있다는 것을 확인하고 PLC 엔지니어 3라운드 감사로 117개 중 43개 태스크를 수리한 뒤 모든 방법을 같은 데이터로 재평가한 대목도 1저자 작업에 포함됩니다.