임베딩 검색을 버리고 grep으로 코퍼스를 직접 뒤지는 에이전트가 늘고 있습니다. 문제는 어디부터 볼지 모른다는 것입니다. RARG는 임베딩을 버리지 않되 문서를 고르는 데 쓰지 않고 rg의 탐색 순서와 출력 가시성을 정하는 데 씁니다. 정확도 84%에 도구 호출 23.9회로, DCI의 78%·99.1회를 양쪽에서 앞섭니다.
태그: NLP
50개의 게시물
-
-
Improved Large Language Diffusion Models 2026-06-30자기회귀 없이 완전 양방향 어텐션으로 LLM을 처음부터 학습하는 마스크드 확산 언어 모델 iLLaDA — 12T 토큰 사전학습과 25B 지시문 미세조정으로 Base 성능에서 Qwen2.5 7B를 처음으로 따라잡습니다.
-
70개 이상 LLM을 2만 6천 개 개방형 질문으로 평가해 모델 간 출력 동질화를 실증한 NeurIPS 2025 Best Paper.
-
토큰화 2026-04-10텍스트를 모델이 처리할 수 있는 최소 단위(토큰)로 분할하는 전처리 과정
-
Word2Vec 2026-04-10단어를 주변 문맥 기반으로 밀집 벡터로 표현하는 정적 임베딩 알고리즘
-
Attention Is All You Need 2025-09-01'Attention Is All You Need'는 RNN을 버리고 셀프 어텐션만으로 시퀀스를 처리하는 Transformer 아키텍처를 제안한 2017년 논문입니다. 기계 번역에서 당시 SOTA를 경신했고, 이후 BERT·GPT·Claude를 포함한 거의 모든 대형 언어 모델의 기반이 되었습니다.
-
미국 일리노이대 어배너섐페인(UIUC) 컴퓨터과학과 교수. 대화형 AI의 권위자로 아마존 알렉사 AI 수석 주임과학자를 지냈습니다.
-
옥스퍼드대 OATML·Big Data Institute 박사후연구원. 멀티모달 학습·생성모델·월드 모델링 연구자로 NExT-GPT 공저자
-
워털루대학교 컴퓨터과학과 조교수. NLP·ML 연구자. Im2LaTeX, WildChat 개발자. Reading to Learn Lab 설립자.
-
베이징대학교(PKU) 박사과정 NLP 연구자로 GUI 에이전트 데이터셋·트래젝토리 합성에 집중하며, Xiaomi LLM-Core 인턴 기간에 Video2GUI 1저자를 맡았다
-
University of Washington 박사과정(Yejin Choi 지도), AI 안전성 및 가치 정렬 연구자, NeurIPS 2025 Best Paper Award 수상
-
텍스트나 이미지 같은 입력을 의미가 보존된 고차원 실수 벡터로 변환한 표현
-
홍콩 이공대학교 NLP 교수. 텍스트 요약·질의응답·다중 문서 추론 연구로 H-Index 52, 인용 13,000회+를 쌓은 시니어 연구자.
-
Alibaba DAMO Algorithm Expert, Qwen 핵심 기여자, NLP/LLM 사전학습 연구자
-
UIUC 교수, BLENDER Lab 창립자. 정보 추출·지식 증강 LLM·다국어 NLP 전공. Amazon Scholar 겸임.
-
저장대학교 연구자. HuggingGPT와 TaskBench의 저자로 LLM 에이전트의 과제 분해와 도구 호출을 연구.
-
중국과학원 정보공학연구소(IIE-CAS)와 Tencent WeChat AI 소속 NLP 연구자. 대화 속 감정 인식·감정 원인 추출에서 에이전틱 검색으로 옮겨 온 RARG 공동 1저자
-
Stanford HAI 교수, NVIDIA 수석 연구 과학자, 상식 추론 및 LLM 동질화 연구자, 2022 맥아더 펠로우
-
싱가포르국립대 컴퓨터과학 박사과정. LLM의 효율성·다국어·정렬·추론 연구자로 Babel 다국어 모델 공저자
-
University of Leeds 및 Southwest Jiaotong University 소속 NLP 연구자. LLM 심리사회적 안전 평가 시스템 DialogGuard 개발 및 에이전트 abstention 연구.
-
Fudan University 컴퓨터과학부 교수. 대형 언어 모델·NLP·구현 AI 연구. MOSS 오픈소스 LLM 개발 주도.
-
중국인민대학 가오링인공지능학원 박사과정. RAG 환각 탐지 연구 ReDeEP로 ICLR 2025 스포트라이트(상위 5.1%)
-
중국과학원 정보공학연구소(IIE-CAS) 연구자. 멀티모달 가짜뉴스 탐지의 설명 기반 동적 검색을 다뤘고 RARG 공동 1저자
-
워싱턴대학교 세인트루이스 컴퓨터과학·공학과 조교수. 라벨 효율적 지식 획득과 언어모델 신뢰성·효율성을 연구하며 ACL·NAACL 우수논문상 수상.
-
하버드대학교 컴퓨터과학과 교수. 계산언어학·자연어처리 분야 원로 연구자. Center for Research on Computation and Society 창설자.
-
중국 톈진대(Tianjin University) 연구자. 자연어처리와 추천 시스템을 연구하며 문서 QA 에이전트로 영역을 넓혔습니다.
-
카카오 Kanana LLM 팀 시니어 연구자. HyperCLOVA 논문 공저자이자 Kanana 사전학습 축을 이끄는 인물
-
CMU 언어기술연구소 조교수, AI2 AI 안전 수석 연구 과학자, 소셜 NLP 및 AI 편향 연구자, 2025 Packard Fellow
-
University of Washington Information School 박사과정생. LLM abstention(답변 거절) 연구의 핵심 저자로, 벤치마크·서베이·강화학습 기반 abstention 개선 방법론을 연구.
-
Tencent 산하 WeChat의 AI 연구조직. Pattern Recognition Center를 중심으로 NLP·기계번역·대화·검색 연구를 냅니다
-
CUHK 시스템공학·공학경영학과 교수. CUHK Text Mining Group 책임자. NLP·정보 검색 분야 선구적 연구자.
-
미국 일리노이대 어배너섐페인(UIUC) 컴퓨터과학과 정교수. 전산언어학·자연어처리의 권위자로 CCG 문법과 이미지 캡셔닝 연구로 알려졌습니다.
-
UCLA CS Associate Professor, PLUSLAB 디렉터, controllable·creative natural language generation 분야 NSF CAREER 수상자
-
베이징대학교 EECS 학과 교수이자 MOE 전산언어학 핵심실험실(Key Lab of Computational Linguistics)에서 NLP·문서 이해·LLM 연구를 이끄는 그룹의 책임자
-
중국인민대학교 고링 인공지능학원 교수. NLP·추천 시스템·LLM 분야 대형 서베이 논문으로 널리 알려진 연구자.
-
양방향 트랜스포머 인코더로 NLP 전반을 끌어올린 구글의 사전학습 언어 모델
-
University of Washington Information School 조교수 겸 Allen Institute for AI(Ai2) 연구과학자. LARCH 랩 수장. 과학·의료 문서 이해와 정보 접근성을 위한 NLP 연구.
-
상하이교통대 전자정보전기공학원 교수. NLP 보안, 언어모델 백도어·적대적 위협을 연구
-
JD Joy Future Academy 연구자. 마이크로소프트 리서치 아시아 NLP 그룹, StepFun을 거쳐 합류했고 Step-Video-T2V·Step-Video-TI2V 비디오 파운데이션 모델 라인을 이끌었습니다.
-
MIT EECS 부교수. 효율적 NLP·언어모델 연구자. TextCNN 저자, 2026 Sloan Fellow.
-
Tencent WeChat AI 수석연구원. 질의응답·정보추출·기계독해·이야기 이해 분야에서 피인용 1만 8천 회를 넘긴 NLP 연구자
-
GRU와 어텐션 메커니즘을 공동 개발해 트랜스포머의 직접 계보를 연 연구자. 현재 NYU 교수 겸 Genentech 프런티어 연구 총괄
-
Chinese University of Hong Kong 교수. NLP·딥러닝 연구자. EvoPolicyGym 교신저자.
-
계산 분자 설계와 화학 반응 모델링을 연구하는 NYU 연구자. 조경현 지도로 박사를 마쳤고 AskChem 1저자
-
EleutherAI 소속 다국어 NLP·토크나이저 연구자, UC San Diego 언어학 PhD
-
NYU 조교수. 질의응답·대화형 정보 탐색 NLP 연구자. QuAC 데이터셋 공저자.
-
전 Alibaba Qwen 팀 테크 리드, OFA(ICML 2022) 및 Qwen 시리즈 주도, 멀티모달 사전학습 연구자
-
Word2Vec 창시자, Google→Facebook AI Research
-
Tencent WeChat AI Pattern Recognition Center를 이끄는 연구자. 2017년 이후 논문 320편 이상, WeChat의 음성 비서 샤오웨이를 발표한 인물
-
UC Merced 조교수, UC Merced NLP Lab 디렉터. 신뢰성 있는 LLM 제어와 멀티모달 추론을 다루며 Self-Manager의 시니어 저자