대규모 언어 모델의 다단계 추론 연구
Multi-Step Reasoning with Large Language Models, a Survey
수십억 개의 매개변수를 가진 대규모 언어 모델(LLM)은 특정 훈련 없이도 소수의 예시만으로 학습하는 인컨텍스트 학습 능력을 보인다. 기존 모델들이 언어 과제에서 뛰어난 성능을 보였지만, 기본적인 추론 벤치마크에서는 한계를 드러냈다. 그러나 새로운 인컨텍스트 학습 접근법인 Chain-of-Thought는 이러한 벤치마크에서 강력한 다단계 추론 능력을 입증했다. 본 연구는 LLM의 다단계 추론 분야를 종합적으로 검토한다. 다단계 추론의 생성, 평가, 제어 방식을 체계화하는 분류법을 제시하고, 핵심 접근법과 미해결 과제를 심층적으로 …