Caramel LabCaramel Lab
#

장기 CoT

1편의 한국어 분석 — 최신순으로 정렬했어요

컴퓨터 과학발표 2026.05· 23최근 1년 23회

장기 CoT 추론 LLM 연구 동향

최근 OpenAI-o1, DeepSeek-R1과 같은 대규모 언어 모델(RLLM)의 추론 능력 발전은 수학 및 코딩과 같은 복잡한 영역에서 인상적인 성과를 보였습니다. 이러한 성공의 핵심 요인은 추론 능력을 향상하고 복잡한 문제 해결을 가능하게 하는 장기 CoT(Long Chain-of-Thought) 특성 적용에 있습니다. 그러나 장기 CoT에 대한 포괄적인 조사는 여전히 부족하여, 기존 단기 CoT(Short CoT)와의 차이점 이해를 제한하고 '과잉 사고' 및 '추론 시간 확장'과 같은 문제에 대한 논의를 복잡하게 만듭니다. 본 연구는 장기 CoT에 대한 통합적 관점을 제시하여 이러한 간극을 메우고자 합니다. 먼저 장기 CoT를 단기 CoT와 구별하고, 현재 추론 패러다임을 분류하기 위한 새로운 분류 체계를 도입합니다. 다음으로, 장기 CoT의 핵심 특성인 심층 추론, 광범위한 탐색, 실현 가능한 반성을 탐구하여, 모델이 얕은 단기 CoT에 비해 더 복잡한 작업을 처리하고 더 효율적이고 일관된 결과를 생성할 수 있음을 보여줍니다. 이러한 특성을 가진 장기 CoT의 출현과 관련된 과잉 사고 및 추론 시간 확장과 같은 주요 현상을 조사하고, 이러한 과정이 실제에서 어떻게 나타나는지에 대한 통찰력을 제공합니다. 마지막으로, 다중 모드 추론 통합, 효율성 개선, 지식 프레임워크 강화 등 중요한 연구 격차를 식별하고 유망한 미래 방향을 제시합니다. 이 조사는 구조화된 개요를 제공함으로써 미래 연구에 영감을 주고 RLLM 개발을 더욱 발전시키는 것을 목표로 합니다.

연구 트렌드로 돌아가기