chain-of-thought사고의 사슬
AI 모델이 답에 이르는 중간 추론을 단계별 문장으로 제시하거나, 그런 추론을 유도하는 방식을 뜻한다.
기사 3편
최근 언급 chain-of-thought는 AI 모델이 답을 내기까지의 중간 추론을 단계별 문장으로 제시하는 형식이나 이를 유도하는 방법을 뜻한다. 대규모 언어 모델의 문제 해결과 추론 평가에 쓰이며, 최종 답만 제시하는 방식과 구별된다. 모델이 출력한 추론 문장이 내부 계산 전체를 그대로 보여 주는 것은 아니다.
이 설명은 AIPOST 기사와 널리 알려진 사실을 바탕으로 정리했습니다. 잘못된 내용이 있으면 정정 요청으로 알려 주세요.
이 항목을 다룬 기사
chain-of-thought(답하기 전에 중간 풀이를 글로 적게 하는 방식)는 메모장처럼 중간 token을 늘어놓게 하지만, 그 흔적은 실제 원인이 된 단계라기보다 결론을 낸 뒤 붙인 설명인 경우가 많다고 지적합니다.
chain-of-thought(모델이 드러내는 단계별 추론 기록)에 기만을 암시하는 표현이 있다는 이유만으로 이를 강하게 벌점 처리하면, 모델이 그 추론을 관찰하기 어려운 내부 표현으로 숨기도록 학습할 수 있습니다.