dynamic sampling동적 샘플링
dynamic sampling은 모델 학습 도중 표본의 난이도에 따라 학습에 쓸 데이터를 다시 고르는 방식이다.
기사 1편
최근 언급 dynamic sampling은 모델 학습 도중 표본의 난이도나 모델의 성능을 반영해 학습에 쓸 데이터를 다시 고르는 방식이다. 학습 전에 표본을 고정하는 방식과 달리 선택 대상이 학습 과정에서 바뀐다. LLM의 강화학습에서는 2025년 ByteDance 등이 공개한 DAPO 알고리즘의 구성 요소로 알려졌으며, 모델이 모두 맞히거나 모두 틀리는 prompt를 걸러내 학습 신호가 없는 표본을 줄인다.
이 설명은 AIPOST 기사와 널리 알려진 사실을 바탕으로 정리했습니다. 잘못된 내용이 있으면 정정 요청으로 알려 주세요.