The Brief FactStack이 되었습니다

FactStack
학습/튜닝

학습/튜닝 AI 용어

사전학습, 파인튜닝, 정렬 등 모델 학습 용어

학습/튜닝

강화학습(Reinforcement Learning)

정답을 알려주는 대신 '잘하면 보상'을 주는 방식으로 AI를 훈련하는 방법이에요. 시행착오를 반복하며 스스로 더 나은 행동을 찾아가요

학습/튜닝

얼라인먼트(정렬)(Alignment)

모델을 인간의 의도, 가치에 맞게 정렬하는 작업이에요. AI가 똑똑한 걸 넘어 '안전하고 의도대로' 행동하게 만드는 거예요

학습/튜닝

파인튜닝(Fine-tuning)

사전학습된 모델을 특정 도메인, 작업에 맞게 추가 학습으로 조정하는 거예요. '범용 모델을 우리 일에 맞춰 특화'하는 단계예요

학습/튜닝

사전학습(Pre-training)

대규모 데이터로 모델의 기본 능력을 만드는 1차 학습이에요. 모델의 '기초 교육' 단계라고 보면 돼요

학습/튜닝

인간 피드백 기반 강화학습(RLHF)

사람의 피드백으로 모델을 사람 취향, 의도에 맞게 정렬, 개선하는 방식이에요. 챗봇이 '말이 통하게' 만든 핵심 기술이에요

학습/튜닝

전이학습(Transfer Learning)

이미 학습된 모델을 출발점 삼아 관련된 새 작업에 적용하는 방법이에요. 처음부터 다시 배우지 않아 데이터와 비용을 크게 아껴요