The Brief FactStack이 되었습니다

FactStack
학습·튜닝

학습·튜닝 AI 용어

사전학습·파인튜닝·정렬 등 모델 학습 용어

학습·튜닝

강화학습(Reinforcement Learning)

정답을 알려주는 대신 '잘하면 보상'을 주는 방식으로 AI를 훈련하는 방법이에요. 시행착오를 반복하며 스스로 더 나은 행동을 찾아가요

학습·튜닝

얼라인먼트(정렬)(Alignment)

모델을 인간의 의도·가치에 맞게 정렬하는 작업이에요. AI가 똑똑한 걸 넘어 '안전하고 의도대로' 행동하게 만드는 거예요

학습·튜닝

파인튜닝(Fine-tuning)

사전학습된 모델을 특정 도메인·작업에 맞게 추가 학습으로 조정하는 거예요. '범용 모델을 우리 일에 맞춰 특화'하는 단계예요

학습·튜닝

사전학습(Pre-training)

대규모 데이터로 모델의 기본 능력을 만드는 1차 학습이에요. 모델의 '기초 교육' 단계라고 보면 돼요

학습·튜닝

인간 피드백 기반 강화학습(RLHF)

사람의 피드백으로 모델을 사람 취향·의도에 맞게 정렬·개선하는 방식이에요. 챗봇이 '말이 통하게' 만든 핵심 기술이에요

학습·튜닝

전이학습(Transfer Learning)

이미 학습된 모델을 출발점 삼아 관련된 새 작업에 적용하는 방법이에요. 처음부터 다시 배우지 않아 데이터와 비용을 크게 아껴요