연구소/벤더LLM 정치 콘텐츠 refusal, 주제 전체가 아닌 경계선을 학습시키는 법AI가 정치 얘기라고 무조건 거부하지 않고 선거 조작 요청만 콕 집어 거부하도록 훈련하는 방법을 다룬 연구예요HuggingFace2026년 9월 9일