한국어EN
안전·정렬·해석가능성OpenAI (Guan·Wallace·Barak 외)

Deliberative Alignment

Deliberative Alignment

왜 중요한가

안전 규범을 CoT로 명시 추론하게 학습, 추론모델 정렬의 기본 레시피

출처 — 1차 출처만 싣고, 직접 이동해 확인할 수 있어요 논문arxiv.orghttps://arxiv.org/abs/2412.163392026년 8월 24일에 더한 조각 · 그 주 보기