안전·정렬·해석가능성Anthropic
Responsible Scaling Policy v1.0 (ASL 체계)
Responsible Scaling Policy v1.0 (ASL 체계)
왜 중요한가
능력 임계값에 안전조치를 연동하는 최초의 랩 자율 프레임워크
출처 — 1차 출처만 싣고, 직접 이동해 확인할 수 있어요
공식 발표anthropic.comhttps://www.anthropic.com/rsp-updates2026년 8월 24일에 더한 조각 · 그 주 보기
같은 주에 나온 조각09.20Chain-of-Verification 발표논문