모델 아키텍처·학습 기법Shen Nie 외 (인민대·Ant Group)
LLaDA 발표
LLaDA 발표 — 8B 확산 언어모델이 인컨텍스트 학습에서 LLaMA3 8B에 필적하고 역방향 완성에서 GPT-4o 상회
왜 중요한가
자기회귀가 LLM 능력의 필요조건인지 자체를 재질문
출처 — 1차 출처만 싣고, 직접 이동해 확인할 수 있어요
논문arxiv.orghttps://arxiv.org/abs/2502.099922026년 8월 24일에 더한 조각 · 그 주 보기
같은 주에 나온 조각02.16NSA — Native Sparse Attention논문02.15딥시크(DeepSeek) 국내 신규 다운로드 잠정 중단보도02.11AI Action Summit 연설에서 프랑스 AI에 대한 1,090억 유로 민간 투자와 2,000억 유로…공식 발표02.11Thomson Reuters v보도