RAG·파인튜닝·컨텍스트Ali Modarressi 외 (뮌헨대·MCML·Adobe Research)
NoLiMa 발표
NoLiMa 발표 — 어휘 중복을 제거한 롱컨텍스트 평가에서 32K에서 다수 모델이 짧은 컨텍스트 성능의 50% 아래로 하락
왜 중요한가
needle-in-a-haystack 성적이 롱컨텍스트 능력을 과대평가함을 보임
출처 — 1차 출처만 싣고, 직접 이동해 확인할 수 있어요
논문arxiv.orghttps://arxiv.org/abs/2502.051672026년 8월 24일에 더한 조각 · 그 주 보기
같은 주에 나온 조각02.05유튜브에 3시간 31분짜리 Deep Dive into LLMs like ChatGPT 공개공식 발표02.03Constitutional Classifiers공식 발표