2025년 316개 조각
기록 316 · 정리 노트 0
2025 12월 24개
Google (Behrouz 외)
옵티마이저를 연상 기억 모듈로 재기술하고 자기 갱신 알고리즘을 학습하는 시퀀스 모델 제안
Kerem Zaman 외 (UNC 채플힐)
옥스퍼드 포지션 논문에 대한 직접 반론. 쌍으로 인용할 것
Anthropic
사양과 레퍼런스 SDK 공개, MCP에 이은 두 번째 표준화 시도
잉글랜드·웨일스 고등법원 (Smith 판사)
2025-11-04 본안 판결이 확정이 아님을 보여주는 후속 단계. 항소심에서 다시 다투어진다
웨이카이 (魏凯, 중국정보통신연구원 인공지능연구소장
중국 관변 싱크탱크가 안전 거버넌스를 기술발전과 대등한 축으로 공식 격상. 제조 침투의 병목을 데이터·공정지식·신뢰성으로 규정한 진단은 OSAT 현장 인식과 일치
인물·담론보도
2025 11월 38개
Anthropic (Justin Young)
Claude Agent SDK를 범용 agent harness로 명시, 프런티어 랩이 harness를 정식 용어로 채택한 분기점
루프·하네스 엔지니어링공식 발표
Anthropic
툴 토큰 85% 절감과 동시에 MCP 평가 정확도가 Opus 4 기준 49%에서 74%로 상승, 툴을 덜 보여줄수록 정확해지는 역설
MCP·Skills 표준화공식 발표
Anthropic (MacDiarmid·Hubing
프로덕션 RL의 reward hacking이 무관 영역의 광범위한 오정렬로 번짐, 완화책으로 inoculation prompting 제시
영국 고등법원 (Joanna Smith 판사)
Getty 패소로만 요약하면 틀린다. 핵심 쟁점은 판단된 것이 아니라 철회됐다
2025 10월 33개
Moonshot AI
공정 비교에서 full attention을 처음 능가, KV 캐시 최대 75% 절감과 1M 컨텍스트 디코딩 최대 6배
xAI
Guardian은 백인 민족주의 논점 확산을, PolitiFact는 무출처·오인용을 지적. AI 생성 지식 베이스의 검증 문제를 드러낸 사례
PyTorch (Meta)
2022년 Google Pathways가 제시한 단일 컨트롤러 모델이 PyTorch 코어 계보로 들어온 지점. TorchTitan 은 Monarch 안의 액터가 되고 torchforge 는 Monarch 위에 세워진다
AI 인프라 소프트웨어공식 발표
PyTorch (Meta)
Triton이 CUDA를 한 단계 추상화했듯 Helion은 Triton을 한 단계 더 추상화한다. 커널 작성 계보의 다음 층
AI 인프라 소프트웨어공식 발표
PyTorch 재단
멀티 GPU 커널을 프레임워크 API 수준에서 직접 쓰게 하는 방향. NCCL 계열 집합통신 위에 사용자 커널 경로가 하나 더 생겼다
AI 인프라 소프트웨어공식 발표
Semiconductor Engineering
후공정 AI가 실제로 어디까지 와 있는지에 대한 스냅샷. 예지보전·이상감지·전이학습이 거론되지만 공개된 양산 실적 수치가 없다
Salesforce AI Research·CMU
continual pretraining 대비 최대 100배 적은 토큰으로 동등 성능, 데이터 고갈에 대한 직접적 기술 답변
2025 9월 32개
NVIDIA (Felix Abecassis 외)
FP4 학습이 실제로 되는가에 대한 가장 강한 긍정 증거. 단 벤더 자체 보고이며 독립 재현은 확인되지 않음
Richard Sutton
Bitter Lesson 저자 본인이 LLM은 Bitter Lesson에 부합하지 않는다고 선언. 양 진영이 같은 텍스트를 근거로 삼던 상황을 깨뜨림
인물·담론보도
Cloudflare
MCP 툴을 TypeScript API로 변환해 LLM이 코드를 쓰게 하자는 제안, 중간 결과가 컨텍스트를 통과하지 않는 것이 이득
MCP·Skills 표준화공식 발표
Cohere
AMD와 NVIDIA가 함께 투자자로 들어간 드문 사례. 엔터프라이즈·주권 AI 포지션으로 프런티어 경쟁을 우회
OpenAI·Apollo Research
감소분이 평가 자각에 의해 견인되었을 가능성을 배제할 수 없다고 저자들이 자인
DeepSeek (深度求索)
프런티어 LLM이 정식 동료심사를 거쳐 학술지에 실린 첫 사례. 기업 기술보고서 중심의 관행에 균열
Surge·Mercor·Mechanize·Prime
병목이 정적 데이터셋에서 상호작용형 검증 환경으로 이동. 동시에 보상 해킹과 빠른 진부화라는 회의론도 제기
Arm
온디바이스 추론의 병목을 전용 NPU가 아니라 CPU 확장명령(SME2)으로 푸는 노선. 프레임워크 통합을 함께 발표해 실리콘이 아니라 소프트웨어 경로로 배포된다. 수치는 벤더 자체 주장
온디바이스·로컬 추론공식 발표
2025 8월 22개
Orion Weller, Michael Boratk
단일 벡터 검색의 한계가 데이터·모델 크기로 해결되지 않는 차원상 원리적 한계임을 보인 반박. 다중벡터·희소·하이브리드 회귀의 이론적 근거
xAI
초기 엔지니어링을 총괄한 핵심 인물의 이탈
Chengshuai Zhao 외 (애리조나주립대)
CoT를 분포 내 패턴 재현으로 설명하려는 반박 계열
2025 7월 24개
Tomek Korbak 외 (UK AISI·Apol
주요 연구소가 공동 서명한 CoT 모니터링 합의 문서
Liquid AI
온디바이스를 사후 양자화의 결과가 아니라 설계 목표로 두고 하드웨어-인-더-루프로 아키텍처를 탐색한 상용 계열. 수치는 벤더 자체 측정이며 독립 검증이 아니다
온디바이스·로컬 추론공식 발표
Dellibarda Varela 외
Apple 논문의 평가 설계를 부분 반박하되 일부 실패는 실제 추론 한계라고 인정
2025 6월 35개
Xiang, Wu 외 (홍콩이공대 등)
그래프가 언제 도움이 되는가를 벤치마크로 검증하는 국면 전환점 — 2026년 회의론의 방법론적 선행
Geoffrey Huntley
컨텍스트를 매 반복 폐기하고 상태를 git과 파일에 두는 루프 엔지니어링의 원형
2025 5월 19개
Microsoft·GitHub
OS 수준까지 내려간 채택과 거버넌스 다자화 시작
Rishi Jha, Collin Zhang 외 (C
임베딩 마이그레이션 비용에 대한 급진적 접근이자 벡터DB 유출 시 보안 함의를 제기
xAI
시스템 프롬프트 한 줄로 프런티어 모델의 정치적 출력이 조작 가능함을 보여준 사건
파도바대 (Barusco, Dalle Pezze,
결함 라벨 0장으로 이미지 단위 99% AUROC. 결함 클래스가 자주 바뀌는 OSAT에서 결함 수집 단계 자체를 건너뛰는 설계가 SEM 도메인에서 성립함을 보인 공개 비교실험
Emily M. Bender, Alex Hanna
2021년 stochastic parrots의 대중서 확장. 실존 위험 담론 자체를 현재의 해악에서 시선을 돌리는 장치로 비판하며 안전 진영과 비판 진영의 분기를 명확히 함
인물·담론공식 발표
Anthropic
CoT가 실제 사용한 힌트를 대체로 20% 미만만 언급함을 측정
2025 4월 22개
Mem0 (Chhikara, Khant 외)
에이전트 장기 기억 상용 제품이 그래프 표현을 핵심 확장으로 채택 — 그래프 엔지니어링이 RAG 를 넘어 메모리 계층으로 확산
XITASO·뮌헨대(LMU)·MCML
SAM은 OSAT 표준 비파괴 검사 장비(박리·보이드). ImageNet보다 자기 도메인 이미지로 사전학습하는 쪽이 낫다는 것을 후공정 모달리티에서 직접 보인 근거. 단 라벨 절감 실증은 아님
2025 3월 27개
xAI
소셜 플랫폼과 프런티어 랩의 합병. 직전 라운드 xAI 밸류가 500억 달러였던 점에서 자기거래 성격 논란
OpenAI
공식 설명은 tokens에서 transformer, diffusion, pixels 순 — 순수 AR 회귀가 아니라 AR 토큰 생성과 확산 디코더의 하이브리드
멀티모달공식 발표
Jinhyuk Lee 외 (Google DeepMi
임베딩 모델이 전용 소형 인코더에서 프런티어 LLM 파생물로 이동하는 흐름을 대표
OpenAI
CoT를 직접 최적화하면 reward hacking이 은폐형으로 진화, CoT에 최적화 압력을 걸지 말라는 규범의 근거
2025 2월 20개
xAI
Think 버튼 기반 추론 모드 분리. 발표문의 20만 GPU 클러스터는 차기 모델 학습용 언급이며 Grok 3 학습에 전부 쓰였다는 서술은 없음
추론 모델·AGI 논쟁공식 발표
미 델라웨어 지법 (Bibas 판사)
단 법원이 오늘 내 앞에 있는 것은 비생성형 AI뿐이라고 명시했다. 생성형 AI 판례로 인용하면 틀린다
2025 1월 20개
DeepSeek
추론 능력이 폐쇄형 랩의 비밀 레시피가 아님을 증명, 자기검증·재검토·전략 전환이 창발. RLVR과 소형 모델로의 능력 이전 레시피도 같은 보고서에서 공개됐다
Zep (Rasmussen, Chalef 외)
시간적 지식그래프를 에이전트 메모리의 1급 설계 요소로 내세운 대표 사례