온디바이스·로컬 추론Apple
M5 GPU Neural Accelerator + MLX 벤치마크 공개
M5 GPU Neural Accelerator + MLX 벤치마크 공개 — LLM 추론 첫 토큰 시간(TTFT) M4 대비 최대 4배 가속, 메모리 대역폭 153GB/s
왜 중요한가
소비자용 실리콘 세대 교체를 로컬 LLM 추론 성능으로 직접 내세우기 시작한 자료
출처 — 1차 출처만 싣고, 직접 이동해 확인할 수 있어요
공식 발표machinelearning.apple.comhttps://machinelearning.apple.com/research/exploring-llms-mlx-m52026년 8월 24일에 더한 조각 · 그 주 보기
같은 주에 나온 조각11.23Natural Emergent Misalignment from Reward Hacking논문11.21MCP Apps 확장(SEP-1865) 제안공식 발표11.20Nano Banana Pro (Gemini 3 Pro Image)공식 발표11.20Olmo 3공식 발표