한국어EN
온디바이스·로컬 추론llama.cpp (ggml-org)커뮤니티 관찰

PR #19769 병합

PR #19769 병합 — GGML_TYPE_NVFP4 도입. FP4 E2M1 가중치 + UE4M3 블록 스케일, NVIDIA ModelOpt 산출물 직접 적재

왜 중요한가

GGUF가 자체 K-quant를 넘어 하드웨어 네이티브 FP4 포맷을 흡수

출처 — 1차 출처만 싣고, 직접 이동해 확인할 수 있어요 공식 발표github.comhttps://github.com/ggml-org/llama.cpp/pull/197692026년 8월 24일에 더한 조각 · 그 주 보기