GGUF
모델을 개인 PC에서 돌리기 좋게 담는 파일 형식. 로컬 AI 커뮤니티의 표준 포장재.
쉽게 말하면
모델의 가중치(두뇌 파일)를 하나의 파일로 담는 형식 중 하나로, 개인 PC에서 AI를 돌리는 「로컬 모델」 생태계의 표준 포장재입니다. 로컬 실행 도구의 원조 격인 llama.cpp 프로젝트에서 나왔습니다.
핵심은 양자화와의 짝입니다 — 숫자 정밀도를 낮춰 모델 몸집을 줄이는 압축을 거쳐, 같은 모델도 Q4·Q8 같은 여러 GGUF 버전으로 배포됩니다. 숫자가 작을수록 가볍지만 조금 덜 똑똑해지는 트레이드오프가 있어, 「내 그래픽카드 메모리에 맞는 버전 고르기」가 로컬 사용자의 첫 관문입니다.
새 모델이 공개되면 커뮤니티가 며칠 안에 GGUF 버전을 만들어 올리는 것이 관례입니다. 「GGUF 언제 나오나」가 모델 공개 소식마다 달리는 첫 댓글일 정도로, 이 단어가 보이면 「집 컴퓨터에서 돌려 보려는 사람들」의 이야기라고 읽으면 됩니다.
기사에서 이렇게 나와요
「신모델 공개 직후 커뮤니티 GGUF 변환 러시」 — 오픈 웨이트 모델 기사 아래에는 늘 로컬 실행 이야기가 따라붙고, 그 중심에 이 파일 형식이 있습니다.
함께 볼 용어
이 용어가 나온 기사
- 큐원3.8-27B, 아파치 2.0 오픈웨이트 공개模型 · 2026.08.15
- Unsloth, 로컬에서 학습까지 되는 데스크톱 앱 공개产品 · 2026.08.12
- 텐센트, 텍스트로 3D 오픈월드 만드는 'Hy3D WorldClaw' 공개模型 · 2026.08.11
- DeepSeek-V4-Flash-0731, 긴 컨텍스트서 작업 멈춤 현상 보고模型 · 2026.08.10
- 미스트랄, 오픈웨이트 안전 분류기 쉴드스트랄 1.0 3B 공개研究 · 2026.08.09
- 딥시크 v4 플래시, DwarfStar용 GGUF 공개…로컬 구동 문턱 낮춘다模型 · 2026.08.01