728x90
Qwen2.5-Coder-1.5B-Instruct-GGUF 모델의 파일 크기는 선택하는 양자화(Quantization) 방식에 따라 다르며, 대략 1.0GB ~ 3.1GB 사이입니다
양자화 방식별 파일 크기
- Q4_K_M (4비트, Quantization 4-bit, K-Quant Method, Medium ): 약 986MB ~ 1.0GB (가장 가벼움)
- Q5_K_M (5비트): 약 1.13GB
- Q8_0 (8비트, Quantization 8-bit, Version 0): 약 1.65GB (균형형)
- F16 (비압축 원본, Floating-Point 16-bit): 약 3.09GB
()
728x90
'프로그램 활용 > 인공지능(AI)' 카테고리의 다른 글
| base, coder, instruct 차이, instruct 훈련 과정 (0) | 2026.08.14 |
|---|---|
| LLM | 초경량 모델 | 파라미터 크기는 작으면서도(1B ~ 8B) 컨텍스트 윈도우는 64K 이상을 네이티브로 지원하는 모델 (0) | 2026.08.14 |
| AI 최신 엔진 활용법 (0) | 2026.08.13 |
| LLM | Qwen 종류별 특성 - 개발은 Qwen 14B 이상 추천 (0) | 2026.08.11 |
| 에이전트 프레임워크 비교, LangGraph vs CrewAI vs AutoGen vs Pydantic AI (0) | 2026.08.07 |