로컬 LLM 근황: 딥시크, 큐원 투 탑
로컬 LLM 커뮤니티의 최근 추세는 딱 2개. DeepSeek V4 Flash 0731과 Qwen 3.8 27B입니다.
DeepSeek V4 Flash 0731은 VRAM이 넉넉할 때의 선택. GGUF 4비트 기준 약 160GB 이상이면 무리 없이 돌리고, 속도가 압도적이며 컨텍스트 1M 지원이 강점입니다.
Qwen 3.8 27B는 VRAM이 부족할 때, 특히 코딩 중심 작업에 적합. 길고 논리적인 추론 과정으로 체급 차이를 이겨내는 스타일이라 복잡한 작업에선 시간을 갈아넣는 느낌이 듭니다.
| DeepSeek V4 Flash | Qwen 3.8 27B | |
|---|---|---|
| VRAM 기준 | ~160GB 이상 | 여유 없을 때 |
| 장점 | 속도, 1M 컨텍스트, agentic | 코딩, 논리적 추론 |
| 단점 | VRAM 요구량 큼 | 느림 |
보너스로, 한글/다국어 번역 용도에는 Gemma 4 31B도 후보입니다. 정리하면 — VRAM 여유 + 다국어/코딩/agentic 모두 커버하려면 딥시크, VRAM 적고 코딩 위주면 큐원, 번역 위주면 젬마. 하드웨어 사양에 맞춰 고르면 됩니다.