--- title: "로컬 AI 미니PC 완전 가이드: 예산별 모델별 추론 속도 벤치마크" date: 2026-09-23 time: "19:00" model: "admin" category: knowhow summary: "로컬 AI 추론은 메모리 대역폭=속도 공식이 지배한다. 50만원대 AMD 미니PC부터 400만원대 Mac Studio까지, 예산에 맞춰 어떤 모델을 몇 TPS로 돌릴 수 있는지 실증 수치로 정리했다." tags: mini-pc,local-llm,inference,tps,mac-mini,amd,beelink,ollama,gemma4,qwen3,能耗 --- # 로컬 AI 미니PC 완전 가이드 로컬 AI 추론의 핵심 공식은 단 한 줄이다: **TPS = 메모리 대역폭(GB/s) / (활성 파라미터 x 바이트/가중치)**. 이 공식만 이해하면 어떤 하드웨어를 사야 하는지 정확히 알 수 있다. --- ## 1. 왜 미니PC인가 데스크톱 RTX 4090(전력 450W) 없이도 로컬 AI를 구동할 수 있는 시대가 열렸다. 2026년 현재 DDR5 메모리와 Apple Silicon의 대역폭이 80~546 GB/s에 도달하면서, 소형 폼팩터에서도 실용적인 추론 속도를 낼 수 있다. ### 메모리 대역폭 비교표 | 메모리 유형 | 대역폭 | 적용 하드웨어 | |---|---|---| | DDR5-5600 듀얼채널 | ~80 GB/s | AMD Ryzen 미니PC | | LPDDR5X (Apple M4) | ~100 GB/s | Mac Mini M4 | | LPDDR5X (Apple M4 Pro) | ~273 GB/s | Mac Mini M4 Pro | | LPDDR5X (Apple M4 Max) | ~546 GB/s | Mac Studio | **MoE의 마법**: Gemma 4 28B는 총 28B 파라미터 중 토큰당 4~5B만 활성화된다. 80 GB/s 대역폭에서도 ~20 TPS를 달성한다. --- ## 2. 예산별 미니PC 비교표 ### Budget (~50만원 / ~$350) | 항목 | Beelink SER8 32GB | Minisforum UM790 Pro (베어본) | |---|---|---| | 가격 | ~80~100만원 (쿠팡/다나와) | ~60~80만원 (RAM/SSD 별도) | | CPU | Ryzen 7 8845HS (8C/16T) | Ryzen 9 7940HS (8C/16T) | | iGPU | Radeon 780M (12CU) | Radeon 780M (12CU) | | RAM | DDR5-5600 32GB | DDR5 32~64GB (선택) | | 전력 | 유휴 8~12W, 부하 ~54W | 유휴 8~15W | | RAM 업그레이드 | 가능 (SO-DIMM 2개, 최대 96GB) | 가능 | ### Mid (~90~110만원 / ~$600~800) | 항목 | Beelink SER8 64GB | Mac Mini M4 24GB | |---|---|---| | 가격 | ~110~130만원 | ~90~100만원 | | CPU | Ryzen 7 8845HS | Apple M4 (10C CPU/10C GPU) | | RAM | DDR5 64GB | 통합 메모리 24GB | | 대역폭 | ~80 GB/s | ~100 GB/s | | 전력 | 부하 45~55W | 부하 19~25W | | 장점 | 64GB 대용량, x86 호환 | MLX 최적화, 조용함, 저전력 | ### High (~150~200만원 / ~$1,200~1,600) | 항목 | Mac Mini M4 Pro 24GB | Mac Mini M4 Pro 48GB | |---|---|---| | 가격 | ~150~180만원 | ~200만원+ | | CPU | Apple M4 Pro (12C CPU/16C GPU) | Apple M4 Pro (14C CPU/20C GPU) | | RAM | 통합 24GB | 통합 48GB | | 대역폭 | ~273 GB/s | ~273 GB/s | | 장점 | 8B 70~90 TPS | 32B 모델 여유, 70B 가능 | ### Ultra (~400만원+ / ~$2,800+) | 항목 | Mac Studio M4 Max 36GB | GMKtec EVO-X2 128GB | |---|---|---| | 가격 | ~280만원+ | ~$3,649 (~420만원) | | CPU | Apple M4 Max (16C CPU/40C GPU) | Ryzen AI Max+ 395 | | RAM | 통합 36GB | LPDDR5X 128GB | | 대역폭 | ~546 GB/s | ~256 GB/s | | 장점 | 70B 20~28 TPS | 120B MoE ~31 TPS | --- ## 3. 모델별 실제 추론 속도 (TPS) ### 4~5B 소형 모델 (가중치 ~2~3GB) | 하드웨어 | Qwen3-4B (Q4) | Gemma 4 E4B (Q4) | K2-Horizon 3.7B (Q4) | |---|---|---|---| | Mac Mini M4 Pro | 100~130 | 100~130 | 100~130 | | Mac Mini M4 | 70~80 | 70~80 | 70~80 | | Beelink SER8 64GB | 50~60 | 50~60 | 50~60 | | Beelink SER8 32GB | 25~35 | 25~35 | 25~35 | ### 8B 모델 (가중치 ~4.9GB) | 하드웨어 | Llama 3.1 8B (Q4) | Qwen3 8B (Q4) | Gemma 4 8B (Q4) | |---|---|---|---| | Mac Mini M4 Pro | 70~90 | 65~85 | 65~85 | | Mac Mini M4 | 42~52 | 40~50 | 40~50 | | Beelink SER8 64GB | 30~40 | 30~40 | 30~40 | | Beelink SER8 32GB | 25~35 | 25~35 | 25~35 | ### 14B 모델 (가중치 ~7~8GB) | 하드웨어 | Qwen 2.5 14B (Q4) | |---|---| | Mac Mini M4 Pro (24GB) | 30~40 | | Beelink SER8 64GB | 18~25 | | Mac Mini M4 (24GB) | 10~15 (스왑 발생) | ### MoE 모델 (Gemma 4 28B, ~14GB) | 하드웨어 | Gemma 4 28B (Q4) | Qwen3.5-32B-A3B (Q4) | |---|---|---| | Mac Mini M4 Pro | 35~45 | 40~50 | | Beelink SER8 64GB | 18~22 | 20~22 | | Strix Halo 128GB | 20~25 | 22~28 | MoE는 28B Dense 대비 **5배 빠르다** (~20 TPS vs ~4 TPS). 64GB 미니PC에서도 쾌적하다. ### 32B+ 대형 모델 | 하드웨어 | Qwen3 32B (Q4) | Llama 3.3 70B (Q4) | |---|---|---| | Mac Mini M4 Pro 48GB | 12~18 | ~5 | | Strix Halo 128GB | ~11 | ~5 | | Beelink SER8 64GB | 8~12 | 메모리 부족 | | Mac Mini M4 24GB | 불가 (스왑) | 불가 | --- ## 4. Mac Mini vs AMD 미니PC | 항목 | Mac Mini M4 | AMD Ryzen 미니PC | |---|---|---| | 8B TPS | 42~52 (M4) / 70~90 (M4 Pro) | 25~40 | | RAM 업그레이드 | 불가 (구매 시 결정) | 가능 (SO-DIMM) | | 전력 | 7~25W (압도적 효율) | 45~55W | | CUDA | 없음 (MLX 사용) | 없음 (Vulkan 사용) | | 호환성 | macOS 전용 | x86 범용 | | 24시간 가동 | 월 ~3,000원 | 월 ~5,000원 | ### 전력 및 소음 비교 | 하드웨어 | 유휴 | 추론 부하 | 월 전기료 | 소음 | |---|---|---|---|---| | Mac Mini M4 | ~7W | 19~25W | ~3,000원 | 거의 무소음 | | Beelink SER8 | ~10W | 45~55W | ~5,000원 | 조용 | | Strix Halo | ~15W | 60~80W | ~7,000원 | 보통 | | 데스크톱 RTX 3090 | ~30W | 300~350W | ~30,000원 | 소음 있음 | --- ## 5. 추천 구성 요약 | 예산 | 추천 구성 | 가능 모델 및 속도 | |---|---|---| | ~50만원 | Beelink SER8 32GB + 1TB SSD | 8B 25~35 TPS, 4B 50~60 TPS | | ~90만원 | Mac Mini M4 24GB | 8B 42~52 TPS, 4B 70~80 TPS | | ~120만원 | Beelink SER8 64GB | 8B 30~40 TPS, MoE 28B 18~22 TPS | | ~180만원 | Mac Mini M4 Pro 24GB | 8B 70~90 TPS, 14B 30~40 TPS | | ~200만원 | Mac Mini M4 Pro 48GB | 32B 12~18 TPS, 70B ~5 TPS | | ~420만원 | GMKtec EVO-X2 128GB | 120B MoE ~31 TPS | --- ## 6. 실전 배치 전략 ### 소규모 사무실/개인 서버 목표: 24시간 챗봇/검색 에이전트 가동. Mac Mini M4 24GB (~90만원)에 Gemma 4 E4B (Q4_K_M, 4.98GB)를 올리면 70~80 TPS로 즉시 응답이 가능하다. 월 전기료 ~3,000원. ### 코딩 에이전트 자동화 목표: IDE 연동 실시간 코드 완성. Mac Mini M4 Pro 48GB (~200만원)에 Qwen3-4B (100~130 TPS)를 메인으로, 14B 모델 (30~40 TPS)을 백업으로 배치. ### 대규모 배치 처리 목표: 하루 수천 건 문서 분류/요약. Beelink SER8 64GB (~120만원)에 Gemma 4 28B MoE (18~22 TPS)를 올리면 RAM 여유로 안정적 구동. --- ## 핵심 결론 1. **MoE 모델이 미니PC의 게임 체인저** - Gemma 4 28B는 64GB 미니PC에서 ~20 TPS 2. **Mac Mini M4가 최적 가성비** - $599에 8B 모델 42~52 TPS, 월 전기료 3,000원 3. **RAM 용량이 대역폭보다 먼저** - 최소 32GB, 가능하면 64GB 4. **24시간 가동은 미니PC** - 전력/열/소음 모두 데스크톱 대비 압도적 5. **대역폭 공식을 기억하라** - DDR5 80GB/s, M4 100GB/s, M4 Pro 273GB/s