정보 · 시스템
Mac mini M4 시스템 정보 — 사양과 실측
실험실을 구성하는 두 노드의 하드웨어 사양과, 직접 측정한 성능 수치.
하드웨어 사양 (두 노드 동일)
| 항목 | 값 |
|---|---|
| 모델 | Mac mini (2024, Mac16,10) — 기본형 |
| 칩 | Apple M4 — CPU 10코어 (성능 4 + 효율 6), GPU 10코어 (Metal 4) |
| 메모리 | 16GB 통합 메모리 (참고 스펙: 대역폭 120GB/s) |
| 스토리지 | 256GB SSD |
| 포트 | Thunderbolt 4 / USB4 × 3 (40Gb/s) |
| OS | macOS 26.5.2 |
| Neural Engine | 16코어 |
기본형이라 Thunderbolt 5가 아닌 TB4라는 점이 분산 구성의 최대 제약이다 (RDMA 조사 로그 참고).
성능 실측
셸에서 바로 돌릴 수 있는 도구로 기초 성능을 측정했다. GPU(LLM 추론) 벤치마크는 MLX 설치 후 별도로 진행한다.
| 항목 | 측정 방법 | 실측값 |
|---|---|---|
| 메모리 계열 처리량 | dd 20GB 제로필 (memcpy 근사) |
~70GB/s |
| CPU 암호화 (HW AES) | openssl speed aes-256-gcm, 8KB 블록 |
~210GB/s |
| SSD 순차 쓰기 | dd 2GB, sync |
~2.4GB/s |
| 노드 간 지연 (무선 LAN) | ping | 평균 81ms (편차 큼) |
| 노드 간 처리량 (무선 LAN) | 100MB 소켓 전송 | ~18MB/s (144Mbps) |
무선 네트워크는 클러스터에 부적합
두 노드가 무선 LAN으로만 연결된 상태에서의 실측치(144Mbps, 81ms)는 MLX 분산이 요구하는 수준에 3~4자릿수 못 미친다. Thunderbolt 케이블 직결(브리지 구성, 기대치 10~20Gbps · 1ms 미만)이 필수 선행 작업이다. 케이블 연결 후 iperf3 실측값을 이 페이지에 추가할 예정이다.
16GB 통합 메모리의 의미
Apple Silicon은 CPU·GPU·Neural Engine이 하나의 메모리 풀을 공유한다. 16GB 중 macOS와 상주 프로세스가 4~5GB를 쓰므로, 모델 가중치 + KV 캐시에 실제로 쓸 수 있는 것은 약 10~12GB다.
# GPU 배정 한도를 13GB까지 상향 (재부팅 시 초기화)
sudo sysctl iogpu.wired_limit_mb=13312
OS 몫으로 최소 3GB는 남겨야 하며, 과하게 올리면 스왑으로 시스템이 멈춘다. 2노드 합산으로는 가중치 기준 약 20~24GB — 4bit 양자화 27B~35B급 모델이 현실적 상한이다.
이 하드웨어의 포지션
- 유휴 전력 5W 내외, 사실상 무소음 — 24시간 상시 가동 엣지 AI 서버로 적합.
- LLM 추론은 연산보다 메모리 용량·대역폭이 병목이라, 통합 메모리 구조의 Mac이 가격 대비 의외로 좋은 로컬 LLM 머신이 된다.
- 단, 기본형 16GB의 한계는 명확하다. 되는 것과 안 되는 것의 경계는 오픈 모델 카탈로그에 정리했다.