분류: 로컬AI
2025년 3월, Apple은 Mac Studio에 M3 Ultra 칩을 탑재해 출시했습니다. 그리고 2026년, M5 Ultra가 등장하며 로컬 AI 커뮤니티의 관심이 다시 한 번 모이고 있어요. 두 칩은 모두 "데스크탑에서 프론티어급 LLM을 로컬로 실행한다"는 목표를 공유하지만, 아키텍처와 성능은 크게 다릅니다.
스펙과 벤치마크를 기반으로 어떤 기기가 당신의 사용 사례에 맞는지 기술적으로 분석합니다.
스펙 비교 — 핵심은 메모리 대제폭
| 항목 | Mac Studio M3 Ultra | Mac Studio M5 Ultra |
|---|---|---|
| CPU | 32코어 (24 Performance + 8 Efficiency) | 약 36코어 (12 Super + 24 Performance) |
| GPU | 80코어 | 80코어 + Neural Accelerators |
| 유니파이드 메모리 | 최대 512GB | 최대 768GB (테스트) |
| 메모리 대제폭 | 819 GB/s | 약 1.2 TB/s (예상) |
| Neural Engine | 32코어 | GPU 코어당 Neural Accelerator |
| 공정 | 3nm (N3E) | 3nm 3세대 |
| Thunderbolt | Thunderbolt 5 | Thunderbolt 5 |
| Geekbench 6 멀티 | 약 28,169 | 약 42,864 (예상) |
CPU 성능 — 세대차의 실체
M3 Ultra는 이미 32코어 CPU와 80코어 GPU로 데스크톱 최상위권을 달렸습니다. Geekbench 6 멀티스코어 약 28,169점은 M2 Ultra(21,241) 대비 약 33% 향상된 수치예요.
M5 Ultra는 아키텍처를 재설계했어요. 기존 "Performance 코어"가 "Super 코어"로 개명되고, 그 아래 새로운 "Performance 코어" 계층이 추가된 3단계 구조입니다. 이로 인해 CPU 코어 수가 약 36코어로 증가했고, 멀티코어 성능은 약 42,864로 M3 Ultra 대비 약 52% 향상될 것으로 예상됩니다.
GPU와 AI 연산 — Neural Accelerator의 등장
두 칩 모두 80코어 GPU를 제공하지만, M5 Ultra의 가장 큰 변화는 GPU 코어당 독립된 Neural Accelerator가 추가되었다는 점이에요. M5 이전 세대는 별도의 Neural Accelerator가 없어 FP16 연산이 GPU ALU에만 의존했지만, M5는 독립된 가속기로 인해 FP16 총산량이 크게 향상됩니다.
로컬 AI/LLM 추론에 가장 중요한 것은 메모리 대제폭입니다. 동일 메모리 용량이라도 대제폭이 높을수록 초당 생성 토큰(tok/s)이 증가하기 때문이에요. M3 Ultra의 819 GB/s도 충분하지만, M5 Ultra가 약 1.2 TB/s에 접근한다면 동일 405B 모델 추론 속도가 30% 이상 향상될 가능성이 있습니다.
메모리 용량 — M5 Ultra의 한계
M3 Ultra는 최대 512GB까지 확장 가능한 것이 가장 큰 강점이에요. 512GB면 405B 모델(Q4 양자화)을 여유 있게 로드할 수 있어요. 반면 M5 Ultra는 현재 768GB까지 지원될 예정이지만, 실제 가격과 Supply 상황이 확인되지 않은 상태예요.
결론 — 누구에게 어떤 기기가 맞을까
| 사용 목적 | 추천 기기 |
|---|---|
| 초대형 모델(405B+) 로컬 추론 | M3 Ultra (512GB) |
| 최대 CPU/GPU 성능, 차세대 AI | M5 Ultra (예상) |
| 가성비, 현재 즉시 구매 | M3 Ultra |
M5 Ultra가 출시된다면 CPU/GPU 성능과 Neural Accelerator로 인한 AI 연산 향상은 확실히 매력적이에요. 다만 메모리 대제폭과 최종 가격이 확정되기 전까지는, 지금 즉시 512GB 대용량이 필요하다면 M3 Ultra가 여전히 현명한 선택입니다.
로컬 AI를 본격적으로 다루는 사용자라면, 두 기기의 출시 일정과 가격을 주시하면서 자신의 모델 크기와 메모리 요구사항에 맞춰 결정하는 것이 좋겠어요.

