클로드 코드 에이전트 동시 실행, 맥 한 대에서 16개 돌렸습니다 — 맥은 멀쩡하고 토큰이 16배 나갑니다
에이전트 15~20개를 동시에 돌렸다는 이야기에 솔깃하셨던 적 있으실 겁니다.
5~6시간 걸릴 일을 15분에 끝냈다는 이야기요.
그리고 바로 걱정이 따라오죠.
내 맥북에서 그렇게 돌리면 팬이 돌고 멈추는 거 아닐까.
저도 그게 궁금했습니다.
그래서 오늘 제 맥북에서 직접 돌리며 쟀어요. 클로드 코드 에이전트 동시 실행을 1개부터 16개까지 늘려 봤어요.
시간·토큰·메모리를 기록했습니다.
결과는 예상과 달랐습니다.
맥은 거의 아무 일도 없었어요.
걱정할 곳은 맥이 아니라 다른 데 있었습니다.

클로드 코드 서브에이전트를 16개 동시에 돌려도 기다린 시간은 21초였습니다.
차례로 했다면 289초예요
1. 결론부터 — 맥이 아니라 토큰이 한계입니다
2026년 10월 2일, 맥북 M4 Pro(메모리 24GB)에서 잰 값입니다.
클로드 코드는 2.1.287 버전이에요.
| 동시에 돌린 수 | 기다린 시간 | 차례로 했다면 | 토큰 합계 |
|---|---|---|---|
| 1개 | 17초 | 17초 | 5.3만 |
| 4개 | 25초 | 66초 | 20.4만 |
| 8개 | 18초 | 121초 | 40.6만 |
| 16개 | 21초 | 289초 | 84.9만 |
«차례로 했다면»은 서브에이전트 각자가 걸린 시간을 모두 더한 값입니다.
개수를 16배로 늘려도 기다린 시간은 그대로였고, 토큰만 16배가 됐습니다. 그동안 클로드 코드 메모리는 566MB에서 622MB가 됐습니다.
56MB 늘었어요.
발열 경고는 한 번도 뜨지 않았어요.
내 맥에서 몇 개까지 돌아가나를 걱정하실 필요는 없습니다.
16개까지는 맥이 버티고 말고 할 일이 없었어요.
봐야 할 숫자는 요금제 한도에서 빠져나가는 토큰입니다.
2. 먼저 낱말 둘 — 서브에이전트와 토큰
서브에이전트는 클로드 코드가 일을 나눠 맡기는 «새끼 클로드»입니다.
본 대화와 따로 떨어진 자기 작업 공간을 갖고, 일을 마치면 결과만 돌려줘요.
자료 조사를 조사원 여럿에게 한 분야씩 맡기고 요약만 받는 것과 같습니다.
토큰은 클로드가 글을 읽고 쓸 때 세는 단위입니다.
요금제 한도도 이 토큰으로 깎여요.
그래서 토큰이 얼마나 나갔는지가 곧 «얼마나 썼는지»입니다.
제 실험 환경은 이렇습니다.
| 항목 | 값 |
|---|---|
| 맥 | 맥북 M4 Pro · 코어 14개 · 메모리 24GB · macOS 27.0.1 |
| 클로드 코드 | 2.1.287 |
| 본 대화 모델 | Fable 5.1 |
| 서브에이전트 모델 | 하이쿠(Haiku)로 지정 |
| 맡긴 일 | 블로그 원고 파일 하나를 읽고 4줄로 답하기 |
3. 따라 하기 — 이렇게 쟀습니다
Step 1. 서브에이전트마다 같은 일을 줍니다
비교가 되려면 일이 같아야 합니다.
제 맥에 쌓인 블로그 원고 29편을 하나씩 나눠 줬어요.
서브에이전트 하나가 받은 지시문은 이것입니다.
Read 도구로 아래 파일 «하나만» 읽고, 정확히 4줄로만 답해라.
다른 파일을 열거나 다른 도구를 쓰지 마라.
1) 프론트매터의 title 값
2) "## " 로 시작하는 줄의 개수
3) "
클로드 코드 서브에이전트 토큰은 개수에 정비례했습니다.
하나당 약 5만 토큰이에요
시간은 줄었지만 토큰은 정직하게 늘었습니다.
하나당 4.8만~5.5만 토큰이 나갔어요.
16개면 84.9만 토큰입니다.
눈여겨볼 건 «하나당 5만»이라는 숫자입니다.
맡긴 일은 원고 한 편을 읽고 4줄을 답하는 것뿐이었어요.
그런데도 5만이 나갑니다.
서브에이전트마다 자기 지시문과 도구 목록을 처음부터 싣고 출발해서입니다.
일이 작아도 이 기본요금은 매번 붙어요.
5만이라는 값은 제 환경 기준입니다.
저는 스킬과 커넥터를 많이 켜 둔 편이라 기본으로 실리는 양이 큽니다.
여러분 환경에선 다를 수 있어요.
이 숫자가 요금제 한도에서 어떤 비율로 깎이는지도 따로 확인하지 못했습니다.
맥은 정말 아무 일도 없었습니다

맥북 M4 Pro에서 클로드 코드 메모리는 16개 동시 실행 중에도 620MB 안팎이었습니다
| 맥의 상태 | 돌리기 전 | 16개 동시 실행 중 |
|---|---|---|
| 클로드 코드 메모리 | 566MB | 622MB |
| 클로드 코드 CPU(평균) | 10.5% | 12.1% |
| 시스템 여유 메모리 | 58% | 58~59% |
| 발열·성능 경고 | 없음 | 없음 |
24GB 가운데 0.6GB를 쓰는 프로그램이 56MB 더 쓴 겁니다.
그마저 16개 때문이라고 단정하기 어려워요.
대화가 길어지면 메모리는 원래 조금씩 늡니다.
온도는 직접 재지 못했습니다.
다만 macOS가 남기는 발열 경고 기록은 비어 있었습니다.
왜 맥이 멀쩡한가

클로드 코드 서브에이전트가 «생각하는» 일은 맥이 아니라 서버에서 일어납니다
답을 만들어 내는 무거운 계산은 앤트로픽 서버에서 돕니다.
맥이 하는 일은 지시를 보내고, 파일을 읽어 주고, 결과를 받는 것뿐이에요.
서브에이전트가 16개여도 맥에는 «주고받는 창구»가 16개 열릴 뿐입니다.
그래서 «맥 한 대에서 몇 개까지 돌아가나»는 질문의 방향이 조금 틀렸습니다.
맥북 에어든 맥 스튜디오든 이 부분은 비슷할 거예요.
다만 저는 M4 Pro 한 대에서만 재 봤습니다.
5. 그래서 몇 개로 돌릴까 — 저는 4~8개를 권합니다
| 하나씩 차례로 | 4~8개 동시 | 16개 동시 | |
|---|---|---|---|
| 기다리는 시간 | 개수만큼 길어짐 | 가장 느린 하나만큼 | 가장 느린 하나만큼 |
| 토큰 | 개수 × 기본요금 | 개수 × 기본요금 | 개수 × 기본요금 |
| 맥 부담 | 없음 | 없음 | 없음 |
| 결과 검산 | 그때그때 볼 수 있음 | 한눈에 볼 만함 | 몰아서 봐야 함 |
| 맞는 일 | 앞 결과가 다음 일에 필요할 때 | 서로 상관없는 일 여러 개 | 똑같은 일을 수십 건 |
토큰은 어느 쪽이든 같습니다. 동시에 돌린다고 더 나가지 않아요.
차이는 기다리는 시간과, 돌아온 결과를 사람이 확인할 수 있느냐입니다.
제가 4~8개를 권하는 이유는 둘째 때문입니다.
16개가 한꺼번에 돌아오면 다 읽고 검산하기가 버거워요.
그리고 기본으로 정해진 동시 실행 상한이 있습니다.
공식 변경 기록에 이렇게 적혀 있어요.
2.1.217 — Added a cap on concurrently-running subagents
(default 20, override with CLAUDE_CODE_MAX_CONCURRENT_SUBAGENTS)
2.1.224 — Removed the 200-subagent-per-session spawn cap;
(concurrency and depth limits still apply)
풀어 쓰면 이렇습니다. 동시에 달릴 수 있는 서브에이전트는 기본 20개까지입니다.
한 대화에서 200개까지만 만들 수 있던 제한은 없어졌고요. «15~20개»라는 숫자가 자주 나오는 건 이 상한 근처라서일 겁니다.
20개를 넘기면 어떻게 되는지는 해 보지 않았습니다.
6. 돌리기 전에 걸리는 것 — 직접 겪은 셋
빨리 끝났는데 답이 틀렸습니다
3장에서 정답을 셀 수 있는 질문을 넣었다고 했죠.
29개의 답을 제가 직접 센 값과 맞춰 봤습니다.
| 질문 | 맞은 수 |
|---|---|
| 이미지 줄 개수 | 29개 중 29개 |
| 소제목 줄 개수 | 29개 중 25개 |
소제목 개수에서 4개가 틀렸습니다.
전부 실제보다 적게 셌어요.
그중 둘은 코드 예시 안에 들어 있는 줄을 빼고 센 것이라 봐줄 만합니다.
나머지 둘은 그냥 틀렸습니다.
동시에 돌린 결과는 반드시 검산하세요. 16개가 21초 만에 돌아오면 다 맞았으리라 믿고 싶어집니다.
하지만 «세는 일»처럼 정확해야 하는 건 틀린 채로 섞여 옵니다.
숫자가 들어가는 일은 몇 개를 뽑아 직접 맞춰 보세요.
일이 길면 «가장 느린 하나»를 기다립니다
오늘 아침 실제 일에서도 써 봤습니다.
블로그 다섯 곳의 실적 조사를 서브에이전트 5개에 나눠 맡겼어요.
이번엔 일이 제각각이었습니다.
| 서브에이전트 | 걸린 시간 | 토큰 |
|---|---|---|
| 첫째 | 31초 | 7.1만 |
| 둘째 | 31초 | 7.1만 |
| 셋째 | 88초 | 9.5만 |
| 넷째 | 154초 | 12.9만 |
| 다섯째 | 250초 | 15.2만 |
합계는 555초, 실제로 기다린 건 250초였습니다. 2.2배 빨라진 셈이에요.
16개 실험의 14배와는 거리가 멉니다.
일의 크기가 고르지 않으면 가장 큰 일 하나가 전체 시간을 정합니다.
토큰은 다섯이 합쳐 51.8만이 나갔어요.
결과가 올 때마다 본 대화가 깨어납니다
서브에이전트는 뒤에서 돌다가 끝나면 알림을 보냅니다.
16개를 띄웠더니 알림이 여러 번에 나눠 왔어요.
그때마다 본 대화의 클로드가 한 번씩 응답합니다.
이 응답도 토큰을 씁니다.
표의 84.9만은 서브에이전트 몫만 센 값입니다.
본 대화가 쓴 양은 빠져 있어요.
7. 자주 묻는 것
Q. 맥북 에어에서도 16개가 되나요? A. 직접 해 보지 않았습니다.
다만 제 M4 Pro에선 메모리가 56MB 늘었을 뿐이에요.
CPU도 2%포인트 차이였습니다.
무거운 계산이 서버에서 도는 구조라 맥 사양이 걸림돌이 되긴 어려워 보입니다.
Q. 서브에이전트 모델을 싼 걸로 바꾸면 토큰이 줄어드나요? A. 이번엔 하이쿠로만 돌려서 비교하지 못했습니다.
개수에 비례한다는 점은 모델과 상관없을 거예요.
Q. 20개를 넘게 띄우면 어떻게 되나요? A. 해 보지 않았습니다.
공식 변경 기록엔 기본 상한 20개만 적혀 있어요.
그 값을 바꾸는 설정 이름도 함께요.
Q. 어떤 일을 동시에 맡기면 좋은가요? A. 서로 결과를 기다릴 필요가 없는 일입니다.
파일 여러 개를 각각 요약하기, 채널별로 따로 조사하기 같은 것들이요.
앞 단계 결과가 있어야 다음을 할 수 있는 일은 차례로 해야 합니다.
8. 다음 단계
토큰이 한계라는 걸 봤습니다.
다음은 그 한도의 생김새와 아끼는 법이에요.
- 한도가 어떻게 깎이나 → 클로드 요금제의 실체 분석 — 세션은 20배가 맞고, 주간은 6배입니다
- 대화가 길어질 때 → 클로드 코드 compact, 언제 눌러야 하나 — 자동을 기다리면 작업 한가운데서 터집니다
- 기본으로 실리는 양을 보려면 → 클로드 스킬은 그냥 마크다운 파일입니다 — 제 맥의 스킬 75개를 열어 봤습니다
이 글의 수치는 2026년 10월 2일 제 맥북 M4 Pro(메모리 24GB, macOS 27.0.1)의 클로드 코드 2.1.287에서 잰 것입니다.
본 대화는 Fable 5.1, 서브에이전트는 하이쿠였습니다.
시간과 토큰은 클로드 코드가 알려 준 값이고, 메모리와 CPU는 터미널에서 1초마다 기록했습니다.
온도는 재지 못했습니다.
20개를 넘는 동시 실행, 다른 맥, 다른 모델은 해 보지 않았습니다.
동시 실행 상한은 공식 변경 기록(CHANGELOG 2.1.217·2.1.224)을 인용했습니다.
'Claude code' 카테고리의 다른 글
| 클로드 코워크 계약서 엑셀 정리, 10월 6일 클라우드 전환 뒤 해 봤습니다 (0) | 2026.10.06 |
|---|---|
| SuperClaude·Claudia, 지금도 깔아야 하나 — 1년 전 필수 애드온 4개를 제 맥의 내장 기능과 맞대 봤습니다 (0) | 2026.10.03 |
| 클로드 디자인으로 한글 슬라이드 5장 만들어 PPTX 로 내보냈습니다 — 폰트가 살아남는지부터 봤습니다 (0) | 2026.10.01 |
| 클로드 아티팩트로 점심 룰렛 만들어 링크로 돌렸습니다 — 공유를 거둬도 같은 링크로 다시 열립니다 (0) | 2026.09.30 |
| 클로드 엑셀 MCP, 맥에서도 될까 — 엑셀 for Mac·넘버스에 직접 붙여 봤습니다 (0) | 2026.09.29 |