"맥 하나 더는 풀 하나와 벽 하나를 더해. 벽은 풀보다 250배 좁아. 그 비율이 기계 여럿과 더 큰 기계 하나의 차이 전부야."
자라는 두 방식
풀은 위로 자라거나(더 넓은 버스, 더 밀도 높은 다이, 배선과 밀도 레슨) 밖으로 자라. 케이블 위의 기계 하나 더. 함대의 선들 레슨은 케이블을 UltraFusion의 2.5 TB/s에 대해 Thunderbolt 5의 10 GB/s로 값 매겼고, 큰 모델 트랙은 공개 결과를 읽었어. 이미 하나에 들어가는 모델에서 맥 둘에 1.3배, 넷에 1.6배. 그리고 다른 모델로 맥 다섯 파이프라인을 돌린 별개의 실행에선 다섯째가 아무것도 못 샀어. 코드 블록이 두 성장을 나란히 놓아. 스케일업은 들어가는 모든 모델의 상한을 올려. 1,229 GB/s의 M5 Ultra는 M3 Ultra가 57로 디코드하는 27B를 85로, 케이블 없이. 스케일아웃은 안 들어가던 모델의 상한만 올리고, 모든 토큰의 모든 레이어에 좁은 선의 횡단을 청구해. Studio 둘은 작업 집합 996 GB와 두 절반 사이의 250 대 1 벽이야. 1,024 GB Studio 하나가 아니고, 애플이 출하하는 어떤 케이블도 그걸 하나로 만들지 않아.
애플 자신의 스케일아웃, 그리고 그 인구
애플은 macOS 26.2에 Thunderbolt 위의 RDMA를 출하하며 "distributed AI inference using MLX"를 용례로 이름 댔고, MLX의 분산 백엔드가 일주일 안에 뒤따랐어. 이 집의 독트린은 그 움직임을 보도가 아니라 인구로 읽어. mini와 Studio는 애플 데스크톱 라인의 양 끝이고, mini 구매자가 시장의 몸통이고 Studio 구매자는 꼬리고, mini에 메모리가 부족하면 그 구매자는 mini를 짝지어. 그러니 멀티 호스트 마케팅은 mini 쌍을 겨냥해. 버그를 드러내고 고칠 만큼 큰 체이닝 인구가 형성될 수 있는 곳. Ultra 쌍은 꼬리 안의 꼬리야. 독트린의 말로 로컬 AI가 꼬리에서 몸통으로 건너갔다는 신호는 mini 쌍이 흔해지는 것이지 M5 Ultra 리뷰가 아니야. 판단이고, 퀘스트는 그렇게 실어. 산수가 더하는 건 mini 쌍이 같은 10 GB/s 벽 뒤의 64 GB 풀 둘이라는 것. mini 하나론 안 되는 모델이 들어가고 선의 값으로 디코드해. Studio 쌍이 그럴 것과 정확히 같게.
숙제
스케일아웃의 숙제는 선이야. 열 배 넓은 선, 맥 사이 100 GB/s, NVLink의 10분의 1이면 레이어당 횡단을 배치 뒤에 숨길 수 있는 범위에 두고, 라이벌의 C2C 같은 일관 링크는 맥 둘을 페이지 테이블 하나 뒤에 두어. 두 계층 레슨의 모양에서 둘째 계층이 다른 상자에 있는 것. 어느 것도 맥엔 없고, 독트린의 읽기는 그걸 필요로 하는 인구가 시장의 몸통이 되기 전까진 어느 것도 없을 거라는 것이야. 그때까지 맥의 스케일아웃은 로딩 경로고 시연이고, 이 집의 함대는 반대로 지어졌어. 토큰을 절대 나누지 않는 맥 아홉, 각각 자기 일이 필요로 하는 풀에 맞춰진 크기, 요청과 결과를 나르고(함대 트랙) 토큰당 바이트는 절대 안 나르는 선들로 이어진. 다이가 오면 스케일업하고, 선이 오면 스케일아웃하고, 둘 다 오기 전까지 풀은 패키지 하나고 정직한 문장은 그렇게 말하는 거야.