GPU 시세 · VRAM · 온디바이스 AI

9월 28일 하드웨어 브리핑: 베라 루빈 3.7배와 M5 울트라 GB당 계산

· 읽는 시간 5분 · 데일리 딥러닝

MLPerf 추론 v6.1 결과와 애플 신제품 실측 리뷰가 같은 주에 나왔습니다. 두 소식의 공통점은 코어 수 경쟁이 아니라 ‘박스 전체의 경제학’이라는 점입니다. 제가 원문을 모두 읽고 계산 가능한 숫자만 골라 정리했습니다.

베라 루빈 NVL72의 3.7배는 칩의 성적이 아니다 — 어디서 나오는 숫자인가

NVIDIA 공식 발표(9월 16일)에 따르면 MLPerf Inference v6.1 프리뷰에서 베라 루빈 NVL72는 Qwen3-VL 벤치마크(vLLM + Dynamo 구성)에서 GB300 NVL72 대비 처리량 최대 3.7배, DeepSeek-R1(TensorRT-LLM)에서 2.5배를 기록했습니다. 그런데 제가 더 주목한 숫자는 따로 있습니다. GB300 랙 4개, GPU 288장 구성의 선형 확장 효율 99%, 그리고 6개월 사이 소프트웨어 최적화만으로 v6.0 대비 1.6배가 나온 대목입니다.

제 판단: 3.7배를 ‘칩 성능 3.7배’로 읽으면 틀립니다. GPU 72장 구성은 그대로고, 차이는 NVLink 도메인과 스케줄링에서 나옵니다. 99% 확장은 랙을 더하면 처리량이 거의 비례해 늘어난다는 뜻, 즉 칩 클럭보다 인터커넥트가 병목이라는 정량 증거입니다. 벤치마크 모델이 DeepSeek-R1과 Qwen3-VL이라는 점도 눈에 걸립니다 — 제가 4090 한 장으로 돌리는 것과 같은 계열이라, 위에서 갈고닦은 vLLM 최적화는 언젠가 제 책상 위 설정 파일까지 내려옵니다.

M5 울트라 맥 스튜디오 256GB는 GB당 48달러 — H100의 8분의 1, 단 조건이 있다

IT World Korea 리뷰가 테스트한 최고 사양은 36코어 CPU, 80코어 GPU, 메모리 256GB, 4TB 스토리지에 12,299달러입니다. Geekbench 7 멀티코어 52,350, Metal GPU 360,019, 스토리지는 쓰기 13,941MB/s로 이전 세대 대비 2배, AI 성능은 M3 울트라 대비 최대 4.3배(애플 발표치)입니다. 리뷰자는 헤드리스로 띄우고 LM Studio로 모델을 올려 최대 약 480W 기준 시간당 10센트 안팎의 렌더·추론 서버로 굴렸습니다.

제 판단: 직접 계산해 보면 12,299달러를 256GB로 나누면 GB당 약 48달러. H100 80GB를 3만 달러로 잡는 GB당 375달러의 8분의 1이고, 4090 24GB(약 1,600달러)의 GB당 67달러보다도 쌉니다. 단, 메모리 대역폭은 서버가 압승이라 토큰 생성 속도는 맥이집니다. 그래서 결론이 갈립니다 — 크게 양자화한 모델을 조용히 상시 대기시키는 ‘엔진실’ 용도로는 현존 최고 가성비, 실시간 서빙용이 아닙니다. 용도별 최소 VRAM은 제가 쓴 VRAM 기준표로 대조하세요.

왜 iOS 27은 신형만 강조하고 구형 아이폰에서 더 빨라졌나 — 초 단위 실측

아이폰 11 프로 맥스 실측입니다. 카메라 실행 0.98초에서 0.65초로, 촬영 후 썸네일 확인까지 3.61초에서 2.44초로, 지도 실행은 3.01초에서 1.36초로 2.2배 빨라졌습니다. 발열도 줄었다고 합니다. 단 시리 AI와 애플 인텔리전스는 아이폰 15 프로 이후 전용입니다.

제 판단: AI 기능은 신형에 잠기고 체감 속도 개선은 구형에서 더 크게 나오는 역설. 애니메이션 파이프라인과 백그라운드 관리 손질의 결과로, AI 마케팅의 그늘에서 구형 기기 수명이 사실상 1~2년 더 늘어납니다. 중고 시장에도 파장이 있습니다 — iOS 27을 무리 없이 돌리는 아이폰 12·13 매물의 체감 수명이 길어져 하락 곡선이 완만해질 수 있고, 학습용 GPU 예산과 달리 폰 교체 예산은 미뤄도 되는 이유가 됩니다.

진짜 사진의 신뢰 기준점이 메타데이터에서 카메라 센서로 이동했다

애플 레퍼런스 이미지 백서 정리. 아이폰 18 프로는 셔터를 누르는 순간 픽셀에 시큐어 인클레이브와 프라이빗 클라우드 컴퓨트로 암호화 서명을 찍고, 변경 불가능한 메타데이터와 자체 타임스탬프를 봉인합니다. 애플이 업계 표준 C2PA를 약하다고 지목한 이유는 서명이 촬영 후에 붙고 사진작가의 신원과 이미지가 연결되기 때문 — 분쟁 지역 사진작가에겐 표적이 되는 구조라는 겁니다. 단 메인 카메라 전용, 소급 적용 불가, 출시 초기 중국 미지원, 유럽은 열람만 가능.

제 판단: 신뢰의 닻이 ‘사후 증빙’에서 ‘촬영 순간 서명’으로 옮겨간 게 본질입니다. 동시에 닻이 애플 하나라는 문제가 남습니다 — 뉴스 사진의 상당량이 아이폰으로 찍히는 시장에서 ‘진짜’의 판정권이 한 기업에 귀속되는 셈이고, 중국·유럽 갈림처럼 진위 검증 자체가 지정학으로 분절되기 시작했습니다. C2PA 진영이 센서 단계 서명을 얼마나 빨리 따라붙이는지가 1차 관전 포인트입니다.

자주 묻는 질문

베라 루빈 3.7배가 로컬 사용자랑 무슨 상관이 있나요?

직접 상관은 없지만 벤치마크 모델(DeepSeek-R1, Qwen3-VL)과 추론 프레임워크(vLLM)가 로컬과 동일 계열입니다. 랙 규모에서 검증된 배치·캐시 최적화 기법은 그대로 책상 위 설정에 내려옵니다.

M5 울트라 256GB면 70B 모델을 돌릴 수 있나요?

70B급 4비트 양자화가 약 40GB라 여러 개를 동시에 올려도 남습니다. 대신 대역폭 제한으로 생성 속도는 데스크톱 GPU보다 느릴 수 있어, 저빈도 상시 대기 용도에 최적입니다.

레퍼런스 이미지는 기존 아이폰에서도 되나요?

안 됩니다. 아이폰 18 프로 메인 카메라 전용이고 소급 적용이 없으며, 초기에는 중국 미지원·유럽은 열람만 가능합니다.

출처: NVIDIA 공식 블로그 MLPerf v6.1 결과(9월 16일), IT World Korea 실측 리뷰, 애플 레퍼런스 이미지 백서. 가격·수치는 발표 기준이며 변동될 수 있습니다.

댓글 남기기