GPU 시세 · VRAM · 온디바이스 AI

Gemini 4 Argon 출력 $10·한도 1M 토큰, SpaceX의 Cursor 인수 $600억 확정 | AI 데일리 (10/8)

· 읽는 시간 5분 · 데일리 딥러닝

미국 AI 기업이 발표한 소식 중 수치가 확인된 5건만 정리했습니다. (집계: 2026-10-08, 소스: 기업 공식 발표 및 1차 보도)

01. Google DeepMind — Gemini 4 Argon API 입력 $2/출력 $10 — 출력 한도 64K→1M 토큰, 도입가 종료 후 $4/$20

  • API 가격: 입력 $2, 출력 $10 (1M 토큰당), 캐시 입력은 입력가의 95% 할인 — 도입 기간 종료 후 입력 $4/출력 $20 적용
  • 출력 토큰 한도 64K에서 1M으로 확대 — 단일 궤적에서 수십만 토큰 생성
  • DeepSWE v1.1 77.9%로 최고 기록, 장기 비디오 이해 LVBench 91.7%, 보안 취약점 복구 평가(CWE-bench) 68%로 공동 1위
  • 사내 실사용: libgav1 Rust 포트에서 SIMD 코드 32K줄 교체, 디코더가 Rust 포트 대비 2.7배 빨라짐 — Fuchsia Zircon 커널은 80만 줄 이상 C/C++→Rust 이주 진행 중
  • 양자 컴퓨팅 서브루틴 최적화 사례: 공개 벤치마크 대비 40% 개선(소요 수 분)

시사점: 1M 출력 한도는 에이전트 장기 작업 설계 변수 — 출력 $10(도입가) 구간에 배치 작업을 몰아넣는 게 종료($20) 전 비용 최소화

출처: Google 공식 블로그 (Gemini 4 Argon 발표문) · 원문

02. Anthropic — Claude Haiku 5.5 입력 $1/출력 $5 — Sonnet 5.5 캐시 읽기 20센트→10센트 반값

  • Haiku 5.5 API 가격: 입력 $1, 출력 $5 (1M 토큰당) — 이전 모델 요청의 약 90%를 차지하는 10만 토큰 이하 프롬프트에서 구형 대비 입출력 모두 최대 90% 저렴
  • Sonnet 5.5 캐시 읽기 가격 $0.20→$0.10/Mtoken 인하 — 캐시 토큰 비중이 커서 에이전트 워크로드 비용 약 20% 절감 전망(사측 추산)
  • OSWorld 2.1(실제 컴퓨터 에이전트 작업) 72.4% — OpenAI GPT-6 Luna가 앞선 6개 시험 전부에서 역전, Opus 4.5 대비 1.5점 상회
  • 테스트 고객 Asana: AI Teammates 에이전트 평가에서 작업 완료 지연이 기존 사용 모델 대비 30% 이상 감소
  • Claude Max 5x 구독에 월 API 크레딧 $100, Max 20x는 2배 — 이번 주부터 지급

시사점: 작은 모델 가격이 초당 추론 비용을 기준으로 다시 정리되는 국면 — 로컬 GPU 구축 판단 기준도 ‘서버 API $1/M 대비 어디서 역전되나’로 이동

출처: SiliconANGLE 보도 (Anthropic 발표 수치 인용) · 원문

03. Microsoft — MAI-Code-1.1-Flash 로컬 배포 — 푸트프린트 53GB, 풀 컨텍스트 피크 75.5GB, 권장 RAM 120GB+

  • 10월 7일(미국 기준) 업데이트: Copilot용 코딩 모델을 개발자 머신에서 다운로드·실행 가능 — 모델 푸트프린트 53GB, 풀 컨텍스트 피크 메모리 75.5GB, 권장 RAM 120GB 이상
  • SWE-bench Verified 72.6%, Terminal-Bench 2.1 62.9% — 사용 토큰은 경쟁 모델 대비 적은 편(모델 카드 기준)
  • 호스팅 API 가격은 입력 $0.20, 캐시 입력 $0.02, 출력 $1.20 (1M 토큰당)
  • 6월 프리디세세서 대비 Terminal-Bench 22%, .NET 작업 15% 개선, 태스크 완료 토큰 25% 감소(사측 주장)
  • 측정 기준 머신은 Surface Laptop Ultra(RTX Spark Superchip, 최대 128GB 통합 메모리) — 128GB 구성의 GPU 주소 지정 가능 메모리는 전체 시스템 메모리보다 작음

시사점: API 입력 $0.20과 로컬 120GB 워크스테이션의 손익분기점은 사용량에 달려 — 호스팅 대비 로컬의 명분은 비용이 아니라 데이터 비거주

출처: Kingy AI 분석 (Microsoft 모델 카드·공식 수치 인용) · 원문

04. SpaceX — SpaceX, AI 코딩 스타트업 Cursor를 $600억 주식 교환으로 인수 확정 — 올해 말 클로징

  • 인수 금액 $600억 전액 주식 교환 — SEC 공시 기반, 올해 말 종료 예정
  • 4월 제휴 당시 조건은 ‘Cursor에 $100억 투자 또는 $600억 인수’ 양자택일이었고, 두 달 만에 인수 쪽으로 확정
  • Cursor는 4월에 Andreessen Horowitz·Nvidia 등으로부터 약 $20억 펀딩을 협상 중이었으나, 그 자금을 확보해도 손익분기 달성은 불가능했다는 보도(TechCrunch)
  • Cursor의 전년 누적 자금 조달액은 $23억

시사점: Cursor의 기준선이 $600억으로 올라감 — 후발 코딩 에이전트 도구(Amp, Windsurf 등)의 후속 협상 단가에 그대로 반영

출처: Engadget 보도 (SEC 공시 링크 포함) · 원문

05. Google — SynthID Detector 웹 도구 공개 — 누적 워터마크 1,800억 건, 내장 검증은 일 100만 요청

  • 2023년 이후 SynthID 워터마크 누적: 이미지·비디오 1,800억 건 이상, 오디오 24만 년 분량
  • Search·Gemini 앱·Chrome 내장 검증 기능 처리량 일 100만 요청 이상 — 이번에 별도 웹 도구(SynthID Detector)로 독립 공개

시사점: 플랫폼 내장 검증만 하던 단계에서 일반 공개 도구로 전환 — AI 생성물 표시 의무화 논의가 진행 중인 규제 시장에서 유통 단계 검증 요구가 커질 가능성

출처: Google 공식 블로그 발표 · 원문

댓글 남기기