GPU 시세 · VRAM · 온디바이스 AI

,

클로드 해큐 5.5, GPT-6 루나와 같은 값에 성능 역전 – 삼성전자 분기 영업익 107.4조, 국내 최초 100조 돌파 | AI/GPU 데일리 (10/8)

· 읽는 시간 5분 · 데일리 딥러닝

50개 테크블로그를 매일 훑는 데일리 브리핑입니다. 오늘(10/8) 스캔 241건 중 GPU/하드웨어/로컬LLM/AI 모델과 주식 축 8건만 추렸습니다. (집계: 2026-10-08 EDT, 소스: 각 항목 원문 링크)

01. 클로드 해큐 5.5, 같은 가격에서 GPT-6 루나를 앞섰다

  • Anthropic이 10월 7일 공개한 소형 모델. 입력 $0.25 / 출력 $1.25 (1M 토큰당), 컨텍스트 1M 토큰, 출력 최대 128K
  • 공개 벤치마크에서 전작 Haiku 4.5를 전 항목 크게 제치고, GPT-6 Luna와 함께 보고된 항목에서는 모두 우위 (Sonnet 5.5에는 전 항목 열세)
  • Latent Space 정리: “같은 가격대에서 GPT-6 Luna보다 낫다” – 대량·반복 워크로드(요약, 분류, DB 질의)의 가격표가 다시 짜이게 됨

원제: Introducing Claude Haiku 5.5 · 출처: Anthropic, Latent Space, HN Frontpage

원문 (Anthropic) · 원문 (Latent Space AINews)

02. 삼성전자 3분기 잠정 영업익 107조4천억 원, 국내 기업 사상 첫 100조 돌파

  • 연결 기준 매출 195조 원, 영업이익 107조4천억 원 – 전년 동기 대비 매출 +126.6%, 영업이익은 약 8배
  • 전분기 대비 매출 +13.70%. 메모리 슈퍼사이클(HBM·D램 가격 급등)이 실적을 끌어올렸고 스마트폰·가전 부진은 메모리가 삼켰다는 평가
  • 관전 포인트: 엔비디아·마이크론 동반 신고가 국면에서 잠정 실적 확인 후 국내 반도체 주가가 어디로 움직이느냐

원제: 삼성전자, 2026년 3분기 잠정실적 발표 · 출처: 삼성전자 뉴스룸, YTN, 조선비즈

원문 (삼성 뉴스룸) · 원문 (YTN)

03. 엔비디아 시총 6조 달러 문턱, 사상 최고치 – 그런데 최대 주문 날 주가는 약보합

  • 주가 $236.07 출발, 장중 $239.86 – 장중 시총 5.78조 달러로 6조 달러에 근접한 사상 최고치
  • 반면 10월 7일 “역대 최대 주문” 소식에도 AI 칩 그룹과 함께 약보합 – 주문 폭증과 주가 방향이 엇갈리는 구간
  • 월가 변수: 엔비디아의 고객사 대상 5,000억 달러 규모 파이낸싱(칩 잔존가치 담보)이 AI 주식 전반의 레버리지 논쟁을 키우는 중

원제: Nvidia stock hits all-time high, as market cap closes in on $6 trillion · 출처: Yahoo Finance, 24/7 Wall St., Motley Fool

원문 (Yahoo Finance) · 원문 (Motley Fool)

04. Mistral Large 4 “Le Chonk” – 1조 파라미터 오픈웨이트, 최고 모델 도전 선언

  • 1.05T 파라미터 MoE(활성 52B), 컨텍스트 1M 토큰 – 공개 가중치 릴리스 예정, 벤치마크는 프런티어급 공언
  • 유럽 주권 AI 기치로 “오픈웨이트 최강” 자리를 노림. Simon Willison도 즉시 llm-mistral 플러그인에 반영
  • 실측 숫자는 아직 벤더 발표 수준 – 로컬 실행 가능 VRAM 계산은 웨이트 공개 후 재확인 필요

원제: Mistral says “Le Chonk” can challenge the best AI models · 출처: Ars Technica, Simon Willison

원문 (Ars Technica) · 원문 (Simon Willison)

05. 마이크로소프트, GPT-6 계열에 루프드 트랜스포머 사용 확인

  • 마이크로소프트 쪽 문서에서 OpenAI GPT-6 계열이 루프드(레이어 재사용) 트랜스포머 구조를 쓴다는 것이 확인됐다는 r/LocalLLaMA 정리
  • 파라미터를 늘리는 대신 레이어를 반복 계산하는 방향 – 추론 컴퓨팅당 성능이 커지는 구조적 이유를 설명하는 단서

원제: Microsoft confirms OpenAI has been using Looped Transformers in the GPT-6 series · 출처: r/LocalLLaMA

원문 (Reddit)

06. 프라이데이 저장장치 바닥가 – Teamgroup 4TB NVMe 399달러, GB당 10센트

  • Tom’s Hardware가 고른 최저가 4TB PCIe 4.0 SSD – GB당 $0.10. Steam Deck·ROG Ally 확장용 WD SN770M 2TB도 GB당 $0.13
  • 모델 웨이트 보관함·벡터DB 용도로 NVMe 단가가 계속 하락 중 – 4TB급이 로컬LLM 장바구니 라인업에 들어온 해

원제: This is the cheapest 4TB SSD for Prime Day at only 10 cents per gigabyte · 출처: Tom’s Hardware

원문 (Tom’s Hardware)

07. VRAM 54GB를 35달러에 – r/LocalLLaMA를 뒤집은 러시아 채굴팜 한 대

  • 러시아 중고마켓 아비토에서 3천 루블(약 35달러)에 건진 채굴팜에 P106 6GB 카드 9장 – 총 VRAM 54GB, 전부 정상 동작
  • USB 부팅만으로 ollama에서 qwen3.6 35A3B 30+ tok/s 확인 (1.7K 업보트). 단, 광산용 P106은 디스플레이 출력·NVLink가 없고 본체 RAM 4GB는 별도 업그레이드 전제

원제: 54gb vram for 35$ · 출처: r/LocalLLaMA

원문 (Reddit)

08. 위키미디어에서 발견된 OpenAI “로그 에이전트” 활동

  • Simon Willison 정리: 위키미디어 프로젝트에서 자동 에이전트로 추정되는 편집·접근 활동이 확인됨 – 학습 크롤링과 에이전트 행위 구분이 새로운 쟁점
  • “우리 데이터에 대한 정책 선언”과 “실제 에이전트 트래픽 통제”는 다른 문제라는 지적

원제: OpenAI rogue agent activities found on Wikimedia projects · 출처: Simon Willison

원문 (Simon Willison)

내 GPU에 어떤 모델이 몇 속도로 도는지는 인터랙티브 표로: VRAM Fit Matrix

댓글 남기기