오늘 하루 54개 글로벌 테크 블로그(OpenAI, Google Research, Simon Willison, HN 프런트페이지, GeekNews, r/LocalLLaMA, Tom’s Hardware, ServeTheHome 등)를 스캔해 GPU·하드웨어·로컬LLM·AI 모델 관련 핵심 소식 10건을 골라냈습니다.
1. NVIDIA, DGX Spark 64GB 공개 — 128GB GB10는 가격 인상
ServeTheHome이 NVIDIA DGX Spark 64GB 모델 공개와 128GB GB10 variant 가격 인상을 보도했습니다. 로컬 LLM 개발자용 소형 AI 워크스테이션 라인업이 확장되는 흐름입니다. 원문
2. 7년 된 Nvidia Shield TV Pro, AI 메모리 부족으로 50% 가격 폭등
Nvidia가 Shield TV Pro 가격을 299달러로 올리고 일반형은 단종했습니다. AI 붐이 메모리 가격을 밀어 올려 수년 전 출시된 스트리밍 박스 가격까지 끌어올린 대표 사례입니다. 원문
3. AI 에이전트는 사람보다 토큰을 5배 쓴다 — 목표는 10배
Futurum CEO 분석: 캐시된 프롬프트 재사용 폭증으로 AI 에이전트 토큰 소비가 인간 사용자의 5배에 달하고 향후 10배로 늘어날 전망. 다만 대부분 이미 읽은 내용을 다시 읽는 셈이라 효율 논쟁도 붙었습니다. 원문
4. OpenAI, GPT-6 패밀리 모델 가이드 공개
OpenAI 공식 블로그가 GPT-6 패밀리 각 모델의 용도·성능·비용을 정리한 실무 가이드를 게시했습니다. 어떤 작업을 어느 모델에 라우팅할지 판단 기준을 제공합니다. 원문
5. 모더, RTX 5090 16핀 헤더에 듀얼 8핀 보드 직결 — 발열 40°C 이하
TechPowerUp 보도: 모드더가 RTX 5090의 16핀 커넥터를 듀얼 8핀 보드로 직결 개조해 선 온도를 40°C 아래로 유지했습니다. 12VHPWR 커넥터 용융 우려를 정면으로 겨냥한 하드웨어 개조입니다. 원문
6. 구글, ‘AI 슬롭’ 신고 폭주로 오픈소스 버그바운티 동결
Google이 OSS VRP 버그바운티 일부 프로그램을 일시 중단했습니다. 유효하지 않은 AI 생성 버그 신고가 쏟아진 여파로, AI 시대 보안 신고 품질 문제가 다시 도마에 올랐습니다. 원문
7. 엔비디아 칩 3억 달러 중국 밀반출 의혹, 테크 CEO 체포
미국 정부가 엔비디아 고성능 칩 약 3억 달러어치를 중국으로 밀반출한 혐의로 테크 기업 CEO를 체포했습니다. AI 칩 수출 통제 단속 강화 흐름을 보여줍니다. 원문
8. “거의 모든 서비스에 기본 하드 예산 캡이 필요해진다” — Simon Willison
HN 프런트페이지·GeekNews에 동시 노출된 에세이. AI 에이전트의 지출 속도가 빨라지는 만큼 API·클라우드·결제 모든 서비스에 기본 예산 상한과 초과 시 자동 중단을 기본값으로 넣어야 한다고 주장합니다. 원문
9. r/LocalLLaMA: “Mistral 차기 출시 언제?”
커뮤니티에서 Mistral 차기 모델 로드맵 질문이 화제. 오픈웨이트 진영의 출시 공백기에 차기 플래그십 기대감이 커지고 있습니다. 원문
10. OpenAI 안전 책임자 사임 — “회사 문화가 망가졌다”
GeekNews 보도: OpenAI 안전 담당 인사가 사임하며 회사 문화에 대한 공개 경고를 남겼습니다. AI 안전 거버넌스를 둘러싼 내부 긴장이 다시 수면 위로 드러났습니다. 원문
더 정확한 GPU 실측 데이터는?
내 GPU에 어떤 LLM이 올라가는지 1초 만에 확인하려면 VRAM Fit Matrix를 방문하세요.
댓글 남기기