AI 소프트웨어
-

오픈 에이전트 모델 61.7% — 에이전트 AI가 숨기는 24.4%포인트 격차 (10월 1일 AI 브리핑)
Holo4 27B가 OSWorld 2.0에서 61.7%, IBM은 평균 77.4%와 반복 성공 53.0% 사이 24.4%포인트 격차를 공개했습니다. 베라…
-

GPT-6.1 Sol 태스크당 5.47달러 — 캐시 0.10달러가 로컬 LLM 가격 방어선을 눌렀다 (9월 30일 AI 브리핑)
GPT-6.1 Sol은 입력 100만 토큰에 2달러, 캐시는 0.10달러로 Astra의 5분의 1입니다. 태스크당 비용은 5.47달러로 경쟁사 대비…
-

MLPerf 추론 v6.1 — Vera Rubin 3.7배와 에이전트 30배의 실제 계산 (2026년 9월)
Vera Rubin 이 MLPerf 추론 v6.1 에서 전작 대비 3.7배를 냈습니다. 에이전트 벤치마크 30배의 실체, 구글…
-

Isaac ROS 5.0과 젯슨 토르가 알려준 것 — 에이전트가 로봇 코딩하는 시대 (2026년 9월)
NVIDIA Isaac ROS 5.0이 ROS 사용자 130만 명에게 에이전트 개발 워크플로를 열었습니다. Gemini 3.7 Flash는 3주…
-

AI 모델 뉴스 9.28: 모델·툴 동향
새 모델과 도구, 개발자 관점 브리핑. New experts join Google · AI for Societal Impact ·…
-

Ollama vs LM Studio vs llama.cpp — 2026년 9월 공개 실측으로 정리
같은 엔진 3개 포장지 실측: 5060 Ti에서 Ollama −10%, LM Studio 무료. 진짜 변수는 컨텍스트 슬라이더…
-

RTX 4090 24GB LoRA 파인튜닝 — 배치·시퀀스·시간 실측표 (2026년 9월)
8B LoRA 1.6시간, 70B QLoRA 16시간, Unsloth 1.78배. 24GB 상한선과 epoch당 전기세까지.
-

AI 모델 뉴스 9.28: 70B 절반 잘라내니 MMLU 23점, 벤치마크 프로토콜의 민낯
Llama-3.3-70B를 50% 압축해 MMLU에서 기존 블록 제거법보다 23%포인트 앞선 방법이 나왔습니다. MentalHealthBench, 벤치마크 재현 공개, WebGPU…
-

AI 모델 뉴스 9.27: 모델·툴 동향
AI 에이전트가 고객 콜 65%를 스스로 해결하고, 멀티벡터 임베딩을 RTX 3090 한 장 14.5시간에 배운다 —…
-

DeepSeek·Qwen 로컬 설치 실전 — 내 PC에서 돌리는 2026 open-weights 가이드
DeepSeek V4·Qwen3.5·gpt-oss 가중치를 실제로 내려받아 내 GPU에서 돌리는 전 과정. ollama 실측 로그(6.6GB), 장비별 현실 라인업표,…