AI 소프트웨어
-

Ollama vs LM Studio vs llama.cpp — 2026년 9월 공개 실측으로 정리
같은 엔진 3개 포장지 실측: 5060 Ti에서 Ollama −10%, LM Studio 무료. 진짜 변수는 컨텍스트 슬라이더…
-

RTX 4090 24GB LoRA 파인튜닝 — 배치·시퀀스·시간 실측표 (2026년 9월)
8B LoRA 1.6시간, 70B QLoRA 16시간, Unsloth 1.78배. 24GB 상한선과 epoch당 전기세까지.
-

AI 모델 뉴스 9.28: 70B 절반 잘라내니 MMLU 23점, 벤치마크 프로토콜의 민낯
Llama-3.3-70B를 50% 압축해 MMLU에서 기존 블록 제거법보다 23%포인트 앞선 방법이 나왔습니다. MentalHealthBench, 벤치마크 재현 공개, WebGPU…
-

AI 모델 뉴스 9.27: 모델·툴 동향
AI 에이전트가 고객 콜 65%를 스스로 해결하고, 멀티벡터 임베딩을 RTX 3090 한 장 14.5시간에 배운다 —…
-

DeepSeek·Qwen 로컬 설치 실전 — 내 PC에서 돌리는 2026 open-weights 가이드
DeepSeek V4·Qwen3.5·gpt-oss 가중치를 실제로 내려받아 내 GPU에서 돌리는 전 과정. ollama 실측 로그(6.6GB), 장비별 현실 라인업표,…
-

AI 모델 뉴스 9.26: 모델과 도구 동향 라운드업
Codex 사례를 시간당 3만원 인건리로 환산하면 도구는 이미 공짜, 컨텍스트 수집이 경쟁력이고 추론 단계가 매출원가다. GGUF…
-

AI 모델 뉴스 9.25 저녁 — Codex 데모 자동화, GGUF를 Transformers로, 광고 60개국
Codex 데모 자동화로 엔지니어 월 40~60시간이 벌어진 사례부터, ChatGPT 광고의 동남아 7개국 확장(출시 200일 연환산 10억…
-

AI 모델 뉴스 9.25 — Academy 2년 400만, 우크라이나 사이버 방어
OpenAI Academy 2년 접점 400만 명, CERT-UA 연 6,000건 사이버 사고 속 Daybreak 제공 — 9월…