OpenAI가 DevDay 2026에서 GPT-6.1 Sol을 내놨는데, 핵심은 지능이 아니라 가격표입니다. 입력 토큰 100만 개당 2달러, 캐시 입력은 0.10달러 — 상위 모델 GPT-6 Astra의 5분의 1입니다. 제가 벤치마크와 단가를 교차 계산해 보니, 이 가격표는 로컬 LLM의 가격 방어선 바로 아래를 정확히 노리고 있습니다. 오늘 AI 소프트웨어 소식 6건을 개발자 비용 관점으로 정리합니다.
GPT-6.1 Sol의 5분의 1 가격은 실제로 무엇을 의미하나
Astra가 입력 10달러·출력 50달러, Sol이 입력 2달러·출력 10달러입니다. DeepSWE v1.1에서 Sol은 Astra와 동급 점수를 5분의 1 비용에 내고, 이전 Sol 최고점보다 6.4%포인트 높습니다. 더 날카로운 건 캐시 가격입니다. 캐시 입력 0.10달러는 표준 입력보다 95% 싸고, 이전 Sol 캐시보다도 50% 저렴합니다. 즉 한 번 태운 컨텍스트를 재사용하는 에이전트 워크로드에서는 체감 차이가 5분의 1이 아니라 그 이상 벌어집니다. 제 판단: OpenAI는 에이전트의 토큰 소비 구조(반복 컨텍스트가 지배적)를 알고 있고, 캐시를 먼저 깎는 건 초보 가격을 후퇴시키지 않으면서 워크로드를 자사 API에 잠그는 수입니다.
태스크 단가로 환산하면 경쟁사와 격차가 얼마나 되나
OpenAI가 공개한 Terminal-Bench Science 태스크당 평균 비용을 그대로 비교합니다. Sol 5.47달러, 경쟁 최상위 23.21달러, Astra 23.80달러. Sol은 경쟁사 대비 76% 저렴하면서 점수는 Astra(68.1%)에 근접합니다. OSWorld 2.0에서는 직전 Sol보다 7%포인트 오르면서 Astra와 격차 2.1%포인트, 태스크당 비용은 약 7분의 1입니다. 환율 1,400원 기준 Sol 태스크당 약 7,700원 — 제가 이전에 로컬 LLM 전기세와 API를 비교했을 때 계산한 로컬 추론 단가보다 여전히 비쌉니다. 제 판단: 대량 추론은 여전히 로컬이 싸고, OpenAI가 파는 건 태스크당 8천 원짜리 ‘대형 태스크의 완수율’입니다.
에이전트가 상주하면 토큰 청구서는 어떻게 되나
dots는 GPT-6 Astra 기반의 상시 에이전트로, 자체 클라우드 컴퓨터와 브라우저, 플러그인으로 연결된 4,000개 앱을 갖고 24/7 작동합니다. Slack에 버그가 뜨면 먼저 조사하고, 청구서를 잊으면 초안까지 만들어 승인만 받는 식입니다. DevDay 전체 발표는 20건이 넘고, 주 12억 사용자에게 네이티브 확장을 개방한다는 문구도 들어 있습니다. Ultrafast는 토큰 생성을 최대 8배 빠르게 합니다. 제가 계산해 보면, 상주 에이전트 하나가 하루 10회 체크를 하고 매번 5만 토큰 컨텍스트를 재사용하면 캐시 입력 기준 일 5달러, 월 150달러입니다. 사람이 쓰는 구독료와 기계가 태우는 토큰비가 별도로 붙는 구조가 되는 겁니다. 제 판단: 에이전트 요금의 과금 단위가 ‘메시지’에서 ‘가동시간’으로 이동하는 신호이고, 이건 로컬 상주 에이전트(예: 제 3090 박스)의 상대 가치를 올려줍니다.
강화학습 안전사례와 에이전트 보안, 같은 흐름의 두 면인가
OpenAI는 최전선 RL 학습 전에 안전사례 문서화를 요구하는 초기 가이드를 공개했습니다. 정렬 학습·격리·감시 3계층, 평가 인식(모델이 시험 중임을 아는 것) 차단 임계값, 변경 불가 트랜스크립트 저장이 골자입니다. NVIDIA도 같은 주제를 운영 쪽에서 씁니다 — 에이전트가 문서의 악성 지시를 받아 고객 데이터를 외부로 내보내려 하면 네트워크 정책이 차단하고 보호된 로그에 도구 호출과 목적지가 남아야 한다는 겁니다. 데이터 수정 권한이 데이터 반출 권한을 자동 포함하지 않는다는 원칙은 IAM의 최소 권한과 동일합니다. 제 판단: 안전담론이 ‘모델 철학’에서 ‘엔지니어링 체크리스트’로 이동 중이고, 이 두 문서를 읽은 팀은 에이전트 도입 체크리스트를 바로 재작성할 수 있습니다.
클린에너지 AI 사례에서 GPU 구매자가 읽어야 할 숫자
NVIDIA가 뉴요크기후주간에서 소개한 사례 중 서던 캘리포니아 에디슨의 계통 연계 심사가 ThinkLabs 에이전트로 30~45일에서 2분으로 단축됐습니다. 30일(43,200분)을 2분으로 줄인 건 21,600배입니다. 그리고 Redwood Materials는 재활용 EV 배터리로 AI 공장의 오프그리드 전원을 만들어 수년을 기다리지 않고 수개월 만에 용량을 켭니다. 제 판단: AI 병목이 연산에서 전력으로 이동했다는 걸 NVIDIA가 공식 자료로 인정한 셈이고, GPU 살 때 전기요금을 계산하던 사람이 다음 단계로 계통 연계 시간을 봐야 하는 이유입니다.
관련 글: MLPerf 추론 v6.1 — Vera Rubin 3.7배의 실제 계산, 로컬 LLM 전기세 vs Claude API 월 비용, Isaac ROS 5.0과 에이전트가 로봇 코딩하는 시대
자주 묻는 질문
GPT-6.1 Sol로 바꾸면 비용이 정확히 5분의 1이 되나요?
표준 입력·출력 토큰은 Astra 대비 5분의 1이 맞습니다. 다만 컨텍스트 재사용이 많은 에이전트 워크로드에서는 캐시 입력 0.10달러 덕에 체감 절감률이 그보다 커지고, 재사용이 없는 일회성 질의 위주면 5분의 1 선에 수렴합니다.
dots는 일반 사용자도 쓸 수 있나요?
Pro, Business Premium, Enterprise 요금 대상으로 해당 지역에서 순차 배포 중입니다. 일반 Plus 요금제는 아직이고, OpenAI 내부에서도 초기 테스트 사례(누락 청구서 자동 처리)가 소개된 단계라 전면 개방은 아닙니다.
이 가격 인하로 로컬 LLM은 의미가 없어지나요?
아닙니다. 태스크당 5.47달러는 완수율 값이고, 제가 실측한 로컬 단가는 이보다 낮은 구간이 많습니다.빈도 높은 추론은 로컬, 복잡한 단일 태스크는 Sol 같은 구분은 더 선명해졌습니다.
출처: OpenAI 공식 발표(2026-09-28~29)와 NVIDIA 공식 블로그 기준. 가격·벤치마크는 발표 시점 수치이며 변동될 수 있습니다.
댓글 남기기