오픈AI, GPT-6 솔·루나 출시
오픈AI는 GPT-6 아스트라에 이어 GPT-6 솔과 GPT-6 루나를 출시한다고 23일 밝혔다.
업무의 복잡도와 규모, 요구되는 속도, 예산에 따라 적합한 모델을 선택할 수 있도록 한 것이다.
GPT-6 솔과 루나는 GPT-6 아스트라와 유사한 방식으로 학습했으며, 전문 업무, 사실 정확성, 코딩, 컴퓨터 사용, 정렬 등에서 각각 GPT-5.6 솔과 GPT-5.6 루나보다 성능을 높였다.
GPT-6 아스트라가 높은 수준의 성능이 필요한 중요 작업을 위한 모델이라면, GPT-6 솔과 루나는 향상된 성능을 더 빠르고 비용 효율적으로 제공해 더 다양한 일상 업무와 서비스에서 GPT-6를 활용할 수 있도록 한 모델이다.
AutomationBench는 영업, 마케팅, 운영, 고객 지원, 재무, 인사 등 실제 업무 환경에서 47개 도구를 활용해 업무를 처음부터 끝까지 수행하는 능력을 평가한다. GPT-6 솔은 xhigh 추론 수준에서 33.2%를 기록해 GPT-6 아스트라의 low 추론 수준 점수인 30.3%를 웃돌았다. GPT-6 루나는 high 추론 수준에서 GPT-5.6 루나보다 5.4%포인트 높은 점수를 기록했으며, 작업당 비용은 58% 낮았다. 추론 수준은 모델이 문제 해결에 투입하는 추론 자원의 설정을 뜻한다. 복잡한 작업에서는 높여 성능을 우선하고, 간단한 작업에서는 낮춰 속도와 비용 효율을 높일 수 있다.
오픈AI는 이용자가 이전 모델의 사실 오류를 지적했던 비식별화된 실제 챗GPT 대화를 바탕으로 사실 정확성을 평가했다. GPT-6 솔은 GPT-5.6 솔보다 약 절반 수준의 오류를 기록했으며, 더 낮은 비용으로 GPT-6 아스트라 수준에 근접한 사실 정확성을 보였다. GPT-6 루나 역시 높은 추론 수준에서 GPT-5.6 솔과 비슷한 수준의 정확성을 약 100분의 1 비용으로 기록했다. 단, 이 평가는 오류가 발생하기 쉬운 대화를 선별한 것으로, 일반적인 챗GPT 사용 환경에서의 사실 오류 발생률을 의미하지 않는다.
GPT-6 솔과 루나는 코딩 성능과 비용 효율을 개선했다. 기술 및 코딩 대화에서는 전문용어와 어색한 표현, 불필요한 세부 설명을 줄여 핵심을 더욱 명확하고 간결하게 전달한다.

코딩 작업에서 자신이 수행한 내용을 설명하는 정확성도 높였다. 오픈AI 내부 평가에서 수행한 코딩 작업을 사실과 다르게 설명한 응답 비율은 GPT-6 솔 1.3%, GPT-6 루나 2.8%로, 각각 GPT-5.6 솔의 10.4%, GPT-5.6 루나의 9.5%보다 낮았다. 이 평가는 사실과 다른 설명을 유도하도록 의도적으로 선정한 어려운 코딩 작업을 대상으로 했으며, 해당 수치는 일반적인 사용 환경에서 이러한 설명이 발생하는 비율을 나타내지 않는다.
일시 : 2026년 9월 30일 (수) 14:00 ~ 15:00
장소 : 온라인 웨비나
개발자를 위한 프롬프트 캐싱도 개선했다. 프롬프트 캐싱은 반복해서 사용하는 입력 문맥을 다시 처리하지 않고 재사용해 응답 속도와 비용을 줄이는 기능이다. GPT-6에서는 기본 캐시 적중률을 높였으며, 캐시된 입력 토큰에는 90% 할인된 가격이 적용된다. 깃허브는 최근 수개월간 이러한 개선으로 새로 처리해야 하는 프롬프트 토큰의 비중이 50% 이상 감소했다고 밝혔다.
OSWorld 2.0은 AI가 컴퓨터를 직접 조작하며 여러 단계로 이어지는 일상 및 전문 업무를 수행하는 능력을 평가한다. 오프라인 평가에서 GPT-6 솔과 루나는 각각의 이전 세대 모델보다 비용 효율을 높였다. 특히 GPT-6 루나는 max 추론 수준에서 GPT-5.6 솔의 medium 추론 수준보다 높은 성능을 약 10분의 1 비용으로 기록했다.
GPT-6 솔과 GPT-6 루나는 플러스, 프로, 비즈니스, 엔터프라이즈, 에듀 이용자를 대상으로 챗GPT 워크와 코덱스에서 제공된다. 무료·고 요금제 이용자는 데스크톱 앱에서 GPT-6 루나를 사용할 수 있다.
API에서는 각각 gpt-6-sol, gpt-6-luna로 제공된다. GPT-6 솔은 입력 100만 토큰당 2달러, 출력 100만 토큰당 10달러로 GPT-5.6 솔의 프로모션 가격보다 50% 낮다. GPT-6 루나는 입력 100만 토큰당 0.10달러, 출력 100만 토큰당 0.50달러로 GPT-5.6 루나의 프로모션 가격보다 50% 낮다. 두 모델은 출시 당일 챗GPT 워크와 코덱스에 순차적으로 적용되며, 챗GPT의 일반 채팅에는 아직 제공되지 않는다.
글. 바이라인네트워크
<김우용 기자>yong2@byline.network
함께 보면 좋은 자료


