(출처=오픈AI 블로그)

오픈AI, GPT-6 솔·루나 출시

오픈AI는 GPT-6 아스트라에 이어 GPT-6 솔과 GPT-6 루나를 출시한다고 23일 밝혔다.

업무의 복잡도와 규모, 요구되는 속도, 예산에 따라 적합한 모델을 선택할 수 있도록 한 것이다.

GPT-6 솔과 루나는 GPT-6 아스트라와 유사한 방식으로 학습했으며, 전문 업무, 사실 정확성, 코딩, 컴퓨터 사용, 정렬 등에서 각각 GPT-5.6 솔과 GPT-5.6 루나보다 성능을 높였다.

GPT-6 아스트라가 높은 수준의 성능이 필요한 중요 작업을 위한 모델이라면, GPT-6 솔과 루나는 향상된 성능을 더 빠르고 비용 효율적으로 제공해 더 다양한 일상 업무와 서비스에서 GPT-6를 활용할 수 있도록 한 모델이다.

AutomationBench는 영업, 마케팅, 운영, 고객 지원, 재무, 인사 등 실제 업무 환경에서 47개 도구를 활용해 업무를 처음부터 끝까지 수행하는 능력을 평가한다. GPT-6 솔은 xhigh 추론 수준에서 33.2%를 기록해 GPT-6 아스트라의 low 추론 수준 점수인 30.3%를 웃돌았다. GPT-6 루나는 high 추론 수준에서 GPT-5.6 루나보다 5.4%포인트 높은 점수를 기록했으며, 작업당 비용은 58% 낮았다. 추론 수준은 모델이 문제 해결에 투입하는 추론 자원의 설정을 뜻한다. 복잡한 작업에서는 높여 성능을 우선하고, 간단한 작업에서는 낮춰 속도와 비용 효율을 높일 수 있다.

오픈AI는 이용자가 이전 모델의 사실 오류를 지적했던 비식별화된 실제 챗GPT 대화를 바탕으로 사실 정확성을 평가했다. GPT-6 솔은 GPT-5.6 솔보다 약 절반 수준의 오류를 기록했으며, 더 낮은 비용으로 GPT-6 아스트라 수준에 근접한 사실 정확성을 보였다. GPT-6 루나 역시 높은 추론 수준에서 GPT-5.6 솔과 비슷한 수준의 정확성을 약 100분의 1 비용으로 기록했다. 단, 이 평가는 오류가 발생하기 쉬운 대화를 선별한 것으로, 일반적인 챗GPT 사용 환경에서의 사실 오류 발생률을 의미하지 않는다.

GPT-6 솔과 루나는 코딩 성능과 비용 효율을 개선했다. 기술 및 코딩 대화에서는 전문용어와 어색한 표현, 불필요한 세부 설명을 줄여 핵심을 더욱 명확하고 간결하게 전달한다.

GPT-6 솔과 루나의 AutomationBench 벤치마크 결과(출처=오픈AI)

코딩 작업에서 자신이 수행한 내용을 설명하는 정확성도 높였다. 오픈AI 내부 평가에서 수행한 코딩 작업을 사실과 다르게 설명한 응답 비율은 GPT-6 솔 1.3%, GPT-6 루나 2.8%로, 각각 GPT-5.6 솔의 10.4%, GPT-5.6 루나의 9.5%보다 낮았다. 이 평가는 사실과 다른 설명을 유도하도록 의도적으로 선정한 어려운 코딩 작업을 대상으로 했으며, 해당 수치는 일반적인 사용 환경에서 이러한 설명이 발생하는 비율을 나타내지 않는다.

◈ AI시대를 선도하는 Voice AI(온라인)

일시 : 2026년 9월 30일 (수) 14:00 ~ 15:00
장소 : 온라인 웨비나

개발자를 위한 프롬프트 캐싱도 개선했다. 프롬프트 캐싱은 반복해서 사용하는 입력 문맥을 다시 처리하지 않고 재사용해 응답 속도와 비용을 줄이는 기능이다. GPT-6에서는 기본 캐시 적중률을 높였으며, 캐시된 입력 토큰에는 90% 할인된 가격이 적용된다. 깃허브는 최근 수개월간 이러한 개선으로 새로 처리해야 하는 프롬프트 토큰의 비중이 50% 이상 감소했다고 밝혔다.

OSWorld 2.0은 AI가 컴퓨터를 직접 조작하며 여러 단계로 이어지는 일상 및 전문 업무를 수행하는 능력을 평가한다. 오프라인 평가에서 GPT-6 솔과 루나는 각각의 이전 세대 모델보다 비용 효율을 높였다. 특히 GPT-6 루나는 max 추론 수준에서 GPT-5.6 솔의 medium 추론 수준보다 높은 성능을 약 10분의 1 비용으로 기록했다.

GPT-6 솔과 GPT-6 루나는 플러스, 프로, 비즈니스, 엔터프라이즈, 에듀 이용자를 대상으로 챗GPT 워크와 코덱스에서 제공된다. 무료·고 요금제 이용자는 데스크톱 앱에서 GPT-6 루나를 사용할 수 있다.

API에서는 각각 gpt-6-sol, gpt-6-luna로 제공된다. GPT-6 솔은 입력 100만 토큰당 2달러, 출력 100만 토큰당 10달러로 GPT-5.6 솔의 프로모션 가격보다 50% 낮다. GPT-6 루나는 입력 100만 토큰당 0.10달러, 출력 100만 토큰당 0.50달러로 GPT-5.6 루나의 프로모션 가격보다 50% 낮다. 두 모델은 출시 당일 챗GPT 워크와 코덱스에 순차적으로 적용되며, 챗GPT의 일반 채팅에는 아직 제공되지 않는다.

글. 바이라인네트워크
<김우용 기자>yong2@byline.network

일간 바이라인 구독하기

답글 남기기

이메일 주소는 공개되지 않습니다. 필수 필드는 *로 표시됩니다


The reCAPTCHA verification period has expired. Please reload the page.